Alibaba

Qwen3-VL-235B-A22B-Thinking

Tekst
Stopgezet Stopgezet op 2026-10-10.

Qwen3-VL-vision-MoE die altijd eerst denkt; 131K context; beeldinvoer via OpenAI-compatibele API

Modelgezondheid Onvoldoende gegevens
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3-vl-235b-a22b-thinking",
  "messages": [
    {
      "role": "user",
      "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3-vl-235b-a22b-thinking",
    messages=[{"role": "user", "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3-vl-235b-a22b-thinking",
  messages: [{ role: "user", content: "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Waarvoor Qwen3-VL-235B-A22B-Thinking gebouwd is

Qwen3-VL-235B-A22B-Thinking is de redeneerversie van Qwen3-VL, de vlaggenschipfamilie van vision-language-modellen van Alibaba Qwen. Het is een Mixture-of-Experts-model met 235B parameters in totaal, waarvan er per token 22B actief zijn. Het verscheen op 23 september 2025 met open weights onder Apache 2.0. Alibaba heeft het afgestemd op multimodaal redeneren, met de nadruk op STEM- en wiskundeproblemen, OCR en het begrijpen van afbeeldingen en video.

Het model werkt alleen in thinking-modus: elk antwoord begint met een redeneerstap, en die stap kun je niet uitzetten. De API van Alibaba biedt het aan met een contextvenster van 131.072 tokens en maximaal 32.768 outputtokens.

Op RunAPI roep je qwen3-vl-235b-a22b-thinking aan via het OpenAI-compatibele Chat Completions-endpoint (/v1/chat/completions), met een OpenAI-SDK die naar https://runapi.ai/v1 wijst. Stuur afbeeldingen als image_url-onderdelen mee naast de tekst in messages[].content[]. Alibaba rekent Qwen3-VL inmiddels tot zijn legacy-modellen, omdat de Qwen3.5- en Qwen3.6-modellen afbeeldingen zelf kunnen lezen.

Model-ID
qwen3-vl-235b-a22b-thinking
Uitgebracht
23 september 2025
Architectuur
MoE, 235B totaal / 22B actief, gewichten onder Apache 2.0
Contextvenster
131.072 tokens
Maximale output
32.768 tokens
Thinking
Altijd aan
Endpoint op RunAPI
OpenAI Chat Completions, tekst- en beeldinvoer
Specificaties

Technische details

Provider Alibaba
Model-ID qwen3-vl-235b-a22b-thinking
Modaliteit Tekst
Taaktypen Synchronous
API-eindpunt /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
/v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
Factureringseenheid 1K tokens
Catalogusstatus Stopgezet
ZO WERKT HET

Gebruik dit model in 3 stappen

  1. Maak je sleutel

    Meld je gratis aan en maak vanuit het dashboard een API-sleutel voor qwen3-vl-235b-a22b-thinking.

  2. Stuur een verzoek

    Stuur een POST-verzoek naar /v1/chat/completions met de model-ID qwen3-vl-235b-a22b-thinking en je parameters.

  3. Resultaten ophalen

    Lees het voltooide qwen3-vl-235b-a22b-thinking-antwoord rechtstreeks van het endpoint.

Wat dit model biedt

Endpointdekking

Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.

Verbruiksgebaseerde facturering

Gemeten aan de hand van 1K tokens, zonder abonnementsvereiste.

API-REFERENTIE

Endpoint-specificatie

Endpoint
POST /v1/chat/completions
Model-ID
qwen3-vl-235b-a22b-thinking
Taaktypen
chat_completion

Requestparameters

Voor dit endpoint zijn geen requestparameters gepubliceerd.

USE CASES

Klantenservice

Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.

Documentanalyse

Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.

Codegeneratie

Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.

FAQ

Veelgestelde vragen over Qwen3-VL-235B-A22B-Thinking

Wat is het verschil tussen de Thinking- en de Instruct-versie van Qwen3-VL-235B-A22B?

Beide draaien op hetzelfde Mixture-of-Experts-model van 235B met 22B actieve parameters. De Thinking-versie redeneert altijd voordat ze antwoordt en is afgestemd op STEM, wiskunde en multimodaal redeneren. De Instruct-versie antwoordt direct en richt zich op visueel programmeren, ruimtelijke waarneming, het begrijpen van lange video's en OCR.

Hoe stuur ik een afbeelding naar qwen3-vl-235b-a22b-thinking?

Gebruik het Chat Completions-endpoint en zet in messages[].content[] een image_url-onderdeel naast het tekstonderdeel. Dat is dezelfde requestvorm die de OpenAI-SDK voor vision gebruikt. Alibaba noemt voor dit model ook video-invoer; videorequests zijn op RunAPI niet geverifieerd.

Kan ik thinking uitzetten bij dit model?

Nee. Alibaba levert het als model dat uitsluitend in thinking-modus werkt. Wil je antwoorden zonder redeneerstap, roep dan qwen3-vl-235b-a22b-instruct aan.

Kies ik voor beeldtaken Qwen3-VL of een Qwen3.5-model?

Alibaba rekent Qwen3-VL tot zijn legacy-modellen en stelt dat Qwen3.5-122B-A10B op vision beter presteert dan Qwen3-VL-235B. Probeer voor nieuwe beeldworkloads dus eerst een Qwen3.5- of Qwen3.6-model, en houd Qwen3-VL aan voor prompts en evaluaties die er al op gebouwd zijn.

Hoe selecteer ik qwen3-vl-235b-a22b-thinking?

Geef de model-ID door die in de quickstart wordt getoond.

Wat is de rate limit voor deze variant?

Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.

Kan ik later van variant wisselen?

Ja — variant is een flag. Wissel door de modelparameter aan te passen.

Ondersteunt het streaming?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Waar meld ik kwaliteitsproblemen?

Open een issue in de publieke GitHub-repo of mail support.

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op