Endpoint-Abdeckung
Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
Qwen3-VL-Vision-MoE nur mit Thinking; 131K Kontext; Bildeingabe über OpenAI-kompatible API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt." }]
});
9 Versionen verfügbar
Qwen3-VL-235B-A22B-Thinking ist die Reasoning-Version von Qwen3-VL, der führenden Vision-Language-Modellfamilie von Alibaba Qwen. Das Mixture-of-Experts-Modell hat 235B Parameter insgesamt, davon 22B aktiv pro Token, und erschien am 23. September 2025 mit offenen Gewichten unter Apache 2.0. Alibaba hat es auf multimodales Reasoning ausgerichtet, mit Schwerpunkt auf MINT- und Mathematikaufgaben, OCR sowie Bild- und Videoverständnis.
Das Modell arbeitet ausschließlich mit Thinking: Jede Antwort beginnt mit einem Reasoning-Schritt, der sich nicht abschalten lässt. Alibabas API stellt es mit einem Kontextfenster von 131.072 Tokens und bis zu 32.768 Output-Tokens bereit.
Bei RunAPI rufen Sie qwen3-vl-235b-a22b-thinking über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions) auf, mit einem OpenAI SDK, das auf https://runapi.ai/v1 zeigt. Bilder senden Sie als image_url-Teile neben dem Text in messages[].content[]. Alibaba führt Qwen3-VL inzwischen bei seinen Legacy-Modellen, weil die Qwen3.5- und Qwen3.6-Modelle Bilder nativ verarbeiten.
| Anbieter | Alibaba |
| Modell-ID | qwen3-vl-235b-a22b-thinking |
| Modalität | Text |
| Aufgabentypen | Synchronous |
| API-Endpunkt | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| Abrechnungseinheit | 1K-Token |
| Katalogstatus | Eingestellt |
Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für qwen3-vl-235b-a22b-thinking.
Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID qwen3-vl-235b-a22b-thinking und deinen Parametern.
Lies die fertige qwen3-vl-235b-a22b-thinking-Antwort direkt vom Endpoint.
Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
Gemessen nach 1K-Token, ohne Abo-Anforderung.
Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.
Nutze LLMs für Chat und Reasoning.
Generiere und prüfe Implementierungsarbeit.
Verbinde Modelle mit Backend-Tasks.
Beide nutzen dasselbe 235B-Mixture-of-Experts-Modell mit 22B aktiven Parametern. Die Thinking-Version denkt vor jeder Antwort nach und ist auf MINT, Mathematik und multimodales Reasoning abgestimmt. Die Instruct-Version antwortet direkt und zielt auf visuelles Coding, räumliche Wahrnehmung, das Verständnis langer Videos und OCR.
Nutzen Sie den Chat-Completions-Endpunkt und fügen Sie in messages[].content[] neben dem Textteil einen image_url-Teil hinzu, also dieselbe Request-Form, die das OpenAI SDK für Vision verwendet. Alibaba nennt für dieses Modell auch Videoeingabe; Video-Requests sind bei RunAPI nicht verifiziert.
Nein. Alibaba liefert es als reines Thinking-Modell aus. Wenn Sie Antworten ohne Reasoning-Schritt brauchen, rufen Sie stattdessen qwen3-vl-235b-a22b-instruct auf.
Alibaba führt Qwen3-VL bei seinen Legacy-Modellen und gibt an, dass die Vision-Fähigkeiten von Qwen3.5-122B-A10B die von Qwen3-VL-235B übertreffen. Testen Sie für neue Bild-Workloads zuerst ein Qwen3.5- oder Qwen3.6-Modell und behalten Sie Qwen3-VL für Prompts und Evaluierungen, die bereits darauf aufbauen.
Übergib die im Quickstart angezeigte Modell-ID.
Ja. Preise werden pro Aufruf oder Einheit gemessen.
Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.
Kontakt aufnehmen