Pokrycie endpointów
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Wizyjny MoE Qwen3-VL, który zawsze najpierw rozumuje; kontekst 131K; obrazy przez API zgodne z OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi." }]
});
9 dostępnych wariantów
Qwen3-VL-235B-A22B-Thinking to wersja z rozumowaniem modelu Qwen3-VL, flagowej rodziny modeli wizyjno-językowych od Alibaba Qwen. Jest to model Mixture-of-Experts z 235B parametrów łącznie, z których 22B jest aktywnych na token. Został wydany z otwartymi wagami na licencji Apache 2.0 23 września 2025 roku. Alibaba dostroiła go do rozumowania multimodalnego, ze szczególnym naciskiem na zadania z nauk ścisłych i matematyki, OCR oraz rozumienie obrazów i wideo.
Model działa wyłącznie w trybie thinking: każda odpowiedź zaczyna się od etapu rozumowania, którego nie da się wyłączyć. API Alibaba udostępnia go z oknem kontekstu 131 072 tokenów i maksymalnie 32 768 tokenami wyjściowymi.
W RunAPI wywołujesz qwen3-vl-235b-a22b-thinking przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions), korzystając z SDK OpenAI skierowanego na https://runapi.ai/v1. Obrazy wysyłaj jako części image_url obok tekstu w messages[].content[]. Alibaba zalicza już Qwen3-VL do swoich modeli legacy, ponieważ modele Qwen3.5 i Qwen3.6 natywnie odczytują obrazy.
| Dostawca | Alibaba |
| ID modelu | qwen3-vl-235b-a22b-thinking |
| Modalność | Tekst |
| Typy zadań | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| Jednostka rozliczeniowa | 1 tys. tokenów |
| Status katalogu | Wycofany |
Zarejestruj się bezpłatnie i utwórz klucz API dla qwen3-vl-235b-a22b-thinking w panelu.
Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu qwen3-vl-235b-a22b-thinking i parametrami.
Odczytaj bezpośrednio z endpointu ukończoną odpowiedź qwen3-vl-235b-a22b-thinking.
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.
Dla tego endpointu nie opublikowano parametrów żądania.
Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.
Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.
Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.
Obie korzystają z tego samego modelu Mixture-of-Experts o rozmiarze 235B z 22B aktywnych parametrów. Wersja Thinking zawsze rozumuje przed odpowiedzią i jest dostrojona do nauk ścisłych, matematyki i rozumowania multimodalnego. Wersja Instruct odpowiada od razu i jest nastawiona na wizualne kodowanie, percepcję przestrzenną, rozumienie długich nagrań wideo i OCR.
Użyj endpointu Chat Completions i dodaj część image_url obok części tekstowej w messages[].content[]. To ten sam kształt żądania, którego SDK OpenAI używa dla vision. Alibaba podaje dla tego modelu także wejście wideo; żądania z wideo nie zostały zweryfikowane w RunAPI.
Nie. Alibaba udostępnia go jako model działający wyłącznie w trybie thinking. Jeśli chcesz odpowiedzi bez etapu rozumowania, wywołaj qwen3-vl-235b-a22b-instruct.
Alibaba zalicza Qwen3-VL do modeli legacy i podaje, że Qwen3.5-122B-A10B radzi sobie z obrazami lepiej niż Qwen3-VL-235B. W nowych zadaniach z obrazami zacznij więc od modelu Qwen3.5 lub Qwen3.6, a Qwen3-VL zostaw dla promptów i ewaluacji, które już na nim zbudowano.
Przekaż identyfikator modelu wyświetlony w quickstarcie.
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.
Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.
Skontaktuj się