Alibaba

Qwen3-VL-235B-A22B-Thinking

Tekst
Wycofany Wycofany dnia 2026-10-10.

Wizyjny MoE Qwen3-VL, który zawsze najpierw rozumuje; kontekst 131K; obrazy przez API zgodne z OpenAI

Kondycja modelu Niewystarczające dane
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3-vl-235b-a22b-thinking",
  "messages": [
    {
      "role": "user",
      "content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3-vl-235b-a22b-thinking",
    messages=[{"role": "user", "content": "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3-vl-235b-a22b-thinking",
  messages: [{ role: "user", content: "Przeczytaj ten zrzut ekranu dashboardu z błędem, wyjaśnij, co oznacza komunikat o błędzie, i zaproponuj zmianę w kodzie, która go naprawi." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Do czego służy Qwen3-VL-235B-A22B-Thinking

Qwen3-VL-235B-A22B-Thinking to wersja z rozumowaniem modelu Qwen3-VL, flagowej rodziny modeli wizyjno-językowych od Alibaba Qwen. Jest to model Mixture-of-Experts z 235B parametrów łącznie, z których 22B jest aktywnych na token. Został wydany z otwartymi wagami na licencji Apache 2.0 23 września 2025 roku. Alibaba dostroiła go do rozumowania multimodalnego, ze szczególnym naciskiem na zadania z nauk ścisłych i matematyki, OCR oraz rozumienie obrazów i wideo.

Model działa wyłącznie w trybie thinking: każda odpowiedź zaczyna się od etapu rozumowania, którego nie da się wyłączyć. API Alibaba udostępnia go z oknem kontekstu 131 072 tokenów i maksymalnie 32 768 tokenami wyjściowymi.

W RunAPI wywołujesz qwen3-vl-235b-a22b-thinking przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions), korzystając z SDK OpenAI skierowanego na https://runapi.ai/v1. Obrazy wysyłaj jako części image_url obok tekstu w messages[].content[]. Alibaba zalicza już Qwen3-VL do swoich modeli legacy, ponieważ modele Qwen3.5 i Qwen3.6 natywnie odczytują obrazy.

ID modelu
qwen3-vl-235b-a22b-thinking
Data premiery
23 września 2025
Architektura
MoE, 235B łącznie / 22B aktywnych, wagi na licencji Apache 2.0
Okno kontekstu
131 072 tokeny
Maksymalny output
32 768 tokenów
Thinking
Zawsze włączony
Endpoint w RunAPI
OpenAI Chat Completions, tekst i obrazy na wejściu
Specyfikacja

Szczegóły techniczne

Dostawca Alibaba
ID modelu qwen3-vl-235b-a22b-thinking
Modalność Tekst
Typy zadań Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
/v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
Jednostka rozliczeniowa 1 tys. tokenów
Status katalogu Wycofany
JAK TO DZIAŁA

Użyj tego modelu w 3 krokach

  1. Uzyskaj klucz

    Zarejestruj się bezpłatnie i utwórz klucz API dla qwen3-vl-235b-a22b-thinking w panelu.

  2. Wyślij żądanie

    Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu qwen3-vl-235b-a22b-thinking i parametrami.

  3. Pobierz wyniki

    Odczytaj bezpośrednio z endpointu ukończoną odpowiedź qwen3-vl-235b-a22b-thinking.

Co oferuje ten model

Pokrycie endpointów

Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.

Rozliczenia według użycia

Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.

ODNIESIENIE API

Specyfikacja endpointu

Endpoint
POST /v1/chat/completions
ID modelu
qwen3-vl-235b-a22b-thinking
Typy zadań
chat_completion

Parametry żądania

Dla tego endpointu nie opublikowano parametrów żądania.

PRZYPADKI UŻYCIA

Obsługa klienta

Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.

Analiza dokumentów

Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.

Generowanie kodu

Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.

FAQ

Najczęściej zadawane pytania o Qwen3-VL-235B-A22B-Thinking

Czym różnią się wersje Thinking i Instruct modelu Qwen3-VL-235B-A22B?

Obie korzystają z tego samego modelu Mixture-of-Experts o rozmiarze 235B z 22B aktywnych parametrów. Wersja Thinking zawsze rozumuje przed odpowiedzią i jest dostrojona do nauk ścisłych, matematyki i rozumowania multimodalnego. Wersja Instruct odpowiada od razu i jest nastawiona na wizualne kodowanie, percepcję przestrzenną, rozumienie długich nagrań wideo i OCR.

Jak wysłać obraz do qwen3-vl-235b-a22b-thinking?

Użyj endpointu Chat Completions i dodaj część image_url obok części tekstowej w messages[].content[]. To ten sam kształt żądania, którego SDK OpenAI używa dla vision. Alibaba podaje dla tego modelu także wejście wideo; żądania z wideo nie zostały zweryfikowane w RunAPI.

Czy mogę wyłączyć thinking w tym modelu?

Nie. Alibaba udostępnia go jako model działający wyłącznie w trybie thinking. Jeśli chcesz odpowiedzi bez etapu rozumowania, wywołaj qwen3-vl-235b-a22b-instruct.

Do zadań z obrazami wybrać Qwen3-VL czy model Qwen3.5?

Alibaba zalicza Qwen3-VL do modeli legacy i podaje, że Qwen3.5-122B-A10B radzi sobie z obrazami lepiej niż Qwen3-VL-235B. W nowych zadaniach z obrazami zacznij więc od modelu Qwen3.5 lub Qwen3.6, a Qwen3-VL zostaw dla promptów i ewaluacji, które już na nim zbudowano.

Jak wybrać qwen3-vl-235b-a22b-thinking?

Przekaż identyfikator modelu wyświetlony w quickstarcie.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się