Alibaba

Qwen3-VL-235B-A22B-Thinking

Testo
Ritirato Ritirato il 2026-10-10.

MoE di visione Qwen3-VL con thinking sempre attivo; contesto 131K; input immagini via API compatibile OpenAI

Stato del modello Dati insufficienti
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3-vl-235b-a22b-thinking",
  "messages": [
    {
      "role": "user",
      "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3-vl-235b-a22b-thinking",
    messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3-vl-235b-a22b-thinking",
  messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

A cosa serve Qwen3-VL-235B-A22B-Thinking

Qwen3-VL-235B-A22B-Thinking è la versione con ragionamento di Qwen3-VL, la famiglia di punta di modelli visione-linguaggio di Alibaba Qwen. È un modello Mixture-of-Experts con 235B parametri totali e 22B attivi per token, rilasciato con pesi aperti sotto Apache 2.0 il 23 settembre 2025. Alibaba lo ha ottimizzato per il ragionamento multimodale, con particolare attenzione a problemi scientifici e matematici, OCR e comprensione di immagini e video.

Il modello funziona solo in modalità thinking: ogni risposta inizia con un passaggio di ragionamento che non si può disattivare. L'API di Alibaba lo offre con una finestra di contesto di 131.072 token e fino a 32.768 token di output.

Su RunAPI, chiama qwen3-vl-235b-a22b-thinking tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions) con un SDK OpenAI puntato su https://runapi.ai/v1. Invia le immagini come parti image_url accanto al testo in messages[].content[]. Alibaba ora raggruppa Qwen3-VL tra i suoi modelli legacy, perché i modelli Qwen3.5 e Qwen3.6 leggono le immagini in modo nativo.

ID del modello
qwen3-vl-235b-a22b-thinking
Rilascio
23 settembre 2025
Architettura
MoE, 235B totali / 22B attivi, pesi sotto Apache 2.0
Finestra di contesto
131.072 token
Output massimo
32.768 token
Thinking
Sempre attivo
Endpoint su RunAPI
OpenAI Chat Completions, input testo e immagini
Specifiche

Dettagli tecnici

Provider Alibaba
ID modello qwen3-vl-235b-a22b-thinking
Modalità Testo
Tipi di attività Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
/v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
Unità di fatturazione 1K token
Stato del catalogo Ritirato
COME FUNZIONA

Usa questo modello in 3 passaggi

  1. Crea la tua chiave

    Registrati gratuitamente e crea una chiave API per qwen3-vl-235b-a22b-thinking dalla dashboard.

  2. Invia una richiesta

    Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello qwen3-vl-235b-a22b-thinking e i tuoi parametri.

  3. Ottieni i risultati

    Leggi direttamente dall’endpoint la risposta completata di qwen3-vl-235b-a22b-thinking.

Cosa offre questo modello

Copertura endpoint

Espone 1 endpoint pubblici: chat_completion.

Fatturazione a consumo

Misurata in base a 1K token, senza requisito di abbonamento.

RIFERIMENTO API

Specifiche dell'endpoint

Endpoint
POST /v1/chat/completions
ID modello
qwen3-vl-235b-a22b-thinking
Tipi di attività
chat_completion

Parametri della richiesta

Nessun parametro della richiesta è pubblicato per questo endpoint.

CASI D'USO

Customer support

Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.

Analisi documentale

Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.

Generazione di codice

Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.

FAQ

Domande frequenti su Qwen3-VL-235B-A22B-Thinking

Che differenza c'è tra le versioni Thinking e Instruct di Qwen3-VL-235B-A22B?

Entrambe usano lo stesso modello Mixture-of-Experts da 235B con 22B parametri attivi. La versione Thinking ragiona sempre prima di rispondere ed è ottimizzata per discipline scientifiche, matematica e ragionamento multimodale. La versione Instruct risponde direttamente ed è pensata per il coding da elementi visivi, la percezione spaziale, la comprensione di video lunghi e l'OCR.

Come invio un'immagine a qwen3-vl-235b-a22b-thinking?

Usa l'endpoint Chat Completions e aggiungi una parte image_url accanto alla parte di testo in messages[].content[], la stessa struttura di richiesta che l'SDK OpenAI usa per la visione. Alibaba indica anche l'input video per questo modello; le richieste video non sono verificate su RunAPI.

Posso disattivare il thinking su questo modello?

No. Alibaba lo distribuisce come modello con thinking sempre attivo. Se vuoi risposte senza passaggio di ragionamento, chiama invece qwen3-vl-235b-a22b-instruct.

Per le attività sulle immagini conviene Qwen3-VL o un modello Qwen3.5?

Alibaba inserisce Qwen3-VL tra i suoi modelli legacy e dichiara che la capacità di visione di Qwen3.5-122B-A10B supera quella di Qwen3-VL-235B. Per nuovi carichi sulle immagini prova prima un modello Qwen3.5 o Qwen3.6, e tieni Qwen3-VL per i prompt e le valutazioni già costruiti su di esso.

Come seleziono qwen3-vl-235b-a22b-thinking?

Passa l'ID del modello mostrato nel quickstart.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci