Copertura endpoint
Espone 1 endpoint pubblici: chat_completion.
MoE di visione Qwen3-VL con thinking sempre attivo; contesto 131K; input immagini via API compatibile OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
9 versioni disponibili
Qwen3-VL-235B-A22B-Thinking è la versione con ragionamento di Qwen3-VL, la famiglia di punta di modelli visione-linguaggio di Alibaba Qwen. È un modello Mixture-of-Experts con 235B parametri totali e 22B attivi per token, rilasciato con pesi aperti sotto Apache 2.0 il 23 settembre 2025. Alibaba lo ha ottimizzato per il ragionamento multimodale, con particolare attenzione a problemi scientifici e matematici, OCR e comprensione di immagini e video.
Il modello funziona solo in modalità thinking: ogni risposta inizia con un passaggio di ragionamento che non si può disattivare. L'API di Alibaba lo offre con una finestra di contesto di 131.072 token e fino a 32.768 token di output.
Su RunAPI, chiama qwen3-vl-235b-a22b-thinking tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions) con un SDK OpenAI puntato su https://runapi.ai/v1. Invia le immagini come parti image_url accanto al testo in messages[].content[]. Alibaba ora raggruppa Qwen3-VL tra i suoi modelli legacy, perché i modelli Qwen3.5 e Qwen3.6 leggono le immagini in modo nativo.
| Provider | Alibaba |
| ID modello | qwen3-vl-235b-a22b-thinking |
| Modalità | Testo |
| Tipi di attività | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| Unità di fatturazione | 1K token |
| Stato del catalogo | Ritirato |
Registrati gratuitamente e crea una chiave API per qwen3-vl-235b-a22b-thinking dalla dashboard.
Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello qwen3-vl-235b-a22b-thinking e i tuoi parametri.
Leggi direttamente dall’endpoint la risposta completata di qwen3-vl-235b-a22b-thinking.
Espone 1 endpoint pubblici: chat_completion.
Misurata in base a 1K token, senza requisito di abbonamento.
Nessun parametro della richiesta è pubblicato per questo endpoint.
Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.
Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.
Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.
Entrambe usano lo stesso modello Mixture-of-Experts da 235B con 22B parametri attivi. La versione Thinking ragiona sempre prima di rispondere ed è ottimizzata per discipline scientifiche, matematica e ragionamento multimodale. La versione Instruct risponde direttamente ed è pensata per il coding da elementi visivi, la percezione spaziale, la comprensione di video lunghi e l'OCR.
Usa l'endpoint Chat Completions e aggiungi una parte image_url accanto alla parte di testo in messages[].content[], la stessa struttura di richiesta che l'SDK OpenAI usa per la visione. Alibaba indica anche l'input video per questo modello; le richieste video non sono verificate su RunAPI.
No. Alibaba lo distribuisce come modello con thinking sempre attivo. Se vuoi risposte senza passaggio di ragionamento, chiama invece qwen3-vl-235b-a22b-instruct.
Alibaba inserisce Qwen3-VL tra i suoi modelli legacy e dichiara che la capacità di visione di Qwen3.5-122B-A10B supera quella di Qwen3-VL-235B. Per nuovi carichi sulle immagini prova prima un modello Qwen3.5 o Qwen3.6, e tieni Qwen3-VL per i prompt e le valutazioni già costruiti su di esso.
Passa l'ID del modello mostrato nel quickstart.
I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.
Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.
Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.
Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.
Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.
Contattaci