Un’unica autenticazione, tutti i provider
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
Usa l'API Qwen tramite RunAPI con model skill, autenticazione unificata e prezzi pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
Qwen è la famiglia di modelli linguistici open-weight di Alibaba, rilasciati sotto Apache 2.0. Su RunAPI, i modelli Qwen3.5 (397B-A17B, 122B-A10B, 27B, 35B-A3B) e Qwen3.6 (27B, 35B-A3B) sono modelli visione-linguaggio nativi con una finestra di contesto di 262.144 token e thinking ibrido. Qwen3-VL-235B-A22B è disponibile nelle versioni Thinking e Instruct per la comprensione delle immagini, con una finestra di contesto di 131.072 token. Qwen3-Coder-Next è un modello di coding solo testo per agenti, con 3B parametri attivi. Tutti si chiamano tramite l'endpoint Chat Completions compatibile OpenAI di RunAPI con una sola chiave API.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Fatturazione | Prezzo | |
|---|---|---|---|
| qwen3-coder-next | 1K token | Ritirato | Visualizza → |
| qwen3-vl-235b-a22b-instruct | 1K token | Ritirato | Visualizza → |
| qwen3-vl-235b-a22b-thinking | 1K token | Ritirato | Visualizza → |
| qwen3.5-122b-a10b | 1K token | Input $0.40 / 1M di token | Output $3.20 / 1M di token | Visualizza → |
| qwen3.5-27b | 1K token | Input $0.30 / 1M di token | Output $2.40 / 1M di token | Visualizza → |
| qwen3.5-35b-a3b | 1K token | Input $0.25 / 1M di token | Output $2.00 / 1M di token | Visualizza → |
| qwen3.5-397b-a17b | 1K token | Input $0.60 / 1M di token | Output $3.60 / 1M di token | Visualizza → |
| qwen3.6-27b | 1K token | Input $0.60 / 1M di token | Output $3.60 / 1M di token | Visualizza → |
| qwen3.6-35b-a3b | 1K token | Input $0.38 / 1M di token | Output $2.25 / 1M di token | Visualizza → |
| Endpoint | Risoluzione | Durata | Prezzo | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.40 / 1M di token | Output $3.20 / 1M di token |
Prezzi mostrati per qwen3.5-122b-a10b. Le altre varianti mantengono i propri prezzi per endpoint.
Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.
Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.
Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.
Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.
I modelli linguistici Qwen di Alibaba sono LLM open-weight, Mixture-of-Experts o densi, con contesto da 131K a 256K. La maggior parte accetta immagini e offre una modalità thinking. Tramite RunAPI condividono una sola chiave API e la fatturazione per token, e qualsiasi SDK OpenAI può chiamarli su https://runapi.ai/v1. Sono i modelli linguistici di Qwen, distinti dai modelli di generazione di immagini Qwen Image, Qwen 2 e Qwen 3.
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.
Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.
Inizia con qwen3.6-27b o qwen3.6-35b-a3b, i modelli Qwen più recenti su RunAPI, per chat, coding e input immagini. Usa qwen3.5-397b-a17b se vuoi il modello Qwen3.5 più grande, e qwen3-coder-next per agenti di coding che non hanno bisogno di un passaggio di thinking.
Tutti i modelli Qwen3.5 e Qwen3.6 ed entrambe le versioni di Qwen3-VL-235B-A22B accettano immagini. Inviale come parti image_url in una richiesta Chat Completions. qwen3-coder-next gestisce solo testo.
I modelli Qwen3.5 e Qwen3.6 sono ibridi e hanno modalità con e senza thinking. qwen3-vl-235b-a22b-thinking ragiona sempre, mentre qwen3-vl-235b-a22b-instruct e qwen3-coder-next rispondono senza passaggio di thinking.
Usa l'endpoint Chat Completions compatibile OpenAI su https://runapi.ai/v1/chat/completions con la tua chiave API RunAPI e un ID di modello Qwen. Qualsiasi SDK OpenAI funziona dopo aver cambiato la base URL.
Sì. Alibaba rilascia questi modelli Qwen con pesi aperti sotto la licenza Apache 2.0. RunAPI ti dà accesso via API, così non devi ospitarli sulle tue GPU.
La linea Qwen raccoglie i modelli linguistici, che leggono testo e immagini e restituiscono testo. Qwen Image, Qwen 2 e Qwen 3 sono linee RunAPI separate che generano e modificano immagini.