Copertura endpoint
Espone 1 endpoint pubblici: chat_completion.
MoE di visione open-weight di punta di Qwen3.5 (17B attivi); contesto 256K; API compatibile OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-397b-a17b:generateContent
POST /v1beta/models/qwen3.5-397b-a17b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-397b-a17b",
"messages": [
{
"role": "user",
"content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-397b-a17b",
messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-397b-a17b",
messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
9 versioni disponibili
Qwen3.5-397B-A17B è il modello open-weight di punta della generazione Qwen3.5 di Alibaba, rilasciato sotto Apache 2.0 il 16 febbraio 2026. È un modello visione-linguaggio nativo che unisce attenzione lineare ibrida e un design Mixture-of-Experts sparso: 397B parametri totali e 17B attivi per token. Alibaba lo destina a linguaggio, ragionamento, coding, agenti, comprensione di immagini e video e interazione con interfacce grafiche.
È un modello ibrido con modalità con e senza thinking, e l'API di Alibaba attiva il thinking per impostazione predefinita. La finestra di contesto è di 262.144 token, con fino a 65.536 token di output. Alibaba indica il supporto a function calling e output strutturati.
Su RunAPI, chiama qwen3.5-397b-a17b tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions) con un SDK OpenAI puntato su https://runapi.ai/v1. Le immagini vanno in parti image_url dentro messages[].content[], e i tool usano il formato standard di OpenAI.
Scegli un modello e genera in pochi secondi.
| Provider | Alibaba |
| ID modello | qwen3.5-397b-a17b |
| Modalità | Testo |
| Tipi di attività | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-397b-a17b:generateContent | |
| /v1beta/models/qwen3.5-397b-a17b:streamGenerateContent | |
| Unità di fatturazione | 1K token |
| Stato del catalogo | Operativo |
Registrati gratuitamente e crea una chiave API per qwen3.5-397b-a17b dalla dashboard.
Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello qwen3.5-397b-a17b e i tuoi parametri.
Leggi direttamente dall’endpoint la risposta completata di qwen3.5-397b-a17b.
Espone 1 endpoint pubblici: chat_completion.
Misurata in base a 1K token, senza requisito di abbonamento.
Nessun parametro della richiesta è pubblicato per questo endpoint.
Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.
Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.
Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.
Il feedback verificato dei clienti non è ancora disponibile per questo modello.
Qwen3.5-397B-A17B è il più grande. Alibaba mette Qwen3.5-122B-A10B al secondo posto, valuta Qwen3.5-27B nel complesso paragonabile al modello da 122B e Qwen3.5-35B-A3B paragonabile a quello da 27B. Tutti e quattro hanno una finestra di contesto di 262.144 token e accettano immagini.
Sì. È un modello visione-linguaggio nativo. Su RunAPI, invia parti image_url insieme al testo in una richiesta Chat Completions. Alibaba indica anche l'input video; le richieste video non sono verificate su RunAPI.
Sì. Alibaba indica il supporto a function calling e output strutturati. Su RunAPI, invia i tool nel formato OpenAI su Chat Completions e leggi tool_calls dalla risposta.
No. Alibaba ha poi rilasciato Qwen3.6 e ora raggruppa i modelli Qwen3.5 tra i suoi modelli legacy, pur continuando a servirli. Secondo Qwen, Qwen3.6-27B, disponibile anch'esso su RunAPI, supera Qwen3.5-397B-A17B nel coding agentico.
Passa l'ID del modello mostrato nel quickstart.
I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.
Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.
Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.
Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.
Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.
Contattaci