Copertura endpoint
Espone 1 endpoint pubblici: chat_completion.
Piccolo MoE di visione open-weight di Qwen3.5 (3B attivi); contesto 256K; API compatibile OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-35b-a3b:generateContent
POST /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-35b-a3b",
"messages": [
{
"role": "user",
"content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-35b-a3b",
messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-35b-a3b",
messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
9 versioni disponibili
Qwen3.5-35B-A3B è il piccolo modello Mixture-of-Experts della serie Qwen3.5 Medium di Alibaba, rilasciato con pesi aperti sotto Apache 2.0 il 24 febbraio 2026. È un modello visione-linguaggio nativo con attenzione lineare ibrida, 35B parametri totali e 3B attivi per token. Alibaba ne valuta le prestazioni complessive come paragonabili a quelle di Qwen3.5-27B.
È un modello ibrido con thinking attivo per impostazione predefinita, una finestra di contesto di 262.144 token e fino a 65.536 token di output. Alibaba indica il supporto a function calling e output strutturati.
Su RunAPI, chiama qwen3.5-35b-a3b tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions) con un SDK OpenAI puntato su https://runapi.ai/v1. Le immagini vanno in parti image_url dentro messages[].content[].
Scegli un modello e genera in pochi secondi.
| Provider | Alibaba |
| ID modello | qwen3.5-35b-a3b |
| Modalità | Testo |
| Tipi di attività | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-35b-a3b:generateContent | |
| /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent | |
| Unità di fatturazione | 1K token |
| Stato del catalogo | Operativo |
Registrati gratuitamente e crea una chiave API per qwen3.5-35b-a3b dalla dashboard.
Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello qwen3.5-35b-a3b e i tuoi parametri.
Leggi direttamente dall’endpoint la risposta completata di qwen3.5-35b-a3b.
Espone 1 endpoint pubblici: chat_completion.
Misurata in base a 1K token, senza requisito di abbonamento.
Nessun parametro della richiesta è pubblicato per questo endpoint.
Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.
Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.
Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.
Il feedback verificato dei clienti non è ancora disponibile per questo modello.
Indica 3B parametri attivi. Il modello ha 35B parametri in totale, e il suo router Mixture-of-Experts ne usa 3B per ogni token.
Qwen3.6-35B-A3B è il successore diretto di questo modello, con la stessa taglia di 35B totali e 3B attivi. Alibaba riporta per il modello 3.6 ampi miglioramenti nel coding agentico, nel ragionamento matematico e sul codice, nell'intelligenza spaziale e nel rilevamento di oggetti.
Sì. Alibaba indica il supporto a function calling e output strutturati. Su RunAPI, invia i tool nel formato OpenAI su Chat Completions e leggi tool_calls dalla risposta.
Sì. È un modello visione-linguaggio nativo. Invia parti image_url insieme al testo in una richiesta Chat Completions. Alibaba indica anche l'input video; le richieste video non sono verificate su RunAPI.
Passa l'ID del modello mostrato nel quickstart.
I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.
Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.
Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.
Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.
Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.
Contattaci