Alibaba

Qwen3.5-35B-A3B

Testo

Piccolo MoE di visione open-weight di Qwen3.5 (3B attivi); contesto 256K; API compatibile OpenAI

Input $0.25 / 1M di token | Output $2.00 / 1M di token Qwen3.5-35B-A3B Riferimento API →
Stato del modello Dati insufficienti
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-35b-a3b:generateContent
POST /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3.5-35b-a3b",
  "messages": [
    {
      "role": "user",
      "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3.5-35b-a3b",
  messages: [{ role: "user", content: "Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

A cosa serve Qwen3.5-35B-A3B

Qwen3.5-35B-A3B è il piccolo modello Mixture-of-Experts della serie Qwen3.5 Medium di Alibaba, rilasciato con pesi aperti sotto Apache 2.0 il 24 febbraio 2026. È un modello visione-linguaggio nativo con attenzione lineare ibrida, 35B parametri totali e 3B attivi per token. Alibaba ne valuta le prestazioni complessive come paragonabili a quelle di Qwen3.5-27B.

È un modello ibrido con thinking attivo per impostazione predefinita, una finestra di contesto di 262.144 token e fino a 65.536 token di output. Alibaba indica il supporto a function calling e output strutturati.

Su RunAPI, chiama qwen3.5-35b-a3b tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions) con un SDK OpenAI puntato su https://runapi.ai/v1. Le immagini vanno in parti image_url dentro messages[].content[].

ID del modello
qwen3.5-35b-a3b
Rilascio
24 febbraio 2026
Architettura
MoE, 35B totali / 3B attivi, pesi sotto Apache 2.0
Finestra di contesto
262.144 token
Output massimo
65.536 token
Thinking
Ibrido, attivo per impostazione predefinita
Endpoint su RunAPI
OpenAI Chat Completions, input testo e immagini
Playground

Prova Qwen3.5-35B-A3B

Scegli un modello e genera in pochi secondi.

Stimato: Input $0.25 / 1M di token | Output $2.00 / 1M di token

Accedi per generare con RunAPI.

Accedi per generare

Accedi per iniziare a generare con i modelli linguistici disponibili.

Specifiche

Dettagli tecnici

Provider Alibaba
ID modello qwen3.5-35b-a3b
Modalità Testo
Tipi di attività Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3.5-35b-a3b:generateContent
/v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
Unità di fatturazione 1K token
Stato del catalogo Operativo
COME FUNZIONA

Usa questo modello in 3 passaggi

  1. Crea la tua chiave

    Registrati gratuitamente e crea una chiave API per qwen3.5-35b-a3b dalla dashboard.

  2. Invia una richiesta

    Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello qwen3.5-35b-a3b e i tuoi parametri.

  3. Ottieni i risultati

    Leggi direttamente dall’endpoint la risposta completata di qwen3.5-35b-a3b.

Cosa offre questo modello

Copertura endpoint

Espone 1 endpoint pubblici: chat_completion.

Fatturazione a consumo

Misurata in base a 1K token, senza requisito di abbonamento.

Qwen3.5-35B-A3B Prezzi

Endpoint
Prezzo
chat_completion
Input: $0.25 / 1M di token Output: $2.00 / 1M di token
RIFERIMENTO API

Specifiche dell'endpoint

Endpoint
POST /v1/chat/completions
ID modello
qwen3.5-35b-a3b
Tipi di attività
chat_completion

Parametri della richiesta

Nessun parametro della richiesta è pubblicato per questo endpoint.

CASI D'USO

Customer support

Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.

Analisi documentale

Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.

Generazione di codice

Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.

Metriche di utilizzo

Scelto dagli sviluppatori
6
Chiamate API / Giorno
100.0%
Tasso di successo
5.7s
Generazione media

Il feedback verificato dei clienti non è ancora disponibile per questo modello.

FAQ

Domande frequenti su Qwen3.5-35B-A3B

Cosa significa A3B in Qwen3.5-35B-A3B?

Indica 3B parametri attivi. Il modello ha 35B parametri in totale, e il suo router Mixture-of-Experts ne usa 3B per ogni token.

Meglio Qwen3.5-35B-A3B o Qwen3.6-35B-A3B?

Qwen3.6-35B-A3B è il successore diretto di questo modello, con la stessa taglia di 35B totali e 3B attivi. Alibaba riporta per il modello 3.6 ampi miglioramenti nel coding agentico, nel ragionamento matematico e sul codice, nell'intelligenza spaziale e nel rilevamento di oggetti.

Qwen3.5-35B-A3B supporta il function calling?

Sì. Alibaba indica il supporto a function calling e output strutturati. Su RunAPI, invia i tool nel formato OpenAI su Chat Completions e leggi tool_calls dalla risposta.

Qwen3.5-35B-A3B può leggere immagini?

Sì. È un modello visione-linguaggio nativo. Invia parti image_url insieme al testo in una richiesta Chat Completions. Alibaba indica anche l'input video; le richieste video non sono verificate su RunAPI.

Come seleziono qwen3.5-35b-a3b?

Passa l'ID del modello mostrato nel quickstart.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci