Endpointdekking
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Kleine open-weight Qwen3.5-vision-MoE (3B actief); 256K context; OpenAI-compatibele API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-35b-a3b:generateContent
POST /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-35b-a3b",
"messages": [
{
"role": "user",
"content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-35b-a3b",
messages=[{"role": "user", "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-35b-a3b",
messages: [{ role: "user", content: "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost." }]
});
9 versies beschikbaar
Qwen3.5-35B-A3B is het kleine Mixture-of-Experts-model uit de Qwen3.5 Medium-serie van Alibaba, uitgebracht met open weights onder Apache 2.0 op 24 februari 2026. Het is een native vision-language-model met hybride lineaire attention, 35B parameters in totaal en 3B actief per token. Alibaba beoordeelt de prestaties over het geheel als vergelijkbaar met Qwen3.5-27B.
Het is een hybride model met thinking standaard aan, een contextvenster van 262.144 tokens en maximaal 65.536 outputtokens. Alibaba noemt function calling en structured outputs als ondersteund.
Op RunAPI roep je qwen3.5-35b-a3b aan via het OpenAI-compatibele Chat Completions-endpoint (/v1/chat/completions), met een OpenAI-SDK die naar https://runapi.ai/v1 wijst. Afbeeldingen gaan als image_url-onderdelen in messages[].content[].
Kies een model en genereer binnen enkele seconden.
| Provider | Alibaba |
| Model-ID | qwen3.5-35b-a3b |
| Modaliteit | Tekst |
| Taaktypen | Synchronous |
| API-eindpunt | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-35b-a3b:generateContent | |
| /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent | |
| Factureringseenheid | 1K tokens |
| Catalogusstatus | Operationeel |
Meld je gratis aan en maak vanuit het dashboard een API-sleutel voor qwen3.5-35b-a3b.
Stuur een POST-verzoek naar /v1/chat/completions met de model-ID qwen3.5-35b-a3b en je parameters.
Lees het voltooide qwen3.5-35b-a3b-antwoord rechtstreeks van het endpoint.
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Gemeten aan de hand van 1K tokens, zonder abonnementsvereiste.
Voor dit endpoint zijn geen requestparameters gepubliceerd.
Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.
Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.
Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.
Geverifieerde klantfeedback is nog niet beschikbaar voor dit model.
Het staat voor 3B actieve parameters. Het model heeft in totaal 35B parameters, en de Mixture-of-Experts-router zet daarvan 3B in voor elk token.
Qwen3.6-35B-A3B is de directe opvolger van dit model, met dezelfde omvang van 35B totaal en 3B actief. Alibaba meldt grote verbeteringen voor het 3.6-model bij agentic coding, redeneren over wiskunde en code, ruimtelijke intelligentie en objectdetectie.
Ja. Alibaba noemt function calling en structured outputs als ondersteund. Stuur op RunAPI tools in het OpenAI-formaat mee met Chat Completions en lees tool_calls uit het antwoord.
Ja. Het is een native vision-language-model. Stuur image_url-onderdelen mee met de tekst in een Chat Completions-request. Alibaba noemt ook video-invoer; videorequests zijn op RunAPI niet geverifieerd.
Geef de model-ID door die in de quickstart wordt getoond.
Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.
Ja — variant is een flag. Wissel door de modelparameter aan te passen.
Waar streaming beschikbaar is, streamt RunAPI end-to-end.
Open een issue in de publieke GitHub-repo of mail support.
We helpen je met enterprise-inrichting, integraties en technische vragen.
Neem contact op