Endpointdekking
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Open-weight vlaggenschip van Qwen3.5, vision-MoE (17B actief); 256K context; OpenAI-compatibele API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-397b-a17b:generateContent
POST /v1beta/models/qwen3.5-397b-a17b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-397b-a17b",
"messages": [
{
"role": "user",
"content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-397b-a17b",
messages=[{"role": "user", "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-397b-a17b",
messages: [{ role: "user", content: "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost." }]
});
9 versies beschikbaar
Qwen3.5-397B-A17B is het open-weight vlaggenschip van de Qwen3.5-generatie van Alibaba, uitgebracht onder Apache 2.0 op 16 februari 2026. Het is een native vision-language-model dat hybride lineaire attention combineert met een sparse Mixture-of-Experts-ontwerp: 397B parameters in totaal, waarvan 17B actief per token. Alibaba richt het op taal, redeneren, programmeren, agents, het begrijpen van afbeeldingen en video, en interactie met grafische interfaces.
Het is een hybride model met een thinking- en een non-thinking-modus, en de API van Alibaba zet thinking standaard aan. Het contextvenster is 262.144 tokens, met maximaal 65.536 outputtokens. Alibaba noemt function calling en structured outputs als ondersteund.
Op RunAPI roep je qwen3.5-397b-a17b aan via het OpenAI-compatibele Chat Completions-endpoint (/v1/chat/completions), met een OpenAI-SDK die naar https://runapi.ai/v1 wijst. Afbeeldingen gaan als image_url-onderdelen in messages[].content[], en tools gebruiken het standaard OpenAI-toolsformaat.
Kies een model en genereer binnen enkele seconden.
| Provider | Alibaba |
| Model-ID | qwen3.5-397b-a17b |
| Modaliteit | Tekst |
| Taaktypen | Synchronous |
| API-eindpunt | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-397b-a17b:generateContent | |
| /v1beta/models/qwen3.5-397b-a17b:streamGenerateContent | |
| Factureringseenheid | 1K tokens |
| Catalogusstatus | Operationeel |
Meld je gratis aan en maak vanuit het dashboard een API-sleutel voor qwen3.5-397b-a17b.
Stuur een POST-verzoek naar /v1/chat/completions met de model-ID qwen3.5-397b-a17b en je parameters.
Lees het voltooide qwen3.5-397b-a17b-antwoord rechtstreeks van het endpoint.
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Gemeten aan de hand van 1K tokens, zonder abonnementsvereiste.
Voor dit endpoint zijn geen requestparameters gepubliceerd.
Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.
Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.
Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.
Geverifieerde klantfeedback is nog niet beschikbaar voor dit model.
Qwen3.5-397B-A17B is het grootste. Alibaba zet Qwen3.5-122B-A10B op de tweede plaats, beoordeelt Qwen3.5-27B over het geheel als vergelijkbaar met het 122B-model en Qwen3.5-35B-A3B als vergelijkbaar met het 27B-model. Alle vier hebben een contextvenster van 262.144 tokens en accepteren afbeeldingen.
Ja. Het is een native vision-language-model. Stuur op RunAPI image_url-onderdelen mee met je tekst in een Chat Completions-request. Alibaba noemt ook video-invoer; videorequests zijn op RunAPI niet geverifieerd.
Ja. Alibaba noemt function calling en structured outputs als ondersteund. Stuur op RunAPI tools in het OpenAI-formaat mee met Chat Completions en lees tool_calls uit het antwoord.
Nee. Alibaba heeft sindsdien Qwen3.6 uitgebracht en rekent de Qwen3.5-modellen nu tot zijn legacy-modellen, al biedt het ze nog steeds aan. Volgens Qwen overtreft Qwen3.6-27B, dat ook op RunAPI staat, Qwen3.5-397B-A17B bij agentic coding.
Geef de model-ID door die in de quickstart wordt getoond.
Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.
Ja — variant is een flag. Wissel door de modelparameter aan te passen.
Waar streaming beschikbaar is, streamt RunAPI end-to-end.
Open een issue in de publieke GitHub-repo of mail support.
We helpen je met enterprise-inrichting, integraties en technische vragen.
Neem contact op