Endpointdekking
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Open-weight Qwen3.5-vision-MoE (10B actief); 256K context; OpenAI-compatibele API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-122b-a10b:generateContent
POST /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-122b-a10b",
"messages": [
{
"role": "user",
"content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-122b-a10b",
messages=[{"role": "user", "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-122b-a10b",
messages: [{ role: "user", content: "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost." }]
});
9 versies beschikbaar
Qwen3.5-122B-A10B is een native vision-language-model uit de Qwen3.5 Medium-serie van Alibaba, uitgebracht met open weights onder Apache 2.0 op 24 februari 2026. Het is een Mixture-of-Experts-model met hybride lineaire attention, 122B parameters in totaal en 10B actief per token. Alibaba zet het in de Qwen3.5-generatie op de tweede plaats, achter Qwen3.5-397B-A17B.
Volgens Alibaba presteert het op tekst beter dan Qwen3-235B-2507 en op vision beter dan Qwen3-VL-235B. Het is een hybride model met thinking standaard aan, een contextvenster van 262.144 tokens en maximaal 65.536 outputtokens. Function calling en structured outputs worden ondersteund.
Op RunAPI roep je qwen3.5-122b-a10b aan via het OpenAI-compatibele Chat Completions-endpoint (/v1/chat/completions), met een OpenAI-SDK die naar https://runapi.ai/v1 wijst. Afbeeldingen gaan als image_url-onderdelen in messages[].content[].
Kies een model en genereer binnen enkele seconden.
| Provider | Alibaba |
| Model-ID | qwen3.5-122b-a10b |
| Modaliteit | Tekst |
| Taaktypen | Synchronous |
| API-eindpunt | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-122b-a10b:generateContent | |
| /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent | |
| Factureringseenheid | 1K tokens |
| Catalogusstatus | Operationeel |
Meld je gratis aan en maak vanuit het dashboard een API-sleutel voor qwen3.5-122b-a10b.
Stuur een POST-verzoek naar /v1/chat/completions met de model-ID qwen3.5-122b-a10b en je parameters.
Lees het voltooide qwen3.5-122b-a10b-antwoord rechtstreeks van het endpoint.
Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.
Gemeten aan de hand van 1K tokens, zonder abonnementsvereiste.
Voor dit endpoint zijn geen requestparameters gepubliceerd.
Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.
Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.
Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.
Geverifieerde klantfeedback is nog niet beschikbaar voor dit model.
Alibaba plaatst het 122B-model direct achter het 397B-vlaggenschip. Het activeert 10B parameters per token, tegenover 17B bij het vlaggenschip. Beide hebben een contextvenster van 262.144 tokens, beeldinvoer en hybride thinking.
Volgens Alibaba presteert Qwen3.5-122B-A10B op vision beter dan Qwen3-VL-235B, en het contextvenster is twee keer zo groot. Test het op je eigen afbeeldingen voordat je een productieworkload overzet.
Standaard wel. Het heeft een thinking- en een non-thinking-modus, en de API van Alibaba zet thinking aan tenzij het request het uitschakelt. Met thinking worden antwoorden langer, dus reken op meer tijd bij synchrone requests.
Gebruik het OpenAI-compatibele Chat Completions-endpoint van RunAPI op https://runapi.ai/v1/chat/completions, met je RunAPI-API-key en model ingesteld op qwen3.5-122b-a10b. Tools gebruiken het standaard OpenAI-toolsformaat.
Geef de model-ID door die in de quickstart wordt getoond.
Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.
Ja — variant is een flag. Wissel door de modelparameter aan te passen.
Waar streaming beschikbaar is, streamt RunAPI end-to-end.
Open een issue in de publieke GitHub-repo of mail support.
We helpen je met enterprise-inrichting, integraties en technische vragen.
Neem contact op