Eén auth, elke provider
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Gebruik de Qwen API via RunAPI met een modelskill, uniforme auth en pay-as-you-go prijzen.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost." }]
});
Qwen is de familie van open-weight taalmodellen van Alibaba, uitgebracht onder Apache 2.0. Op RunAPI zijn de Qwen3.5-modellen (397B-A17B, 122B-A10B, 27B, 35B-A3B) en de Qwen3.6-modellen (27B, 35B-A3B) native vision-language-modellen met een contextvenster van 262.144 tokens en hybride thinking. Qwen3-VL-235B-A22B is er in een Thinking- en een Instruct-versie voor beeldbegrip, met een contextvenster van 131.072 tokens. Qwen3-Coder-Next is een codeermodel voor agents dat alleen tekst verwerkt en 3B actieve parameters heeft. Je roept ze allemaal aan via het OpenAI-compatibele Chat Completions-endpoint van RunAPI, met één API-key.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variant | Facturering | Prijzen | |
|---|---|---|---|
| qwen3-coder-next | 1K tokens | Stopgezet | Bekijken → |
| qwen3-vl-235b-a22b-instruct | 1K tokens | Stopgezet | Bekijken → |
| qwen3-vl-235b-a22b-thinking | 1K tokens | Stopgezet | Bekijken → |
| qwen3.5-122b-a10b | 1K tokens | Invoer $0.40 / 1M tokens | Uitvoer $3.20 / 1M tokens | Bekijken → |
| qwen3.5-27b | 1K tokens | Invoer $0.30 / 1M tokens | Uitvoer $2.40 / 1M tokens | Bekijken → |
| qwen3.5-35b-a3b | 1K tokens | Invoer $0.25 / 1M tokens | Uitvoer $2.00 / 1M tokens | Bekijken → |
| qwen3.5-397b-a17b | 1K tokens | Invoer $0.60 / 1M tokens | Uitvoer $3.60 / 1M tokens | Bekijken → |
| qwen3.6-27b | 1K tokens | Invoer $0.60 / 1M tokens | Uitvoer $3.60 / 1M tokens | Bekijken → |
| qwen3.6-35b-a3b | 1K tokens | Invoer $0.38 / 1M tokens | Uitvoer $2.25 / 1M tokens | Bekijken → |
| Endpoint | Resolutie | Duur | Prijs | |
|---|---|---|---|---|
| chat_completion | — | — | Invoer $0.40 / 1M tokens | Uitvoer $3.20 / 1M tokens |
Prijzen getoond voor qwen3.5-122b-a10b. Andere varianten behouden hun eigen endpoint-prijzen.
Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.
Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.
Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.
Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.
De Qwen-taalmodellen van Alibaba zijn open-weight Mixture-of-Experts- en dense LLM's met 131K tot 256K context. De meeste accepteren beeldinvoer en hebben een thinking-modus. Via RunAPI delen ze één API-key en facturatie per token, en elke OpenAI-SDK kan ze aanroepen op https://runapi.ai/v1. Dit zijn de taalmodellen van Qwen, los van de beeldgeneratiemodellen Qwen Image, Qwen 2 en Qwen 3.
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.
Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.
Begin met qwen3.6-27b of qwen3.6-35b-a3b, de nieuwste Qwen-modellen op RunAPI, voor chat, programmeren en beeldinvoer. Gebruik qwen3.5-397b-a17b als je het grootste Qwen3.5-model wilt, en qwen3-coder-next voor coding-agents die geen thinking-stap nodig hebben.
Alle Qwen3.5- en Qwen3.6-modellen en beide versies van Qwen3-VL-235B-A22B accepteren afbeeldingen. Stuur ze als image_url-onderdelen in een Chat Completions-request. qwen3-coder-next verwerkt alleen tekst.
De Qwen3.5- en Qwen3.6-modellen zijn hybride en hebben een thinking- en een non-thinking-modus. qwen3-vl-235b-a22b-thinking denkt altijd na, terwijl qwen3-vl-235b-a22b-instruct en qwen3-coder-next antwoorden zonder thinking-stap.
Gebruik het OpenAI-compatibele Chat Completions-endpoint op https://runapi.ai/v1/chat/completions met je RunAPI-API-key en een Qwen-model-ID. Elke OpenAI-SDK werkt zodra je de base URL aanpast.
Ja. Alibaba brengt deze Qwen-modellen uit met open weights onder de Apache 2.0-licentie. RunAPI geeft je API-toegang, zodat je ze niet op je eigen GPU's hoeft te hosten.
De Qwen-lijn bevat de taalmodellen, die tekst en afbeeldingen lezen en tekst teruggeven. Qwen Image, Qwen 2 en Qwen 3 zijn aparte RunAPI-lijnen die afbeeldingen genereren en bewerken.