Ein API Key
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Nutze die Qwen API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt." }]
});
Qwen ist Alibabas Familie von Open-Weight-Sprachmodellen unter Apache 2.0. Bei RunAPI sind die Qwen3.5-Modelle (397B-A17B, 122B-A10B, 27B, 35B-A3B) und die Qwen3.6-Modelle (27B, 35B-A3B) native Vision-Language-Modelle mit einem Kontextfenster von 262.144 Tokens und hybridem Thinking. Qwen3-VL-235B-A22B gibt es als Thinking- und als Instruct-Version für Bildverständnis mit einem Kontextfenster von 131.072 Tokens. Qwen3-Coder-Next ist ein reines Text-Coding-Modell für Agenten mit 3B aktiven Parametern. Alle rufen Sie mit einem API-Key über den OpenAI-kompatiblen Chat-Completions-Endpunkt von RunAPI auf.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Abrechnung | Preise | |
|---|---|---|---|
| qwen3-coder-next | 1K-Token | Eingestellt | Ansehen → |
| qwen3-vl-235b-a22b-instruct | 1K-Token | Eingestellt | Ansehen → |
| qwen3-vl-235b-a22b-thinking | 1K-Token | Eingestellt | Ansehen → |
| qwen3.5-122b-a10b | 1K-Token | Eingabe $0.40 / 1 Mio. Tokens | Ausgabe $3.20 / 1 Mio. Tokens | Ansehen → |
| qwen3.5-27b | 1K-Token | Eingabe $0.30 / 1 Mio. Tokens | Ausgabe $2.40 / 1 Mio. Tokens | Ansehen → |
| qwen3.5-35b-a3b | 1K-Token | Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $2.00 / 1 Mio. Tokens | Ansehen → |
| qwen3.5-397b-a17b | 1K-Token | Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.60 / 1 Mio. Tokens | Ansehen → |
| qwen3.6-27b | 1K-Token | Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.60 / 1 Mio. Tokens | Ansehen → |
| qwen3.6-35b-a3b | 1K-Token | Eingabe $0.38 / 1 Mio. Tokens | Ausgabe $2.25 / 1 Mio. Tokens | Ansehen → |
| Endpoint | Auflösung | Dauer | Preis | |
|---|---|---|---|---|
| chat_completion | — | — | Eingabe $0.40 / 1 Mio. Tokens | Ausgabe $3.20 / 1 Mio. Tokens |
Preise für qwen3.5-122b-a10b angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.
Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.
Nutze deinen RunAPI Key für jedes unterstützte Modell.
Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.
Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.
Die Qwen-Sprachmodelle von Alibaba sind Open-Weight-LLMs, als Mixture-of-Experts oder dicht, mit 131K bis 256K Kontext. Die meisten nehmen Bilder an und bieten einen Thinking-Modus. Über RunAPI teilen sie einen API-Key und tokenbasierte Abrechnung, und jedes OpenAI SDK kann sie unter https://runapi.ai/v1 aufrufen. Es handelt sich um Qwens Sprachmodelle, getrennt von den Bildgenerierungsmodellen Qwen Image, Qwen 2 und Qwen 3.
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.
Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.
Beginnen Sie mit qwen3.6-27b oder qwen3.6-35b-a3b, den neuesten Qwen-Modellen bei RunAPI, für Chat, Coding und Bildeingabe. Nehmen Sie qwen3.5-397b-a17b, wenn Sie das größte Qwen3.5-Modell wollen, und qwen3-coder-next für Coding-Agenten, die keinen Thinking-Schritt brauchen.
Alle Qwen3.5- und Qwen3.6-Modelle sowie beide Versionen von Qwen3-VL-235B-A22B nehmen Bilder an. Senden Sie sie als image_url-Teile in einem Chat-Completions-Request. qwen3-coder-next verarbeitet nur Text.
Die Qwen3.5- und Qwen3.6-Modelle sind hybrid und haben einen Thinking- und einen Non-Thinking-Modus. qwen3-vl-235b-a22b-thinking denkt immer nach, während qwen3-vl-235b-a22b-instruct und qwen3-coder-next ohne Thinking-Schritt antworten.
Nutzen Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt unter https://runapi.ai/v1/chat/completions mit Ihrem RunAPI-API-Key und einer Qwen-Modell-ID. Jedes OpenAI SDK funktioniert, sobald Sie die Base URL ändern.
Ja. Alibaba veröffentlicht diese Qwen-Modelle mit offenen Gewichten unter der Apache-2.0-Lizenz. RunAPI bietet Ihnen API-Zugang, sodass Sie sie nicht auf eigenen GPUs betreiben müssen.
Die Qwen-Linie umfasst die Sprachmodelle, die Text und Bilder lesen und Text zurückgeben. Qwen Image, Qwen 2 und Qwen 3 sind eigene RunAPI-Linien, die Bilder generieren und bearbeiten.