Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Utilisez l'API Qwen via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème." }]
});
Qwen est la famille de modèles de langage open-weight d'Alibaba, publiés sous licence Apache 2.0. Sur RunAPI, les modèles Qwen3.5 (397B-A17B, 122B-A10B, 27B, 35B-A3B) et Qwen3.6 (27B, 35B-A3B) sont des modèles vision-langage natifs, avec une fenêtre de contexte de 262 144 tokens et un thinking hybride. Qwen3-VL-235B-A22B existe en versions Thinking et Instruct pour la compréhension d'images, avec une fenêtre de contexte de 131 072 tokens. Qwen3-Coder-Next est un modèle de code texte uniquement, conçu pour les agents, avec 3B paramètres actifs. Tous s'appellent via le point d'accès Chat Completions compatible OpenAI de RunAPI avec une seule clé API.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Facturation | Tarifs | |
|---|---|---|---|
| qwen3-coder-next | 1 000 jetons | Retiré | Voir → |
| qwen3-vl-235b-a22b-instruct | 1 000 jetons | Retiré | Voir → |
| qwen3-vl-235b-a22b-thinking | 1 000 jetons | Retiré | Voir → |
| qwen3.5-122b-a10b | 1 000 jetons | Entrée $0.40 / 1M de tokens | Sortie $3.20 / 1M de tokens | Voir → |
| qwen3.5-27b | 1 000 jetons | Entrée $0.30 / 1M de tokens | Sortie $2.40 / 1M de tokens | Voir → |
| qwen3.5-35b-a3b | 1 000 jetons | Entrée $0.25 / 1M de tokens | Sortie $2.00 / 1M de tokens | Voir → |
| qwen3.5-397b-a17b | 1 000 jetons | Entrée $0.60 / 1M de tokens | Sortie $3.60 / 1M de tokens | Voir → |
| qwen3.6-27b | 1 000 jetons | Entrée $0.60 / 1M de tokens | Sortie $3.60 / 1M de tokens | Voir → |
| qwen3.6-35b-a3b | 1 000 jetons | Entrée $0.38 / 1M de tokens | Sortie $2.25 / 1M de tokens | Voir → |
| Endpoint | Résolution | Durée | Prix | |
|---|---|---|---|---|
| chat_completion | — | — | Entrée $0.40 / 1M de tokens | Sortie $3.20 / 1M de tokens |
Prix affichés pour qwen3.5-122b-a10b. Les autres variantes conservent leurs propres tarifs par endpoint.
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Interrogez par task ID ou traitez le callback quand la génération se termine.
Les modèles de langage Qwen d'Alibaba sont des LLM open-weight, Mixture-of-Experts ou denses, avec un contexte de 131K à 256K. La plupart acceptent les images et proposent un mode thinking. Via RunAPI, ils partagent une seule clé API et une facturation au token, et n'importe quel SDK OpenAI peut les appeler sur https://runapi.ai/v1. Il s'agit des modèles de langage de Qwen, distincts des modèles de génération d'images Qwen Image, Qwen 2 et Qwen 3.
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Les tarifs à l'usage sont visibles avant l'appel.
Commencez par qwen3.6-27b ou qwen3.6-35b-a3b, les modèles Qwen les plus récents sur RunAPI, pour le chat, le code et l'entrée image. Prenez qwen3.5-397b-a17b si vous voulez le plus grand modèle Qwen3.5, et qwen3-coder-next pour les agents de code qui n'ont pas besoin d'étape de thinking.
Tous les modèles Qwen3.5 et Qwen3.6, ainsi que les deux versions de Qwen3-VL-235B-A22B, acceptent les images. Envoyez-les sous forme de parties image_url dans une requête Chat Completions. qwen3-coder-next traite uniquement le texte.
Les modèles Qwen3.5 et Qwen3.6 sont hybrides et disposent de modes avec et sans thinking. qwen3-vl-235b-a22b-thinking raisonne toujours, tandis que qwen3-vl-235b-a22b-instruct et qwen3-coder-next répondent sans étape de thinking.
Utilisez le point d'accès Chat Completions compatible OpenAI à l'adresse https://runapi.ai/v1/chat/completions, avec votre clé API RunAPI et un ID de modèle Qwen. N'importe quel SDK OpenAI fonctionne une fois l'URL de base modifiée.
Oui. Alibaba publie ces modèles Qwen avec des poids ouverts sous licence Apache 2.0. RunAPI vous donne un accès API, vous n'avez donc pas à les héberger sur vos propres GPU.
La ligne Qwen regroupe les modèles de langage, qui lisent du texte et des images et renvoient du texte. Qwen Image, Qwen 2 et Qwen 3 sont des lignes RunAPI distinctes qui génèrent et modifient des images.