Couverture des endpoints
Expose 1 endpoint(s) public(s) : chat_completion.
MoE vision open-weight Qwen3.5 (10B actifs) ; contexte 256K ; API compatible OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-122b-a10b:generateContent
POST /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-122b-a10b",
"messages": [
{
"role": "user",
"content": "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-122b-a10b",
messages=[{"role": "user", "content": "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-122b-a10b",
messages: [{ role: "user", content: "Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème." }]
});
9 versions disponibles
Qwen3.5-122B-A10B est un modèle vision-langage natif de la série Qwen3.5 Medium d'Alibaba, publié en open-weight sous licence Apache 2.0 le 24 février 2026. C'est un modèle Mixture-of-Experts à attention linéaire hybride, avec 122B paramètres au total et 10B actifs par token. Alibaba le classe deuxième de la génération Qwen3.5, derrière Qwen3.5-397B-A17B.
Selon Alibaba, ses capacités textuelles dépassent celles de Qwen3-235B-2507 et ses capacités de vision celles de Qwen3-VL-235B. C'est un modèle hybride avec le thinking activé par défaut, une fenêtre de contexte de 262 144 tokens et jusqu'à 65 536 tokens de sortie. L'appel de fonctions et les sorties structurées sont pris en charge.
Sur RunAPI, appelez qwen3.5-122b-a10b via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions), avec un SDK OpenAI configuré sur https://runapi.ai/v1. Les images se placent dans des parties image_url de messages[].content[].
Choisissez un modèle et générez en quelques secondes.
| Fournisseur | Alibaba |
| ID du modèle | qwen3.5-122b-a10b |
| Modalité | Texte |
| Types de tâche | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-122b-a10b:generateContent | |
| /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent | |
| Unité de facturation | 1 000 jetons |
| État du catalogue | Opérationnel |
Inscrivez-vous gratuitement et créez une clé API pour qwen3.5-122b-a10b depuis le tableau de bord.
Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle qwen3.5-122b-a10b et vos paramètres.
Lisez directement la réponse qwen3.5-122b-a10b terminée depuis l’endpoint.
Expose 1 endpoint(s) public(s) : chat_completion.
Mesuré par 1 000 jetons, sans abonnement requis.
Aucun paramètre de requête n'est publié pour cet endpoint.
Utilisez les LLM pour le chat et le raisonnement.
Générez et révisez le travail d'implémentation.
Connectez les modèles aux tâches backend.
Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.
Alibaba place le modèle 122B juste derrière le phare 397B. Il active 10B paramètres par token, contre 17B pour le phare. Les deux ont une fenêtre de contexte de 262 144 tokens, l'entrée image et le thinking hybride.
Selon Alibaba, les capacités de vision de Qwen3.5-122B-A10B dépassent celles de Qwen3-VL-235B, et sa fenêtre de contexte est deux fois plus grande. Testez-le sur vos propres images avant de migrer une charge de production.
Par défaut, oui. Il dispose de modes avec et sans thinking, et l'API d'Alibaba active le thinking sauf si la requête le désactive. Le thinking allonge les réponses : prévoyez plus de temps pour les requêtes synchrones.
Utilisez le point d'accès Chat Completions compatible OpenAI de RunAPI à l'adresse https://runapi.ai/v1/chat/completions, avec votre clé API RunAPI et model défini sur qwen3.5-122b-a10b. Les outils suivent le format standard d'OpenAI.
Passez l'ID de modèle affiché dans le quickstart.
Oui. Les tarifs sont mesurés par appel ou par unité.
Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.
Nous contacter