Endpoint kapsamı
1 genel endpoint sunar: chat_completion.
Ajanlar için açık ağırlıklı Qwen kodlama modeli (3B aktif); 256K bağlam; OpenAI uyumlu API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-coder-next:generateContent
POST /v1beta/models/qwen3-coder-next:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-coder-next",
"messages": [
{
"role": "user",
"content": "Hata veren bir panonun bu ekran görüntüsünü oku, hata mesajının ne anlama geldiğini açıkla ve sorunu giderecek kod değişikliğini öner."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-coder-next",
messages=[{"role": "user", "content": "Hata veren bir panonun bu ekran görüntüsünü oku, hata mesajının ne anlama geldiğini açıkla ve sorunu giderecek kod değişikliğini öner."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-coder-next",
messages: [{ role: "user", content: "Hata veren bir panonun bu ekran görüntüsünü oku, hata mesajının ne anlama geldiğini açıkla ve sorunu giderecek kod değişikliğini öner." }]
});
9 varyant mevcut
Qwen3-Coder-Next, Alibaba Qwen'in 3 Şubat 2026'da Apache 2.0 lisansıyla yayımladığı açık ağırlıklı bir kodlama modelidir. Hibrit attention kullanan seyrek bir Mixture-of-Experts (MoE) modeli olan Qwen3-Next-80B-A3B üzerine kuruludur; toplam 80B parametresi vardır ve token başına 3B parametresi aktiftir. Qwen modeli kodlama ajanları ve depo düzeyindeki işler için eğitti.
Qwen'in model kartına göre model yalnızca düşünmeyen modda çalışır ve thinking blokları üretmez; bu yüzden yanıt doğrudan cevapla veya araç çağrısıyla başlar. Alibaba'nın API'si modeli 262.144 tokenlik bağlam penceresi, en fazla 204.800 token girdi ve en fazla 65.536 token çıktıyla sunar.
RunAPI'de qwen3-coder-next modelini, https://runapi.ai/v1 adresine yönlendirilmiş bir OpenAI SDK ile OpenAI uyumlu Chat Completions uç noktası (/v1/chat/completions) üzerinden çağırın. Model metin girdisi alır. Araçlar standart OpenAI tools biçimini kullanır ve model yanıtta tool_calls döndürür.
| Sağlayıcı | Alibaba |
| Model kimliği | qwen3-coder-next |
| Modality | Metin |
| Görev türleri | Synchronous |
| API uç noktası | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-coder-next:generateContent | |
| /v1beta/models/qwen3-coder-next:streamGenerateContent | |
| Faturalandırma birimi | 1K token |
| Katalog durumu | Kullanımdan kaldırıldı |
Ücretsiz kaydolun ve kontrol panelinden qwen3-coder-next için bir API anahtarı oluşturun.
qwen3-coder-next model kimliği ve parametrelerinizle /v1/chat/completions adresine POST isteği gönderin.
Tamamlanan qwen3-coder-next yanıtını uç noktadan doğrudan okuyun.
1 genel endpoint sunar: chat_completion.
Abonelik gerektirmeksizin 1K token ile ölçülür.
Bu uç nokta için yayımlanmış istek parametresi yok.
Özel bir bilgi tabanından müşteri sorularını yanıtlayarak destek talebi sayısını azaltın.
Sözleşme özetleri hazırlayın ve avukat incelemesi için önemli maddeleri işaretleyin.
CI içinde birim testleri, kod incelemeleri ve refaktör önerilerini otomatik oluşturun.
Kodlama ajanları ve depo düzeyindeki işler için: bir kod tabanını okumak, birkaç dosyayı düzenlemek ve bir döngü içinde araç çağırmak gibi. Qwen, 10 ila 20 kat daha fazla aktif parametreye sahip modellerle karşılaştırılabilir SWE-Bench-Pro sonuçları bildiriyor.
Evet. Chat Completions isteğinde araçları OpenAI biçiminde gönderin, model tool_calls döndürür. Qwen'in model kartı da araç çağırmayı modelin başlıca güçlü yönlerinden biri olarak tanımlıyor.
Hayır. Qwen'in model kartına göre yalnızca düşünmeyen modu destekler ve thinking blokları üretmez. Görev bir akıl yürütme adımı gerektiriyorsa düşünme modu olan bir Qwen3.5 veya Qwen3.6 modeli kullanın.
80B parametresinin 3B'si her token için aktiftir. Model, seyrek Mixture-of-Experts tasarımını hibrit attention ile birleştiren Qwen3-Next-80B-A3B üzerine kuruludur.
Quickstart'ta gösterilen model ID'sini gönderin.
Anahtar bazlı hız limitleri kullanım kademesine göre ölçeklenir. Güncel limitler için fiyatlandırma sayfasına bakın.
Evet — varyant bir bayraktır. model parametresini değiştirerek geçiş yapın.
Streaming उपलब्ध olduğunda RunAPI uçtan uca stream eder.
Herkese açık GitHub reposunda bir issue açın veya desteğe e-posta gönderin.
Kurumsal kurulum, entegrasyonlar ve teknik sorular konusunda yardımcı oluruz.
İletişime geçin