Endpoint 覆蓋範圍
公開 1 個公共 endpoint:chat_completion。
專為 AI 代理打造的開放權重 Qwen 程式碼模型(啟用 3B);256K 上下文;OpenAI 相容 API
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-coder-next:generateContent
POST /v1beta/models/qwen3-coder-next:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-coder-next",
"messages": [
{
"role": "user",
"content": "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-coder-next",
messages=[{"role": "user", "content": "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-coder-next",
messages: [{ role: "user", content: "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。" }]
});
9 個版本可用
Qwen3-Coder-Next 是 Alibaba Qwen 團隊於 2026 年 2 月 3 日以 Apache 2.0 授權釋出的開放權重程式碼模型。它以 Qwen3-Next-80B-A3B 為基礎,後者是採用混合注意力的稀疏 MoE 模型,總參數 80B,每個 token 啟用 3B。Qwen 團隊訓練它的目標是程式碼代理與儲存庫層級的開發工作。
Qwen 的模型卡說明它只支援非思考模式,不會產生思考區塊,因此回覆一開始就是答案或工具呼叫。Alibaba 官方 API 為它提供 262,144 token 的上下文視窗,輸入最多 204,800 token,輸出最多 65,536 token。
在 RunAPI 上,將 OpenAI SDK 的 base URL 指向 https://runapi.ai/v1,即可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)呼叫 qwen3-coder-next。它接受文字輸入。工具採用標準的 OpenAI tools 格式,模型會在回應中回傳 tool_calls。
| 提供者 | Alibaba |
| 模型 ID | qwen3-coder-next |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-coder-next:generateContent | |
| /v1beta/models/qwen3-coder-next:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 已下線 |
免費註冊後,從控制台建立 qwen3-coder-next 的 API 金鑰。
向 /v1/chat/completions 傳送 POST 請求,並傳入 qwen3-coder-next 模型 ID 與參數。
直接從端點讀取已完成的 qwen3-coder-next 回應。
公開 1 個公共 endpoint:chat_completion。
依 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答顧客問題,減少工單量。
起草合約摘要,並標示關鍵條款供律師審閱。
在 CI 中自動產生單元測試、程式碼審查與重構建議。
程式碼代理與儲存庫層級的開發,例如閱讀 codebase、修改多個檔案、反覆呼叫工具。Qwen 團隊公布的 SWE-Bench-Pro 成績,與啟用參數多出 10 到 20 倍的模型相當。
支援。在 Chat Completions 請求中以 OpenAI 格式傳入 tools,模型就會回傳 tool_calls。Qwen 的模型卡把工具呼叫列為這個模型的主要強項之一。
沒有。Qwen 的模型卡說明它只支援非思考模式,不會產生思考區塊。如果任務需要推理步驟,請使用具備思考模式的 Qwen3.5 或 Qwen3.6 模型。
80B 參數中,每個 token 啟用 3B。這個模型以 Qwen3-Next-80B-A3B 為基礎,結合稀疏 MoE 設計與混合注意力。
傳入 quickstart 顯示的 model ID。
每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。
可以——variant 只是旗標。只要變更 model 參數即可切換。
只要支援串流,RunAPI 就會端到端串流。
請在公開 GitHub repo 提交 issue,或寄信給支援。