统一认证,接入所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
通过 RunAPI 使用 Qwen API,配套 model skill、统一认证和按需计费。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。" }]
});
Qwen(通义千问)是阿里巴巴以 Apache 2.0 许可证开放权重的语言模型系列。RunAPI 上的 Qwen3.5 模型(397B-A17B、122B-A10B、27B、35B-A3B)和 Qwen3.6 模型(27B、35B-A3B)都是原生视觉语言模型,具备 262,144 token 的上下文窗口和混合思考模式。Qwen3-VL-235B-A22B 提供 Thinking 和 Instruct 两个版本,用于图像理解,上下文窗口为 131,072 token。Qwen3-Coder-Next 是面向智能体的纯文本编程模型,激活参数 3B。以上模型都通过 RunAPI 的 OpenAI 兼容 Chat Completions 端点调用,共用一个 API key。
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| 变体 | 计费方式 | 价格 | |
|---|---|---|---|
| qwen3-coder-next | 1K tokens | 已下线 | 查看 → |
| qwen3-vl-235b-a22b-instruct | 1K tokens | 已下线 | 查看 → |
| qwen3-vl-235b-a22b-thinking | 1K tokens | 已下线 | 查看 → |
| qwen3.5-122b-a10b | 1K tokens | 输入 $0.40 / 百万 tokens | 输出 $3.20 / 百万 tokens | 查看 → |
| qwen3.5-27b | 1K tokens | 输入 $0.30 / 百万 tokens | 输出 $2.40 / 百万 tokens | 查看 → |
| qwen3.5-35b-a3b | 1K tokens | 输入 $0.25 / 百万 tokens | 输出 $2.00 / 百万 tokens | 查看 → |
| qwen3.5-397b-a17b | 1K tokens | 输入 $0.60 / 百万 tokens | 输出 $3.60 / 百万 tokens | 查看 → |
| qwen3.6-27b | 1K tokens | 输入 $0.60 / 百万 tokens | 输出 $3.60 / 百万 tokens | 查看 → |
| qwen3.6-35b-a3b | 1K tokens | 输入 $0.38 / 百万 tokens | 输出 $2.25 / 百万 tokens | 查看 → |
| Endpoint | 分辨率 | 时长 | 价格 | |
|---|---|---|---|---|
| chat_completion | — | — | 输入 $0.40 / 百万 tokens | 输出 $3.20 / 百万 tokens |
当前价格适用于 qwen3.5-122b-a10b。其他变体保留各自的 endpoint 定价。
根据输出类型、质量要求和延迟目标选择模型与变体。
设置 RunAPI key,并在代码工作区安装对应 model skill。
按 skill 里的说明,把模型能力接入到你的应用里。
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
USD 按次定价,按月结算。失败的生成不计费。
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
聊天、编程和图像输入,可以先用 RunAPI 上最新的 Qwen 模型 qwen3.6-27b 或 qwen3.6-35b-a3b。需要最大的 Qwen3.5 模型时用 qwen3.5-397b-a17b,不需要思考步骤的编程智能体用 qwen3-coder-next。
所有 Qwen3.5 和 Qwen3.6 模型,以及 Qwen3-VL-235B-A22B 的两个版本都支持图像输入。在 Chat Completions 请求中以 image_url 内容块发送图像。qwen3-coder-next 仅支持文本。
Qwen3.5 和 Qwen3.6 模型是混合模型,具备思考和非思考两种模式。qwen3-vl-235b-a22b-thinking 始终思考,qwen3-vl-235b-a22b-instruct 和 qwen3-coder-next 则不经过思考步骤直接作答。
使用 OpenAI 兼容的 Chat Completions 端点 https://runapi.ai/v1/chat/completions,填入你的 RunAPI API key 和 Qwen 模型 ID。修改 base URL 后,任何 OpenAI SDK 都能使用。
是的。阿里巴巴以 Apache 2.0 许可证开放这些 Qwen 模型的权重。RunAPI 提供 API 访问,你无需在自己的 GPU 上部署。
Qwen 系列是语言模型,读取文本和图像并输出文本。Qwen Image、Qwen 2 和 Qwen 3 是 RunAPI 上独立的系列,用于生成和编辑图像。