公開版本與端點
| 模型 ID | 端點 | 起始價格 | 模型目錄 |
|---|---|---|---|
qwen3.5-122b-a10b
|
/v1/chat/completions
|
$0.40 / 百萬 tokens | 模型詳情 |
qwen3.5-27b
|
/v1/chat/completions
|
$0.30 / 百萬 tokens | 模型詳情 |
qwen3.5-35b-a3b
|
/v1/chat/completions
|
$0.25 / 百萬 tokens | 模型詳情 |
qwen3.5-397b-a17b
|
/v1/chat/completions
|
$0.60 / 百萬 tokens | 模型詳情 |
qwen3.6-27b
|
/v1/chat/completions
|
$0.60 / 百萬 tokens | 模型詳情 |
qwen3.6-35b-a3b
|
/v1/chat/completions
|
$0.38 / 百萬 tokens | 模型詳情 |
驗證
輪詢,直到 Task 進入終態
選擇 <model-id> 後產生驗證命令。
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。
三步開始使用
-
選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
-
設定 RunAPI
為此 Agent 新增 Provider 設定。
-
驗證結果
執行下方 Agent 狀態與模型選擇命令。
使用 Hermes Agent + Qwen 可以打造什麼
-
Agent 程式開發與推理
藉助模型的推理能力,讓 Agent 規劃、撰寫和審查程式碼,或處理多步驟問題。
-
長文件分析與擷取
摘要報告、合約或程式碼庫,並從長文件中擷取結構化欄位。
-
工具呼叫工作流程
將模型連接到函式和 API,讓 Agent 在回覆之間查詢資料並執行操作。
為什麼透過 RunAPI + Hermes Agent 使用 Qwen
-
6 個變體,一個 API 金鑰
透過一個 RunAPI 連線選擇可用的模型變體,無需變更現有整合。
-
清楚的用量價格
送出請求前查看目錄中的目前價格,無需訂閱或最低消費。
-
直接回傳結果
同步呼叫會在同一個回應中回傳結果,Agent 不需輪詢工作即可直接使用。
Hermes Agent + Qwen 常見問題
該從哪個 Qwen 模型開始?
對話、程式撰寫與圖片輸入,可以先用 RunAPI 上最新的 Qwen 模型 qwen3.6-27b 或 qwen3.6-35b-a3b。需要最大的 Qwen3.5 模型時用 qwen3.5-397b-a17b,不需要思考步驟的程式碼代理則用 qwen3-coder-next。
哪些 Qwen 模型支援圖片輸入?
所有 Qwen3.5 與 Qwen3.6 模型,以及 Qwen3-VL-235B-A22B 的兩個版本都支援圖片輸入。在 Chat Completions 請求中以 image_url 內容區塊傳送圖片。qwen3-coder-next 僅支援文字。
Qwen 模型的思考模式如何運作?
Qwen3.5 與 Qwen3.6 模型是混合模型,具備思考與非思考兩種模式。qwen3-vl-235b-a22b-thinking 一律會思考,qwen3-vl-235b-a22b-instruct 與 qwen3-coder-next 則不經思考步驟直接回答。
在 RunAPI 上呼叫 Qwen 要用哪個 API?
使用 OpenAI 相容的 Chat Completions 端點 https://runapi.ai/v1/chat/completions,填入你的 RunAPI API key 與 Qwen 模型 ID。更改 base URL 之後,任何 OpenAI SDK 都能使用。
Qwen 語言模型是開放權重的嗎?
是的。Alibaba 以 Apache 2.0 授權釋出這些 Qwen 模型的權重。RunAPI 提供 API 存取,你無需在自己的 GPU 上部署。
Qwen 系列和 Qwen Image 有什麼差別?
Qwen 系列是語言模型,讀取文字與圖片並輸出文字。Qwen Image、Qwen 2 和 Qwen 3 是 RunAPI 上獨立的系列,用於生成與編輯圖片。
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。
本指南會設定聊天模型嗎?
會。此 Model Line 支援面向用戶端的 LLM 協定。