Alibaba · 文字

Hermes Agent x Qwen

Alibaba 的 Qwen 語言模型是開放權重的 MoE 及稠密大型語言模型,上下文由 131K 至 256K。大部分支援圖片輸入並提供思考模式。透過 RunAPI,它們共用一組 API key、按 token 計費,任何 OpenAI SDK 都可以經 https://runapi.ai/v1 調用。這些是 Qwen 的語言模型,與 Qwen Image、Qwen 2 及 Qwen 3 圖片生成模型各自獨立。

6 variants 由 $0.25 / 百萬 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 qwen3.5-122b-a10b:開放權重 Qwen3.5 視覺 MoE 模型(啟用 10B);256K 上下文;OpenAI 相容 API。

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: 開放權重 Qwen3.5 視覺 MoE 模型(啟用 10B);256K 上下文;OpenAI 相容 API
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: 稠密開放權重 Qwen3.5 視覺模型;256K 上下文,混合思考;OpenAI 相容 API
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: 小型開放權重 Qwen3.5 視覺 MoE 模型(啟用 3B);256K 上下文;OpenAI 相容 API
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: Qwen3.5 旗艦開放權重視覺 MoE 模型(啟用 17B);256K 上下文;OpenAI 相容 API
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: 為代理式編程而設的稠密開放權重 Qwen3.6 視覺模型;256K 上下文;OpenAI 相容 API
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: 首個開放權重 Qwen3.6 模型,啟用 3B 的視覺 MoE;256K 上下文;OpenAI 相容 API
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 看看這張出錯的儀表板截圖,解釋錯誤訊息的意思,並提出可以修正問題的程式碼改動。
Verify the active model with: hermes model;hermes doctor

公開版本與端點

模型 ID 端點 起始價格 模型目錄
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 百萬 tokens 模型詳情
qwen3.5-27b
/v1/chat/completions
$0.30 / 百萬 tokens 模型詳情
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 百萬 tokens 模型詳情
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 百萬 tokens 模型詳情
qwen3.6-27b
/v1/chat/completions
$0.60 / 百萬 tokens 模型詳情
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 百萬 tokens 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    為此 Agent 新增 Provider 設定。

  3. 驗證結果

    執行下方 Agent 狀態與模型選擇命令。

使用 Hermes Agent + Qwen 可以建立甚麼

  • Agent 編碼與推理

    借助模型的推理能力,讓 Agent 規劃、編寫和審查代碼,或處理多步驟問題。

  • 長文件分析與擷取

    總結報告、合約或代碼庫,並從長文件中擷取結構化欄位。

  • 工具調用工作流程

    將模型連接到函數和 API,讓 Agent 在回覆之間查詢數據並執行操作。

為甚麼透過 RunAPI + Hermes Agent 使用 Qwen

  • 6 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 直接返回結果

    同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。

Hermes Agent + Qwen 常見問題

應該從哪個 Qwen 模型開始?

對話、編程及圖片輸入,可以先用 RunAPI 上最新的 Qwen 模型 qwen3.6-27b 或 qwen3.6-35b-a3b。需要最大的 Qwen3.5 模型時用 qwen3.5-397b-a17b,毋須思考步驟的編碼代理則用 qwen3-coder-next。

哪些 Qwen 模型支援圖片輸入?

所有 Qwen3.5 及 Qwen3.6 模型,以及 Qwen3-VL-235B-A22B 的兩個版本都支援圖片輸入。在 Chat Completions 請求中以 image_url 內容區塊傳送圖片。qwen3-coder-next 只支援文字。

Qwen 模型的思考模式如何運作?

Qwen3.5 及 Qwen3.6 模型是混合模型,具備思考及非思考兩種模式。qwen3-vl-235b-a22b-thinking 每次都會思考,而 qwen3-vl-235b-a22b-instruct 及 qwen3-coder-next 則不經思考步驟直接作答。

在 RunAPI 上調用 Qwen 要用哪個 API?

使用 OpenAI 相容的 Chat Completions 端點 https://runapi.ai/v1/chat/completions,填入你的 RunAPI API key 及 Qwen 模型 ID。更改 base URL 後,任何 OpenAI SDK 都可以使用。

Qwen 語言模型是開放權重的嗎?

是。Alibaba 以 Apache 2.0 授權開放這些 Qwen 模型的權重。RunAPI 提供 API 存取,你毋須在自己的 GPU 上部署。

Qwen 系列與 Qwen Image 有甚麼分別?

Qwen 系列是語言模型,讀取文字及圖片並輸出文字。Qwen Image、Qwen 2 及 Qwen 3 是 RunAPI 上獨立的系列,用於生成及編輯圖片。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

會。此 Model Line 支援面向用戶端的 LLM 協定。

透過 Hermes Agent 開始使用 Qwen

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們