公開版本與端點
| 模型 ID | 端點 | 起始價格 | 模型目錄 |
|---|---|---|---|
MiniMax-M2
|
/v1/chat/completions
|
$0.19 / 百萬 tokens | 模型詳情 |
MiniMax-M2.1
|
/v1/chat/completions
|
$0.19 / 百萬 tokens | 模型詳情 |
MiniMax-M2.5
|
/v1/chat/completions
|
$0.19 / 百萬 tokens | 模型詳情 |
MiniMax-M2.5-highspeed
|
/v1/chat/completions
|
$0.37 / 百萬 tokens | 模型詳情 |
MiniMax-M2.7
|
/v1/chat/completions
|
$0.19 / 百萬 tokens | 模型詳情 |
MiniMax-M2.7-highspeed
|
/v1/chat/completions
|
$0.37 / 百萬 tokens | 模型詳情 |
MiniMax-M3
|
/v1/chat/completions
|
$0.18 / 百萬 tokens | 模型詳情 |
驗證
輪詢,直到 Task 進入終態
選擇 <model-id> 後產生驗證命令。
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。
三步開始使用
-
選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
-
設定 RunAPI
為此 Agent 新增 Provider 設定。
-
驗證結果
執行下方 Agent 狀態與模型選擇命令。
使用 Hermes Agent + MiniMax 可以建立甚麼
-
Agent 編碼與推理
借助模型的推理能力,讓 Agent 規劃、編寫和審查代碼,或處理多步驟問題。
-
長文件分析與擷取
總結報告、合約或代碼庫,並從長文件中擷取結構化欄位。
-
工具調用工作流程
將模型連接到函數和 API,讓 Agent 在回覆之間查詢數據並執行操作。
為甚麼透過 RunAPI + Hermes Agent 使用 MiniMax
-
7 個變體,一個 API 金鑰
透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。
-
清晰的用量價格
發送請求前查看目錄中的目前價格,無需訂閱或最低消費。
-
直接返回結果
同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。
Hermes Agent + MiniMax 常見問題
呢啲同 MiniMax Hailuo 影片模型一樣嗎?
唔一樣。呢啲係 MiniMax 用於程式碼同聊天嘅文字語言模型;Hailuo 係 MiniMax 另一條影片生成產品線。
我應該揀邊個 MiniMax 文字模型?
MiniMax-M3 最強,具備 1M 上下文、80.5% SWE-bench Verified,亦係第一個結合前沿程式碼能力同百萬 token 上下文嘅開放權重模型。M2.7 係最佳 200K 上下文選項。Highspeed 變體(M2.5 同 M2.7)以相同權重用約 100 tokens/sec 運行,以較高 token 成本換取更低延遲。
邊啲 SDK 可以透過 RunAPI 呼叫 MiniMax 文字模型?
使用 OpenAI SDK(Chat Completions 或 Responses)或者 Anthropic Messages SDK 連到 RunAPI,並傳入 MiniMax model id;proxy 會調整協定。
MiniMax 文字模型點樣收費?
按 token、按用量計費,採用 RunAPI 為每個模型公布嘅輸入同輸出費率。Highspeed 變體按其單獨公布嘅費率計費,輸出質素相同,吞吐量更高。
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。
本指南會設定聊天模型嗎?
會。此 Model Line 支援面向用戶端的 LLM 協定。