MiniMax · 文字

Hermes Agent x MiniMax

MiniMax M-series 文字模型係 sparse MoE LLM,支援 200K-1M 上下文,以遠低於 dense 模型嘅成本提供前沿程式碼分數。透過 RunAPI,呢啲模型共用單一 API 金鑰、按用量 token 收費,並可以從 OpenAI Chat Completions、OpenAI Responses 同 Anthropic Messages 介面呼叫。呢啲係 MiniMax 嘅文字模型,同 MiniMax Hailuo 影片生成唔同。

7 variants 由 $0.18 / 百萬 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 MiniMax-M2:230B / 啟用 10B;200K 上下文;M-series 基準程式碼模型。

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 啟用 10B;200K 上下文;M-series 基準程式碼模型
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: 200K 上下文;polyglot programming;74% SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: 200K 上下文;更強嘅代理式工具調用同搜尋
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: M2.5 約 100 tokens/sec;相同權重,更高吞吐量
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: 200K 上下文;56.2% SWE-bench Pro;self-evolving training
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: M2.7 約 100 tokens/sec;相同權重,更高吞吐量
  chat endpoints: /v1/chat/completions
- MiniMax-M3: 1M 上下文;80.5% SWE-bench Verified;前沿開放權重程式碼 + 長上下文
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 根據呢份 API spec,生成 typed client,針對 mock server 撰寫整合測試,並反覆修改直到通過。
Verify the active model with: hermes model;hermes doctor

公開版本與端點

模型 ID 端點 起始價格 模型目錄
MiniMax-M2
/v1/chat/completions
$0.19 / 百萬 tokens 模型詳情
MiniMax-M2.1
/v1/chat/completions
$0.19 / 百萬 tokens 模型詳情
MiniMax-M2.5
/v1/chat/completions
$0.19 / 百萬 tokens 模型詳情
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 百萬 tokens 模型詳情
MiniMax-M2.7
/v1/chat/completions
$0.19 / 百萬 tokens 模型詳情
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 百萬 tokens 模型詳情
MiniMax-M3
/v1/chat/completions
$0.18 / 百萬 tokens 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    為此 Agent 新增 Provider 設定。

  3. 驗證結果

    執行下方 Agent 狀態與模型選擇命令。

使用 Hermes Agent + MiniMax 可以建立甚麼

  • Agent 編碼與推理

    借助模型的推理能力,讓 Agent 規劃、編寫和審查代碼,或處理多步驟問題。

  • 長文件分析與擷取

    總結報告、合約或代碼庫,並從長文件中擷取結構化欄位。

  • 工具調用工作流程

    將模型連接到函數和 API,讓 Agent 在回覆之間查詢數據並執行操作。

為甚麼透過 RunAPI + Hermes Agent 使用 MiniMax

  • 7 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 直接返回結果

    同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。

Hermes Agent + MiniMax 常見問題

呢啲同 MiniMax Hailuo 影片模型一樣嗎?

唔一樣。呢啲係 MiniMax 用於程式碼同聊天嘅文字語言模型;Hailuo 係 MiniMax 另一條影片生成產品線。

我應該揀邊個 MiniMax 文字模型?

MiniMax-M3 最強,具備 1M 上下文、80.5% SWE-bench Verified,亦係第一個結合前沿程式碼能力同百萬 token 上下文嘅開放權重模型。M2.7 係最佳 200K 上下文選項。Highspeed 變體(M2.5 同 M2.7)以相同權重用約 100 tokens/sec 運行,以較高 token 成本換取更低延遲。

邊啲 SDK 可以透過 RunAPI 呼叫 MiniMax 文字模型?

使用 OpenAI SDK(Chat Completions 或 Responses)或者 Anthropic Messages SDK 連到 RunAPI,並傳入 MiniMax model id;proxy 會調整協定。

MiniMax 文字模型點樣收費?

按 token、按用量計費,採用 RunAPI 為每個模型公布嘅輸入同輸出費率。Highspeed 變體按其單獨公布嘅費率計費,輸出質素相同,吞吐量更高。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

會。此 Model Line 支援面向用戶端的 LLM 協定。

透過 Hermes Agent 開始使用 MiniMax

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們