MiniMax · 텍스트

Hermes Agent x MiniMax

MiniMax M 시리즈 텍스트 모델은 200K-1M 컨텍스트를 갖춘 희소 MoE LLM이며, 밀집 모델보다 훨씬 낮은 비용으로 최전선 코딩 점수를 제공합니다. RunAPI를 통해 단일 API 키와 사용량 기반 토큰 과금을 공유하며, OpenAI Chat Completions, OpenAI Responses, Anthropic Messages 표면에서 호출할 수 있습니다. 이 모델들은 MiniMax의 텍스트 모델로, MiniMax Hailuo 비디오 생성과는 별개입니다.

7 variants 최저 $0.18 / 100만 토큰 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 MiniMax-M2를 사용하세요: 230B / 10B 활성, 200K 컨텍스트, 기준 M 시리즈 코딩 모델.

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 10B 활성, 200K 컨텍스트, 기준 M 시리즈 코딩 모델
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: 200K 컨텍스트, 다언어 프로그래밍, 74% SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: 200K 컨텍스트, 더 강한 에이전틱 도구 호출과 검색
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: 약 100 tokens/sec의 M2.5, 동일 가중치와 더 높은 처리량
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: 200K 컨텍스트, 56.2% SWE-bench Pro, 자기 진화 훈련
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: 약 100 tokens/sec의 M2.7, 동일 가중치와 더 높은 처리량
  chat endpoints: /v1/chat/completions
- MiniMax-M3: 1M 컨텍스트, 80.5% SWE-bench Verified, 최전선 오픈웨이트 코딩과 장문 컨텍스트
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 이 API 사양을 기반으로 타입이 지정된 클라이언트를 생성하고, 목 서버에 대한 통합 테스트를 작성한 뒤 통과할 때까지 반복하세요.
Verify the active model with: hermes model;hermes doctor

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
MiniMax-M2
/v1/chat/completions
$0.19 / 100만 토큰 모델 상세
MiniMax-M2.1
/v1/chat/completions
$0.19 / 100만 토큰 모델 상세
MiniMax-M2.5
/v1/chat/completions
$0.19 / 100만 토큰 모델 상세
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 100만 토큰 모델 상세
MiniMax-M2.7
/v1/chat/completions
$0.19 / 100만 토큰 모델 상세
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 100만 토큰 모델 상세
MiniMax-M3
/v1/chat/completions
$0.18 / 100만 토큰 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    이 Agent의 Provider 설정을 추가합니다.

  3. 결과 검증

    아래 Agent 상태 및 모델 선택 명령을 실행합니다.

Hermes Agent + MiniMax로 만들 수 있는 것

  • 에이전트 코딩과 추론

    모델의 추론 능력으로 에이전트가 코드를 계획, 작성, 검토하거나 여러 단계의 문제를 해결하게 할 수 있습니다.

  • 긴 문서 분석과 추출

    보고서, 계약서, 코드베이스를 요약하고 긴 문서에서 구조화된 필드를 추출합니다.

  • 도구 호출 워크플로

    모델을 함수와 API에 연결해 에이전트가 응답 사이에 데이터를 조회하고 작업을 실행하도록 합니다.

MiniMax을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 7개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 즉시 응답

    동기 호출은 같은 응답 안에 결과를 반환하므로 에이전트가 작업 상태를 폴링하지 않고 바로 결과를 사용할 수 있습니다.

Hermes Agent + MiniMax 자주 묻는 질문

이것들은 MiniMax Hailuo 비디오 모델과 같은가요?

아닙니다. 이것들은 코딩과 채팅을 위한 MiniMax의 텍스트 언어 모델입니다. Hailuo는 MiniMax의 별도 비디오 생성 라인입니다.

어떤 MiniMax 텍스트 모델을 선택해야 하나요?

MiniMax-M3가 가장 강력합니다. 1M 컨텍스트, SWE-bench Verified 80.5%를 제공하며, 최전선 코딩과 백만 토큰 컨텍스트를 결합한 최초의 오픈웨이트 모델입니다. M2.7은 최고의 200K 컨텍스트 옵션입니다. Highspeed 변형(M2.5 및 M2.7)은 더 높은 토큰 비용으로 더 낮은 지연 시간을 위해 동일한 가중치를 약 100 tokens/sec로 실행합니다.

어떤 SDK로 RunAPI에서 MiniMax 텍스트를 호출할 수 있나요?

OpenAI SDK의 Chat Completions 또는 Responses, 또는 Anthropic Messages SDK를 RunAPI에 연결하고 MiniMax 모델 id를 사용하세요. 프록시가 프로토콜을 맞춰 줍니다.

MiniMax 텍스트는 어떻게 과금되나요?

각 모델에 대해 RunAPI에 공개된 입력 및 출력 요율에 따라 토큰 단위, 사용량 기반으로 과금됩니다. Highspeed 변형은 더 높은 처리량에서 동일한 출력 품질을 제공하며 별도로 공개된 요율로 청구됩니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

예. 이 Model Line은 클라이언트용 LLM 프로토콜을 지원합니다.

Hermes Agent에서 MiniMax 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기