MiniMax · Texto

Hermes Agent x MiniMax

Modelos de texto MiniMax série M são LLMs sparse MoE com contexto 200K–1M, entregando scores frontier de coding por uma fração do custo de modelos densos. Pelo RunAPI, compartilham uma única API key com cobrança pay-as-you-go por token, chamáveis pelas superfícies OpenAI Chat Completions, OpenAI Responses e Anthropic Messages. Estes são os modelos de texto da MiniMax, distintos da geração de vídeo MiniMax Hailuo.

7 variants a partir de $0.18 / 1M de tokens Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use MiniMax-M2 quando ele corresponder à tarefa: 230B / 10B ativos; contexto 200K; modelo de coding baseline da série M.

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 10B ativos; contexto 200K; modelo de coding baseline da série M
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: Contexto 200K; programação poliglota; 74% SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: Contexto 200K; tool calling agêntico e busca mais fortes
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: M2.5 a ~100 tokens/sec; mesmos pesos, maior throughput
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: Contexto 200K; 56,2% SWE-bench Pro; treinamento autoevolutivo
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: M2.7 a ~100 tokens/sec; mesmos pesos, maior throughput
  chat endpoints: /v1/chat/completions
- MiniMax-M3: Contexto 1M; 80,5% SWE-bench Verified; coding frontier open-weight + longo contexto
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Dada esta especificação de API, gere um client tipado, escreva testes de integração contra um mock server e itere até passarem.
Verify the active model with: hermes model;hermes doctor

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
MiniMax-M2
/v1/chat/completions
$0.19 / 1M de tokens Detalhes do modelo
MiniMax-M2.1
/v1/chat/completions
$0.19 / 1M de tokens Detalhes do modelo
MiniMax-M2.5
/v1/chat/completions
$0.19 / 1M de tokens Detalhes do modelo
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 1M de tokens Detalhes do modelo
MiniMax-M2.7
/v1/chat/completions
$0.19 / 1M de tokens Detalhes do modelo
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 1M de tokens Detalhes do modelo
MiniMax-M3
/v1/chat/completions
$0.18 / 1M de tokens Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Adicione a configuração do provedor para este agente.

  3. Verifique o resultado

    Execute os comandos de status e seleção de modelo mostrados abaixo.

O que criar com Hermes Agent + MiniMax

  • Programação e raciocínio com agentes

    Deixe seu agente planejar, escrever e revisar código ou resolver problemas de várias etapas com o raciocínio do modelo.

  • Análise e extração de documentos longos

    Resuma relatórios, contratos ou bases de código e extraia campos estruturados de documentos longos.

  • Fluxos com chamadas de ferramentas

    Conecte o modelo a funções e APIs para que seu agente consulte dados e execute ações entre as respostas.

Por que usar MiniMax pelo RunAPI + Hermes Agent

  • 7 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Respostas diretas

    Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.

Perguntas sobre Hermes Agent + MiniMax

Eles são os mesmos modelos do MiniMax Hailuo video?

Não. Estes são os modelos de linguagem de texto da MiniMax para coding e chat; Hailuo é a linha separada de geração de vídeo da MiniMax.

Qual modelo de texto MiniMax devo escolher?

MiniMax-M3 é o mais forte — contexto 1M, 80,5% SWE-bench Verified e o primeiro modelo open-weight a combinar coding frontier com contexto de um milhão de tokens. M2.7 é a melhor opção com contexto 200K. Variants Highspeed (M2.5 e M2.7) rodam os mesmos pesos a ~100 tokens/sec para menor latência com custo de token mais alto.

Quais SDKs podem chamar MiniMax text pelo RunAPI?

Use o SDK da OpenAI (Chat Completions ou Responses) ou o SDK Anthropic Messages contra o RunAPI com o model id da MiniMax; o proxy adapta o protocolo.

Como MiniMax text é cobrado?

Por token nas taxas de entrada e saída publicadas pelo RunAPI para cada modelo, pay-as-you-go. Variants Highspeed são cobradas pelas próprias tarifas publicadas, com a mesma qualidade de saída e maior throughput.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.

Comece a usar MiniMax com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco