API de LLM

LLM API — Compatível com OpenAI

Acesse Claude, GPT, Gemini, DeepSeek e Grok por um único endpoint compatível com OpenAI. /v1/chat/completions, /v1/messages, /v1/responses.

67 modelos troca de base_url plug-and-play pague por token

67
Modelos LLM
15-25%
Abaixo do oficial
2 linhas
Para migrar

Playground

ao vivo
Modelo
Mensagem
Refactor this handler to stream partial results and return a typed error on timeout.
Máximo de tokens
integer | null
Temperatura
number | null
Stream
false
Endpoint
/v1/chat/completions
Custo estimado
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Exemplos

Comparação entre múltiplos modelos

Prompt Explique computação quântica em uma frase

Claude/claude-fable-5

Chame Claude/claude-fable-5 pelo /v1/messages.
Mantenha a mesma chave RunAPI e o mesmo formato de requisição enquanto compara as saídas.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Chame Claude/claude-fable-5-1 pelo /v1/messages.
Mantenha a mesma chave RunAPI e o mesmo formato de requisição enquanto compara as saídas.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Chame Claude/claude-haiku-4-5-20251001 pelo /v1/messages.
Mantenha a mesma chave RunAPI e o mesmo formato de requisição enquanto compara as saídas.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 formatos de endpoint, uma chave

Chat completion

O formato OpenAI que todo SDK já conhece. Troque a base_url e mantenha seu código de requisição atual.

Message

O formato Messages API para prompts de sistema, uso de ferramentas e blocos de conteúdo estruturado.

Response

O formato stateful para loops de agentes com múltiplos turnos e gerenciamento de conversa no servidor.

Embedding

Embeddings vetoriais para recuperação, cobrados por token na mesma chave RunAPI.

LLMs em uma só chave

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Ver todos os 67 modelos LLM
Início rápido

Chame qualquer modelo com o formato OpenAI

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Como funciona

Quatro passos para sua primeira geração

  1. Obtenha sua chave de API

    Crie uma chave para sua conta RunAPI.

  2. Use o formato OpenAI

    Envie solicitações pelo endpoint compatível com OpenAI documentado.

  3. Roteamos com inteligência

    O RunAPI seleciona uma rota compatível com sua solicitação.

  4. Transmita respostas

    Receba a saída em streaming quando o endpoint selecionado oferecer suporte a SSE.

Por que desenvolvedores escolhem o RunAPI

Uma Chave, Todos os Modelos

Pare de gerenciar várias chaves de API. Uma única integração dá acesso a 230+ modelos de todos os provedores.

Economia de 15–25%

Nossos acordos de volume com provedores garantem preços menores do que contratar diretamente. Sem margem adicional.

Failover Automático

Se um provedor sair do ar, redirecionamos para a melhor alternativa. Sua aplicação continua no ar.

Compatível com OpenAI

Substituto direto para o SDK da OpenAI. Mude uma linha de código para acessar qualquer modelo.

Cobrança em Tempo Real

Pague apenas pelo que usar. Preço por requisição sem valor mínimo. Acompanhe custos por modelo e por projeto.

Privacidade dos dados

Nossa política de privacidade explica como os dados das solicitações e o conteúdo gerado são processados e armazenados.

O que equipes constroem com isso

Agentes de Código

Roteie planejamento para o Opus e edições para um modelo econômico, em uma chave com uma única fatura.

Pipelines RAG

Embeddings e geração no mesmo endpoint, para que recuperação e resposta compartilhem um orçamento.

Geração de Conteúdo

Distribua rascunhos entre modelos e fique com o melhor, sem assinar cinco contratos com provedores.

Comparação entre Modelos

Faça testes A/B com o mesmo prompt no Claude, GPT e Gemini alterando apenas uma string.

RunAPI vs alternativas

Recurso RunAPI OpenRouter API Direta
Modelos LLM 66 300+ 1 provedor
Outras modalidades Vídeo, Imagem, Música, Áudio Não Por provedor
Preços 15–25% abaixo do oficial Preço de mercado Tarifa oficial
Messages API nativa Sim Não Sim
Créditos unificados Sim Sim Não
Servidor MCP + CLI Sim Não Não

Perguntas sobre a LLM API

Como faço para migrar de um cliente compatível com OpenAI?

Aponte o cliente para a base URL documentada do RunAPI e use sua chave RunAPI. Mantenha o formato de requisição compatível com o endpoint selecionado.

Streaming é suportado?

Streaming está disponível quando o modelo e o endpoint selecionados expõem uma resposta em streaming.

Chamadas de ferramenta funcionam?

O uso de ferramentas está disponível em modelos e formatos de endpoint que declaram suporte a ferramentas em seu contrato de runtime.

Como os tokens são cobrados?

As taxas de entrada e saída estão listadas no catálogo de modelos. O uso é cobrado com base nas contagens de tokens reportadas para a requisição.

Qual endpoint devo usar?

Escolha o formato de endpoint que corresponde ao seu cliente atual e às funcionalidades exigidas pela sua requisição.

E se uma rota estiver indisponível?

A API retorna o status da requisição pelo seu contrato de resposta documentado, para que sua aplicação possa tentar novamente ou escolher outro modelo suportado.

Troque duas linhas, mantenha seu código

67 modelos no formato OpenAI que você já usa. Comece grátis, sem cartão de crédito.