API de LLM

API LLM — Compatible con OpenAI

Accede a Claude, GPT, Gemini, DeepSeek y Grok a través de un único endpoint compatible con OpenAI. /v1/chat/completions, /v1/messages, /v1/responses.

67 modelos cambio de base_url directo pago por token

67
Modelos LLM
15-25%
Por debajo del precio oficial
2 líneas
Para migrar

Playground

en vivo
Modelo
Mensaje
Refactor this handler to stream partial results and return a typed error on timeout.
Tokens máximos
integer | null
Temperatura
number | null
Streaming
false
Endpoint
/v1/chat/completions
Coste estimado
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Ejemplos

Comparación entre modelos

Prompt Explica la computación cuántica en una oración

Claude/claude-fable-5

Llama a Claude/claude-fable-5 a través de /v1/messages.
Mantén la misma clave RunAPI y la misma estructura de solicitud mientras comparas resultados.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Llama a Claude/claude-fable-5-1 a través de /v1/messages.
Mantén la misma clave RunAPI y la misma estructura de solicitud mientras comparas resultados.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Llama a Claude/claude-haiku-4-5-20251001 a través de /v1/messages.
Mantén la misma clave RunAPI y la misma estructura de solicitud mientras comparas resultados.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 formas de endpoint, una sola clave

Chat completion

La estructura OpenAI que todo SDK ya entiende. Cambia base_url y conserva tu código de solicitud existente.

Message

La estructura de la Messages API para prompts de sistema, uso de herramientas y bloques de contenido estructurado.

Response

La estructura con estado para bucles de agentes multi-turno con manejo de conversación en el servidor.

Embedding

Embeddings vectoriales para recuperación, facturados por token con la misma clave RunAPI.

LLMs con una sola clave

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Ver todos los 67 modelos LLM
Inicio rápido

Llama a cualquier modelo con la estructura OpenAI

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Cómo funciona

Cuatro pasos para tu primera generación

  1. Obtén tu clave de API

    Crea una clave para tu cuenta de RunAPI.

  2. Usa el formato de OpenAI

    Envía solicitudes al endpoint documentado compatible con OpenAI.

  3. Enrutamos de forma inteligente

    RunAPI selecciona una ruta compatible con tu solicitud.

  4. Transmite respuestas

    Recibe la salida en streaming cuando el endpoint seleccionado admite SSE.

Por qué los desarrolladores eligen RunAPI

Una sola clave, todos los modelos

Deja de gestionar múltiples claves de API. Una sola integración te da acceso a 230+ modelos de todos los proveedores.

15-25% de ahorro en costos

Nuestros acuerdos de volumen con los proveedores significan precios más bajos que contratando directamente. Sin márgenes adicionales.

Failover automático

Si un proveedor cae, enrutamos la solicitud a la siguiente mejor opción. Tu aplicación sigue en línea.

Compatible con OpenAI

Reemplazo directo para el SDK de OpenAI. Cambia una línea de código para acceder a cualquier modelo.

Facturación en tiempo real

Paga solo por lo que usas. Precios por solicitud sin mínimos. Rastrea costos por modelo y por proyecto.

Privacidad de los datos

Nuestra política de privacidad explica cómo se procesan y conservan los datos de las solicitudes y el contenido generado.

Qué crean los equipos con él

Agentes de código

Enruta la planificación a Opus y las ediciones a un modelo económico, con una sola clave y una sola factura.

Pipelines RAG

Embeddings y generación en el mismo endpoint, para que la recuperación y las respuestas compartan presupuesto.

Generación de contenido

Distribuye borradores entre modelos y quédate con el mejor, sin firmar cinco contratos con proveedores.

Comparación entre modelos

Haz A/B del mismo prompt entre Claude, GPT y Gemini cambiando solo una cadena de texto.

RunAPI vs alternativas

Característica RunAPI OpenRouter API directa
Modelos LLM 66 300+ 1 proveedor
Otras modalidades Video, imagen, música, audio No Por proveedor
Precios 15-25% por debajo del precio oficial Precio de mercado Tarifa oficial
Messages API nativa No
Créditos unificados No
Servidor MCP + CLI No No

Preguntas sobre la API LLM

¿Cómo migro desde un cliente compatible con OpenAI?

Apunta el cliente a la URL base de RunAPI documentada y usa tu clave RunAPI. Mantén la estructura de solicitud compatible con el endpoint seleccionado.

¿Se admite streaming?

El streaming está disponible cuando el modelo y el endpoint seleccionados exponen una respuesta en streaming.

¿Funcionan las llamadas a herramientas?

Las llamadas a herramientas están disponibles en los modelos y estructuras de endpoint que declaran soporte de herramientas en su contrato de ejecución.

¿Cómo se facturan los tokens?

Las tarifas de entrada y salida están listadas en el catálogo de modelos. El uso se factura según los conteos de tokens reportados para la solicitud.

¿Qué endpoint debo usar?

Elige la estructura de endpoint que coincida con tu cliente existente y las capacidades requeridas por tu solicitud.

¿Qué pasa si una ruta no está disponible?

La API devuelve el estado de la solicitud a través de su contrato de respuesta documentado para que tu aplicación pueda reintentar o elegir otro modelo compatible.

Cambia dos líneas, conserva tu código

67 modelos detrás de la estructura OpenAI que ya usas. Comienza gratis, sin tarjeta de crédito.