Inicio rápido
Llame a los modelos de lenguaje de RunAPI a través de un protocolo síncrono o de streaming compatible.
RunAPI expone modelos de lenguaje a través de formatos de protocolo públicos conocidos. Apunte un cliente compatible existente a https://runapi.ai, use un identificador de modelo de RunAPI y autentíquese con una Clave de API estándar.
Elegir un protocolo
- Chat Completions compatible con OpenAI usa
POST /v1/chat/completions. - Responses compatible con OpenAI usa
POST /v1/responses. - Messages compatible con Anthropic usa
POST /v1/messages. - La generación de contenido compatible con Gemini usa
/v1beta/models/{model}:generateContento:streamGenerateContent.
Elija el protocolo que mejor se adapte a su cliente y flujo de aplicación existentes. El catálogo de modelos identifica qué protocolos públicos admite cada modelo.
Enviar una solicitud
Esta solicitud de Chat Completions devuelve una respuesta síncrona:
curl "https://runapi.ai/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
}'
Mantenga la solicitud y la respuesta en la forma de protocolo seleccionada. Use la Referencia de la API de la operación para conocer los campos exactos, la llamada a herramientas, la salida estructurada y las restricciones específicas del modelo.
Salida en streaming
Active la opción de streaming del protocolo y consuma de forma incremental los eventos enviados por el servidor devueltos. Para Chat Completions, añada "stream": true; para las llamadas compatibles con Gemini, use la operación :streamGenerateContent. Cierre el stream cuando su cliente reciba el evento terminal del protocolo.
Inspeccionar la fidelidad de entrega
Cada respuesta LLM aceptada incluye X-RunAPI-Fidelity. Un valor de
full significa que la solicitud se entregó sin omisión alguna. Un valor de
lossy significa que RunAPI omitió controles opcionales para completar la solicitud;
X-RunAPI-Omitted-Fields contiene sus nombres de campo separados por comas.
Las solicitudes cuya semántica de ciclo de vida requerido, continuación, herramienta o elemento tipado
no puede preservarse se rechazan antes de que se cree una tarea.
Ambos encabezados están expuestos a través de CORS, por lo que los clientes del navegador pueden inspeccionarlos. Regístrelos junto con el identificador de solicitud cuando el comportamiento exacto de entrega sea relevante para la aplicación.
Manejar errores y uso
Trata 401 como un fallo de autenticación, las respuestas 4xx como problemas de solicitud o de política, y reintenta solo los fallos transitorios de servidor o red. Lee el uso de tokens de la respuesta final o del evento de stream terminal en la forma del protocolo seleccionado, y conserva los identificadores de solicitud en los registros de la aplicación para soporte.