Saltar al contenido
Guías
Guías

Inicio rápido

Llame a los modelos de lenguaje de RunAPI a través de un protocolo síncrono o de streaming compatible.

RunAPI expone modelos de lenguaje a través de formatos de protocolo públicos conocidos. Apunte un cliente compatible existente a https://runapi.ai, use un identificador de modelo de RunAPI y autentíquese con una Clave de API estándar.

Elegir un protocolo

  • Chat Completions compatible con OpenAI usa POST /v1/chat/completions.
  • Responses compatible con OpenAI usa POST /v1/responses.
  • Messages compatible con Anthropic usa POST /v1/messages.
  • La generación de contenido compatible con Gemini usa /v1beta/models/{model}:generateContent o :streamGenerateContent.

Elija el protocolo que mejor se adapte a su cliente y flujo de aplicación existentes. El catálogo de modelos identifica qué protocolos públicos admite cada modelo.

Enviar una solicitud

Esta solicitud de Chat Completions devuelve una respuesta síncrona:

SHELL
curl "https://runapi.ai/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.4",
    "messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
  }'

Mantenga la solicitud y la respuesta en la forma de protocolo seleccionada. Use la Referencia de la API de la operación para conocer los campos exactos, la llamada a herramientas, la salida estructurada y las restricciones específicas del modelo.

Salida en streaming

Active la opción de streaming del protocolo y consuma de forma incremental los eventos enviados por el servidor devueltos. Para Chat Completions, añada "stream": true; para las llamadas compatibles con Gemini, use la operación :streamGenerateContent. Cierre el stream cuando su cliente reciba el evento terminal del protocolo.

Inspeccionar la fidelidad de entrega

Cada respuesta LLM aceptada incluye X-RunAPI-Fidelity. Un valor de full significa que la solicitud se entregó sin omisión alguna. Un valor de lossy significa que RunAPI omitió controles opcionales para completar la solicitud; X-RunAPI-Omitted-Fields contiene sus nombres de campo separados por comas. Las solicitudes cuya semántica de ciclo de vida requerido, continuación, herramienta o elemento tipado no puede preservarse se rechazan antes de que se cree una tarea.

Ambos encabezados están expuestos a través de CORS, por lo que los clientes del navegador pueden inspeccionarlos. Regístrelos junto con el identificador de solicitud cuando el comportamiento exacto de entrega sea relevante para la aplicación.

Manejar errores y uso

Trata 401 como un fallo de autenticación, las respuestas 4xx como problemas de solicitud o de política, y reintenta solo los fallos transitorios de servidor o red. Lee el uso de tokens de la respuesta final o del evento de stream terminal en la forma del protocolo seleccionado, y conserva los identificadores de solicitud en los registros de la aplicación para soporte.