Una API key
Usa las mismas credenciales entre modelos y proveedores.
It looks like you may prefer a different language. Switch anytime.
Accede a la API de Kimi a través de RunAPI con una habilidad de modelo, autenticación unificada y precios de pago por uso.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen." }]
});
Kimi incluye kimi-k3, el modelo insignia actual con razonamiento siempre activo, junto con kimi-k2.5 y kimi-k2.6. Los modelos K2 anteriores usan una arquitectura Mixture-of-Experts de 1T parámetros; kimi-k2.5 añadió entrada multimodal nativa y kimi-k2.6 alcanzó 58,6% en SWE-bench Pro. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Facturación | Precios | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | Ver → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | Ver → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | Ver → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | Ver → |
| Endpoint | Resolución | Duración | Precio | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens |
Precios mostrados para kimi-k2.5. Otras variantes mantienen sus propios precios por endpoint.
Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.
Usa tu clave RunAPI para todos los modelos compatibles.
Añade el model skill a tu workspace de código antes de implementar la función.
Consulta por task ID o procesa el callback cuando termine la generación.
kimi-k3 es el modelo insignia actual de Kimi con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles; su arquitectura K2 anterior tiene 1T parámetros y contexto 256K, y el 58,6% en SWE-bench Pro corresponde a kimi-k2.6. Kimi está disponible mediante OpenAI Chat Completions, OpenAI Responses, Anthropic Messages y Gemini native APIs. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.
Usa las mismas credenciales entre modelos y proveedores.
El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.
El precio por uso es visible antes de llamar.
Empieza con kimi-k3, el modelo insignia actual con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles para los casos de uso K2 existentes.
La misma arquitectura MoE de 1T. kimi-k2.5 añadió entrada multimodal nativa (visión + texto). kimi-k2.6 es un refinamiento de post-entrenamiento con mayor estabilidad de largo horizonte — SWE-bench Pro sube de 50,7% a 58,6%, y Agent Swarm escala de 100 a 300 subagentes.
Usa OpenAI Chat Completions, OpenAI Responses, Anthropic Messages o Gemini native APIs con un ID de modelo Kimi. La primera versión de kimi-k3 admite texto básico con respuestas síncronas y streaming SSE.
Consulta la página del catálogo de RunAPI de cada modelo Kimi para ver los precios actuales.
Instala el model skill y sigue sus notas de setup con tu clave RunAPI.
Las generaciones fallidas no se cobran