Kimi API
Acceso a la API de Moonshot AI Kimi a través de RunAPI — kimi-k3 es el modelo insignia actual con razonamiento siempre activo; kimi-k2.5 y kimi-k2.6 siguen disponibles.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen." }]
});
Kimi incluye kimi-k3, el modelo insignia actual con razonamiento siempre activo, junto con kimi-k2.5 y kimi-k2.6. Los modelos K2 anteriores usan una arquitectura Mixture-of-Experts de 1T parámetros; kimi-k2.5 añadió entrada multimodal nativa y kimi-k2.6 alcanzó 58,6% en SWE-bench Pro. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.
- Variantes para distintos objetivos de calidad y latencia
- API key unificada
- El model skill incluye documentación, schemas y notas de setup
- Las generaciones fallidas no se cobran
Variantes
| Variant | Billing | Pricing | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | Ver → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | Ver → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | Ver → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | Ver → |
Endpoints API de Kimi
Usa el SDK de OpenAI o Anthropic con tu clave RunAPI. No se necesita SDK adicional.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
Cómo construir con este model skill
Elige el modelo
Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.
Autentica una vez
Usa tu clave RunAPI para todos los modelos compatibles.
Instala el skill
Añade el model skill a tu workspace de código antes de implementar la función.
Recibe la salida
Consulta por task ID o procesa el callback cuando termine la generación.
Dónde encaja Kimi
kimi-k3 es el modelo insignia actual de Kimi con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles; su arquitectura K2 anterior tiene 1T parámetros y contexto 256K, y el 58,6% en SWE-bench Pro corresponde a kimi-k2.6. Kimi está disponible mediante OpenAI Chat Completions, OpenAI Responses, Anthropic Messages y Gemini native APIs. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.
Por qué usar Kimi mediante RunAPI
Una API key
Usa las mismas credenciales entre modelos y proveedores.
Listo para skills
El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.
Facturación predecible
El precio por uso es visible antes de llamar.
Preguntas frecuentes
¿Con qué modelo Kimi debería empezar?
Empieza con kimi-k3, el modelo insignia actual con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles para los casos de uso K2 existentes.
¿Cuál es la diferencia entre kimi-k2.5 y kimi-k2.6?
La misma arquitectura MoE de 1T. kimi-k2.5 añadió entrada multimodal nativa (visión + texto). kimi-k2.6 es un refinamiento de post-entrenamiento con mayor estabilidad de largo horizonte — SWE-bench Pro sube de 50,7% a 58,6%, y Agent Swarm escala de 100 a 300 subagentes.
¿Qué APIs pueden llamar a Kimi a través de RunAPI?
Usa OpenAI Chat Completions, OpenAI Responses, Anthropic Messages o Gemini native APIs con un ID de modelo Kimi. La primera versión de kimi-k3 admite texto básico con respuestas síncronas y streaming SSE.
¿Cómo se factura Kimi?
Consulta la página del catálogo de RunAPI de cada modelo Kimi para ver los precios actuales.
¿Cómo llamo a este modelo?
Instala el model skill y sigue sus notas de setup con tu clave RunAPI.
¿Las generaciones fallidas cuestan dinero?
Las generaciones fallidas no se cobran
¿Puedo llamarlo desde mi aplicación?
Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.