Text · Moonshot AI

Kimi API

Acceso a la API de Moonshot AI Kimi a través de RunAPI — kimi-k3 es el modelo insignia actual con razonamiento siempre activo; kimi-k2.5 y kimi-k2.6 siguen disponibles.

Operativo · 4 variants · desde $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen." }]
});
https://runapi.ai 5 endpoints
RESUMEN

Kimi incluye kimi-k3, el modelo insignia actual con razonamiento siempre activo, junto con kimi-k2.5 y kimi-k2.6. Los modelos K2 anteriores usan una arquitectura Mixture-of-Experts de 1T parámetros; kimi-k2.5 añadió entrada multimodal nativa y kimi-k2.6 alcanzó 58,6% en SWE-bench Pro. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.

  • Variantes para distintos objetivos de calidad y latencia
  • API key unificada
  • El model skill incluye documentación, schemas y notas de setup
  • Las generaciones fallidas no se cobran
VARIANTES

Variantes

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Ver →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Ver →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Ver →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Ver →
API

Endpoints API de Kimi

Usa el SDK de OpenAI o Anthropic con tu clave RunAPI. No se necesita SDK adicional.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
CÓMO FUNCIONA

Cómo construir con este model skill

01

Elige el modelo

Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

02

Autentica una vez

Usa tu clave RunAPI para todos los modelos compatibles.

03

Instala el skill

Añade el model skill a tu workspace de código antes de implementar la función.

04

Recibe la salida

Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja Kimi

kimi-k3 es el modelo insignia actual de Kimi con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles; su arquitectura K2 anterior tiene 1T parámetros y contexto 256K, y el 58,6% en SWE-bench Pro corresponde a kimi-k2.6. Kimi está disponible mediante OpenAI Chat Completions, OpenAI Responses, Anthropic Messages y Gemini native APIs. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.

Provider
Moonshot AI
Modality
Text
POR QUÉ RUNAPI

Por qué usar Kimi mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

FAQ

Preguntas frecuentes

¿Con qué modelo Kimi debería empezar?

Empieza con kimi-k3, el modelo insignia actual con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles para los casos de uso K2 existentes.

¿Cuál es la diferencia entre kimi-k2.5 y kimi-k2.6?

La misma arquitectura MoE de 1T. kimi-k2.5 añadió entrada multimodal nativa (visión + texto). kimi-k2.6 es un refinamiento de post-entrenamiento con mayor estabilidad de largo horizonte — SWE-bench Pro sube de 50,7% a 58,6%, y Agent Swarm escala de 100 a 300 subagentes.

¿Qué APIs pueden llamar a Kimi a través de RunAPI?

Usa OpenAI Chat Completions, OpenAI Responses, Anthropic Messages o Gemini native APIs con un ID de modelo Kimi. La primera versión de kimi-k3 admite texto básico con respuestas síncronas y streaming SSE.

¿Cómo se factura Kimi?

Consulta la página del catálogo de RunAPI de cada modelo Kimi para ver los precios actuales.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

¿Las generaciones fallidas cuestan dinero?

Las generaciones fallidas no se cobran

¿Puedo llamarlo desde mi aplicación?

Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.

EMPEZAR

Empieza a construir con Kimi.