It looks like you may prefer a different language. Switch anytime.

Text Moonshot AI

Kimi API

Accede a la API de Kimi a través de RunAPI con una habilidad de modelo, autenticación unificada y precios de pago por uso.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planifica e implementa una pequeña herramienta CLI: crea la estructura del proyecto, escribe los comandos, añade pruebas y ejecútalas hasta que pasen." }]
});
https://runapi.ai 5 endpoints
RESUMEN

Acerca de Kimi

Kimi incluye kimi-k3, el modelo insignia actual con razonamiento siempre activo, junto con kimi-k2.5 y kimi-k2.6. Los modelos K2 anteriores usan una arquitectura Mixture-of-Experts de 1T parámetros; kimi-k2.5 añadió entrada multimodal nativa y kimi-k2.6 alcanzó 58,6% en SWE-bench Pro. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.

Proveedor
Moonshot AI
Modalidad
Text

Endpoints API de Kimi

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Variantes

Variante Facturación Precios
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Ver →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Ver →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Ver →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Ver →
PRECIOS

Precios de Kimi

Endpoint Resolución Duración Precio
chat_completion Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

Precios mostrados para kimi-k2.5. Otras variantes mantienen sus propios precios por endpoint.

Integración de agentes

Ejecuta Kimi desde un agente

CÓMO FUNCIONA

Empieza con Kimi

  1. Elige el modelo

    Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

  2. Autentica una vez

    Usa tu clave RunAPI para todos los modelos compatibles.

  3. Instala el skill

    Añade el model skill a tu workspace de código antes de implementar la función.

  4. Recibe la salida

    Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja Kimi

kimi-k3 es el modelo insignia actual de Kimi con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles; su arquitectura K2 anterior tiene 1T parámetros y contexto 256K, y el 58,6% en SWE-bench Pro corresponde a kimi-k2.6. Kimi está disponible mediante OpenAI Chat Completions, OpenAI Responses, Anthropic Messages y Gemini native APIs. La primera versión de kimi-k3 en RunAPI admite solicitudes básicas de texto con respuestas síncronas y streaming SSE.

Proveedor
Moonshot AI
Ver todo →
Modalidad
Text
Explorar modelos →

Por qué usar Kimi mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

Preguntas sobre Kimi

¿Con qué modelo Kimi debería empezar?

Empieza con kimi-k3, el modelo insignia actual con razonamiento siempre activo. kimi-k2.5 y kimi-k2.6 siguen disponibles para los casos de uso K2 existentes.

¿Cuál es la diferencia entre kimi-k2.5 y kimi-k2.6?

La misma arquitectura MoE de 1T. kimi-k2.5 añadió entrada multimodal nativa (visión + texto). kimi-k2.6 es un refinamiento de post-entrenamiento con mayor estabilidad de largo horizonte — SWE-bench Pro sube de 50,7% a 58,6%, y Agent Swarm escala de 100 a 300 subagentes.

¿Qué APIs pueden llamar a Kimi a través de RunAPI?

Usa OpenAI Chat Completions, OpenAI Responses, Anthropic Messages o Gemini native APIs con un ID de modelo Kimi. La primera versión de kimi-k3 admite texto básico con respuestas síncronas y streaming SSE.

¿Cómo se factura Kimi?

Consulta la página del catálogo de RunAPI de cada modelo Kimi para ver los precios actuales.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

¿Las generaciones fallidas cuestan dinero?

Las generaciones fallidas no se cobran

MODELOS SIMILARES

Modelos similares a Kimi

Empieza a construir con Kimi.