Text · Google

Gemini API

Acceso a la API de Gemini para el LLM multimodal de Google en chat, generación de código, razonamiento y tareas de contexto largo.

Operativo · 7 variants · desde $0.0003
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.7-flash",
  messages: [{ role: "user", content: "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después." }]
});
https://runapi.ai 5 endpoints
RESUMEN

Gemini es la familia de modelos de lenguaje multimodal de gran escala de Google que soporta comprensión de texto, imagen, audio y código. Disponible en variantes Flash y Pro, maneja desde resúmenes rápidos hasta razonamiento profundo y programación compleja.

  • Variantes para distintos objetivos de calidad y latencia
  • API key unificada
  • El model skill incluye documentación, schemas y notas de setup
  • Las generaciones fallidas no se cobran
VARIANTES

Variantes

Variant Billing Pricing
gemini-2.5-flash 1K tokens Input $0.30 / 1M tokens | Output $2.50 / 1M tokens Ver →
gemini-2.5-pro 1K tokens Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens Ver →
gemini-3-flash-preview 1K tokens Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens Ver →
gemini-3.1-pro-preview 1K tokens Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens Ver →
gemini-3.5-flash 1K tokens Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens Ver →
gemini-3.6-flash 1K tokens Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens Ver →
gemini-3.7-flash 1K tokens Input $0.45 / 1M tokens | Output $2.25 / 1M tokens Ver →
API

Endpoints API de Gemini

Usa el SDK de OpenAI o Anthropic con tu clave RunAPI. No se necesita SDK adicional.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
CÓMO FUNCIONA

Cómo construir con este model skill

01

Elige el modelo

Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

02

Autentica una vez

Usa tu clave RunAPI para todos los modelos compatibles.

03

Instala el skill

Añade el model skill a tu workspace de código antes de implementar la función.

04

Recibe la salida

Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja Gemini

Gemini es el LLM multimodal insignia de Google, disponible en variantes Flash (rápido) y Pro (razonamiento frontera). A través de RunAPI, todos los modelos Gemini comparten la misma forma de API y facturación.

Provider
Google
Modality
Text
POR QUÉ RUNAPI

Por qué usar Gemini mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

FAQ

Preguntas frecuentes

¿Cuál es el tamaño de la ventana de contexto de Gemini?

Hasta 1 millón de tokens en todas las variantes. Esto permite procesar bases de código completas, documentos largos y conversaciones de múltiples turnos sin truncamiento.

¿Qué modalidades de entrada acepta Gemini?

Texto, imágenes, audio y vídeo. Puedes pasar entradas multimodales en una sola solicitud para razonamiento cruzado entre modalidades.

¿Qué es el grounding con Google Search?

Gemini puede fundamentar sus respuestas en resultados de búsqueda de Google en tiempo real, reduciendo las alucinaciones en consultas factuales y sensibles al tiempo.

¿Cómo se comparan Flash y Pro?

Flash está optimizado para velocidad y coste — ideal para tareas de alto volumen. Pro ofrece un razonamiento más profundo y es mejor para análisis complejos de múltiples pasos.

¿Gemini soporta llamadas a funciones?

Sí — Gemini soporta llamadas a funciones estructuradas con esquemas JSON tipados, lo que lo hace adecuado para flujos de trabajo agénticos y uso de herramientas.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

¿Las generaciones fallidas cuestan dinero?

Las generaciones fallidas no se cobran

¿Puedo llamarlo desde mi aplicación?

Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.

EMPEZAR

Empieza a construir con Gemini.