Uma API key
Use as mesmas credenciais entre modelos e provedores.
It looks like you may prefer a different language. Switch anytime.
Use a API do Gemini via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [
{
"role": "user",
"content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.7-flash",
messages: [{ role: "user", content: "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois." }]
});
Gemini é a família de modelos de linguagem multimodal de grande porte do Google suportando texto, imagem, áudio e compreensão de código. Disponível em variants Flash e Pro, lida com tarefas desde sumarizações rápidas até raciocínio profundo e programação complexa.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Cobrança | Preços | |
|---|---|---|---|
| gemini-2.5-flash | 1K tokens | Input $0.30 / 1M tokens | Output $2.50 / 1M tokens | Ver → |
| gemini-2.5-pro | 1K tokens | Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens | Ver → |
| gemini-3-flash-preview | 1K tokens | Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens | Ver → |
| gemini-3.1-pro-preview | 1K tokens | Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens | Ver → |
| gemini-3.5-flash | 1K tokens | Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens | Ver → |
| gemini-3.6-flash | 1K tokens | Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens | Ver → |
| gemini-3.7-flash | 1K tokens | Input $0.45 / 1M tokens | Output $2.25 / 1M tokens | Ver → |
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.30 / 1M tokens | Output $2.50 / 1M tokens |
Preços exibidos para gemini-2.5-flash. Outras variantes mantêm seus próprios preços por endpoint.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
Gemini é o LLM multimodal flagship do Google, disponível em variants Flash (rápido) e Pro (raciocínio frontier). Pelo RunAPI, todos os modelos Gemini compartilham o mesmo formato de API e cobrança.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
Até 1 milhão de tokens em todos os variants. Isso suporta bases de código inteiras, documentos longos e conversas de múltiplos turnos sem truncamento.
Texto, imagens, áudio e vídeo. Você pode passar entradas multimodais em uma única requisição para raciocínio cross-modal.
Gemini pode fundamentar respostas em resultados do Google Search em tempo real, reduzindo alucinações para consultas factuais e sensíveis ao tempo.
Flash é otimizado para velocidade e custo — ideal para tarefas de alto volume. Pro entrega raciocínio mais profundo e é melhor para análises complexas de múltiplas etapas.
Sim — Gemini suporta function calling estruturado com schemas JSON tipados, tornando-o adequado para workflows agênticos e uso de ferramentas.
Instale o model skill e siga as notas de setup com sua chave RunAPI.