gemini-2.5-flash API
Use gemini-2.5-flash da família Gemini via RunAPI. Preços por chamada, sem assinatura, e gerações com falha não são cobradas.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash:generateContent
POST /v1beta/models/gemini-2.5-flash:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash",
"messages": [
{
"role": "user",
"content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-2.5-flash",
messages=[{"role": "user", "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-2.5-flash",
messages: [{ role: "user", content: "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois." }]
});
Gemini gemini-2.5-flash está disponível com a mesma autenticação RunAPI, fluxo de model skill e preços por uso.
- API key unificada
- Setup do model skill
- Referência de ID de modelo
- Gerações com falha não são cobradas
PREÇOS
FICHA TÉCNICA
| ID do modelo | gemini-2.5-flash |
| Provedor | |
| Modalidade | text |
| Tipo de tarefa | synchronous |
| Cobrança | 1K tokens |
| Endpoint | /v1/chat/completions |
| /v1/responses | |
| /v1/messages | |
| /v1beta/models/gemini-2.5-flash:generateContent | |
| /v1beta/models/gemini-2.5-flash:streamGenerateContent | |
| Comercial | Sim |
| Status do catálogo | Operacional |
Model skill — gemini-2.5-flash
Instale o skill uma vez, depois use o ID do variant desta página durante o desenvolvimento.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/gemini-2.5-flash:generateContent | Gemini generateContent |
| /v1beta/models/gemini-2.5-flash:streamGenerateContent | Gemini streamGenerateContent |
Como usar gemini-2.5-flash
Escolha o modelo
Selecione o modelo e a variante que combinam com o fluxo do seu app.
Envie o ID do modelo
Use este ID de variante no corpo da requisição.
Execute a tarefa
Envie a requisição e armazene o task ID retornado.
Colete a saída
Consulte ou receba o callback quando a tarefa terminar.
Comparativo de gemini-2.5-flash
Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior
Melhor raciocínio na geração 2.5; 1M contexto
Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior
gemini-3-flash-preview
Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior
gemini-3-pro-preview
Onde usar esta variante
Chat
Use LLMs para chat e raciocínio.
Código
Gere e revise trabalho de implementação.
Automação
Conecte modelos a tarefas backend.
Perguntas frequentes sobre gemini-2.5-flash
Como seleciono gemini-2.5-flash?
Envie o ID de modelo mostrado no quickstart.
O preço é por uso?
Sim. O preço é medido por chamada ou unidade.