Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
It looks like you may prefer a different language. Switch anytime.
Utilisez l'API Gemini via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [
{
"role": "user",
"content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.7-flash",
messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
Gemini est la famille de grands modèles de langage multimodaux de Google supportant la compréhension de texte, d'images, d'audio et de code. Disponible en variantes Flash et Pro, il gère des tâches allant de la synthèse rapide au raisonnement profond et au code complexe.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Facturation | Tarifs | |
|---|---|---|---|
| gemini-2.5-flash | 1K tokens | Input $0.30 / 1M tokens | Output $2.50 / 1M tokens | Voir → |
| gemini-2.5-pro | 1K tokens | Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens | Voir → |
| gemini-3-flash-preview | 1K tokens | Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens | Voir → |
| gemini-3.1-pro-preview | 1K tokens | Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens | Voir → |
| gemini-3.5-flash | 1K tokens | Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens | Voir → |
| gemini-3.6-flash | 1K tokens | Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens | Voir → |
| gemini-3.7-flash | 1K tokens | Input $0.45 / 1M tokens | Output $2.25 / 1M tokens | Voir → |
| Endpoint | Résolution | Durée | Prix | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.30 / 1M tokens | Output $2.50 / 1M tokens |
Prix affichés pour gemini-2.5-flash. Les autres variantes conservent leurs propres tarifs par endpoint.
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Interrogez par task ID ou traitez le callback quand la génération se termine.
Gemini est le LLM multimodal flagship de Google, disponible en variantes Flash (rapide) et Pro (raisonnement frontier). Via RunAPI, tous les modèles Gemini partagent la même forme d'API et la même facturation.
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Les tarifs à l'usage sont visibles avant l'appel.
Jusqu'à 1 million de tokens pour toutes les variantes. Cela gère des bases de code entières, de longs documents et des conversations multi-tours sans troncature.
Texte, images, audio et vidéo. Vous pouvez passer des entrées multimodales dans une seule requête pour un raisonnement cross-modal.
Gemini peut ancrer ses réponses dans des résultats Google Search en temps réel, réduisant les hallucinations pour les requêtes factuelles et temporelles.
Flash est optimisé pour la vitesse et le coût — idéal pour les tâches à haut volume. Pro offre un raisonnement plus profond et est meilleur pour l'analyse multi-étapes complexe.
Oui — Gemini supporte les appels de fonctions structurés avec des schémas JSON typés, le rendant adapté aux workflows agentiques et à l'utilisation d'outils.
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.