Text · Google

Gemini API

Accès API Gemini pour le LLM multimodal de Google couvrant le chat, la génération de code, le raisonnement et les tâches à contexte long.

Opérationnel · 7 variants · à partir de $0.0003
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.7-flash",
  messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
https://runapi.ai 5 endpoints
APERÇU

Gemini est la famille de grands modèles de langage multimodaux de Google supportant la compréhension de texte, d'images, d'audio et de code. Disponible en variantes Flash et Pro, il gère des tâches allant de la synthèse rapide au raisonnement profond et au code complexe.

  • Variantes de modèle pour différents objectifs de qualité et de latence
  • API key unifiée
  • Le model skill inclut docs, schémas et notes de setup
  • Les générations échouées ne sont pas facturées
VARIANTES

Variantes

Variant Billing Pricing
gemini-2.5-flash 1K tokens Input $0.30 / 1M tokens | Output $2.50 / 1M tokens Voir →
gemini-2.5-pro 1K tokens Input $1.25-$2.50 / 1M tokens | Output $10.00-$15.00 / 1M tokens Voir →
gemini-3-flash-preview 1K tokens Input $0.50 / 1M tokens | Output $3.00 / 1M tokens · Input $0.30 / 1M tokens | Output $1.80 / 1M tokens Voir →
gemini-3.1-pro-preview 1K tokens Input $1.00-$2.00 / 1M tokens | Output $7.00-$10.50 / 1M tokens Voir →
gemini-3.5-flash 1K tokens Input $1.50 / 1M tokens | Output $9.00 / 1M tokens · Input $0.90 / 1M tokens | Output $5.40 / 1M tokens Voir →
gemini-3.6-flash 1K tokens Input $1.50 / 1M tokens | Output $7.50 / 1M tokens · Input $0.90 / 1M tokens | Output $4.50 / 1M tokens Voir →
gemini-3.7-flash 1K tokens Input $0.45 / 1M tokens | Output $2.25 / 1M tokens Voir →
API

Points d'accès API Gemini

Utilisez le SDK OpenAI ou Anthropic avec votre clé RunAPI. Aucun SDK supplémentaire requis.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
FONCTIONNEMENT

Construire avec ce model skill

01

Choisir le modèle

Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

02

S'authentifier une fois

Utilisez votre clé RunAPI pour tous les modèles pris en charge.

03

Installer le skill

Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

04

Recevoir la sortie

Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser Gemini

Gemini est le LLM multimodal flagship de Google, disponible en variantes Flash (rapide) et Pro (raisonnement frontier). Via RunAPI, tous les modèles Gemini partagent la même forme d'API et la même facturation.

Provider
Google
Modality
Text
POURQUOI RUNAPI

Pourquoi utiliser Gemini via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

FAQ

Questions fréquentes

Quelle est la taille de la fenêtre de contexte pour Gemini ?

Jusqu'à 1 million de tokens pour toutes les variantes. Cela gère des bases de code entières, de longs documents et des conversations multi-tours sans troncature.

Quelles modalités d'entrée Gemini accepte-t-il ?

Texte, images, audio et vidéo. Vous pouvez passer des entrées multimodales dans une seule requête pour un raisonnement cross-modal.

Qu'est-ce que le grounding Google Search ?

Gemini peut ancrer ses réponses dans des résultats Google Search en temps réel, réduisant les hallucinations pour les requêtes factuelles et temporelles.

Comment se comparent Flash et Pro ?

Flash est optimisé pour la vitesse et le coût — idéal pour les tâches à haut volume. Pro offre un raisonnement plus profond et est meilleur pour l'analyse multi-étapes complexe.

Gemini supporte-t-il les appels de fonctions ?

Oui — Gemini supporte les appels de fonctions structurés avec des schémas JSON typés, le rendant adapté aux workflows agentiques et à l'utilisation d'outils.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

Les générations échouées coûtent-elles quelque chose ?

Les générations échouées ne sont pas facturées

Puis-je l'appeler depuis mon application ?

Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.

COMMENCER

Commencez à construire avec Gemini.