Google

Gemini 3.1 Flash-Lite

Texte

Gemini 3.1 Flash-Lite ; contexte 1M, thinking réglable ; requêtes texte via Chat Completions compatible OpenAI

Entrée $0.25 / 1M de tokens | Sortie $1.50 / 1M de tokens Gemini 3.1 Flash-Lite Lire la documentation →
Santé du modèle Données insuffisantes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
https://runapi.ai 5 endpoints
APERÇU

À quoi sert Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite est le modèle à faible latence et à faible coût de la série Gemini 3 de Google. Google le conçoit pour les tâches simples à fort volume, comme la traduction, la classification et l'extraction d'entités, le tri de documents et l'aiguillage des requêtes entre modèles. La version stable gemini-3.1-flash-lite est disponible pour tous depuis le 7 mai 2026. La fenêtre de contexte atteint 1 048 576 tokens et la sortie jusqu'à 65 536 tokens.

Le thinking est réglable : Google propose quatre niveaux de thinking, de minimal à élevé, et compte les tokens de thinking dans la sortie. Google prend en charge l'appel de fonctions et les sorties structurées sur ce modèle.

Le modèle de Google accepte en entrée le texte, les images, la vidéo, l'audio et les PDF. Sur RunAPI, gemini-3.1-flash-lite n'accepte que l'entrée texte. Envoyez vos requêtes via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages ou Gemini generateContent. Google désigne Gemini 3.5 Flash-Lite comme remplaçant, que RunAPI propose sous l'ID gemini-3.5-flash-lite.

ID du modèle
gemini-3.1-flash-lite
Date de sortie
7 mai 2026 (disponibilité générale)
Fenêtre de contexte
1 048 576 tokens
Sortie maximale
65 536 tokens
Thinking
Réglable, de minimal à élevé
Arrêt au plus tôt (Google)
7 mai 2027
Point d'accès sur RunAPI
OpenAI Chat Completions, entrée texte
Playground

Essayez Gemini 3.1 Flash-Lite

Choisissez un modèle et générez en quelques secondes.

Estimé : Entrée $0.25 / 1M de tokens | Sortie $1.50 / 1M de tokens

Connectez-vous pour générer avec RunAPI.

Connectez-vous pour générer

Connectez-vous pour commencer à générer avec vos modèles de langage disponibles.

Spécifications

FICHE TECHNIQUE

Fournisseur Google
ID du modèle gemini-3.1-flash-lite
Modalité Texte
Types de tâche Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Unité de facturation 1 000 jetons
État du catalogue Opérationnel
COMMENT ÇA MARCHE

Utilisez ce modèle en 3 étapes

  1. Créez votre clé

    Inscrivez-vous gratuitement et créez une clé API pour gemini-3.1-flash-lite depuis le tableau de bord.

  2. Envoyez une requête

    Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle gemini-3.1-flash-lite et vos paramètres.

  3. Obtenez les résultats

    Lisez directement la réponse gemini-3.1-flash-lite terminée depuis l’endpoint.

Ce que ce modèle propose

Couverture des endpoints

Expose 1 endpoint(s) public(s) : chat_completion.

Facturation à l'usage

Mesuré par 1 000 jetons, sans abonnement requis.

Gemini 3.1 Flash-Lite TARIFS

Endpoint
Prix
chat_completion
Entrée: $0.25 / 1M de tokens Sortie: $1.50 / 1M de tokens
  • Lecture du cache: $0.03 / 1M de tokens
RÉFÉRENCE API

Spécification de l'endpoint

Endpoint
POST /v1/chat/completions
ID du modèle
gemini-3.1-flash-lite
Types de tâche
chat_completion

Paramètres de requête

Aucun paramètre de requête n'est publié pour cet endpoint.

CAS D’USAGE

Chat

Utilisez les LLM pour le chat et le raisonnement.

Code

Générez et révisez le travail d'implémentation.

Automatisation

Connectez les modèles aux tâches backend.

Métriques d'utilisation

Utilisé par des développeurs
6
Appels API / Jour
100.0%
Taux de succès
1.9s
Génération moyenne

Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.

FAQ

Questions fréquentes sur Gemini 3.1 Flash-Lite

Faut-il utiliser Gemini 3.1 Flash-Lite ou Gemini 3.5 Flash-Lite ?

Google désigne Gemini 3.5 Flash-Lite comme remplaçant de 3.1 Flash-Lite. Démarrez les nouveaux projets avec gemini-3.5-flash-lite, et choisissez gemini-3.1-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API.

Jusqu'à quand Gemini 3.1 Flash-Lite sera-t-il disponible ?

Google indique le 7 mai 2027 comme date d'arrêt au plus tôt de gemini-3.1-flash-lite. Le modèle en préversion a été arrêté en mai 2026, utilisez donc l'ID de modèle stable.

Puis-je appeler Gemini 3.1 Flash-Lite avec le SDK OpenAI ?

Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-3.1-flash-lite. Les outils suivent le format standard d'OpenAI.

Puis-je envoyer des images ou de l'audio à gemini-3.1-flash-lite sur RunAPI ?

Pas encore. Le modèle de Google lit les images, la vidéo, l'audio et les PDF, mais RunAPI n'accepte que l'entrée texte pour gemini-3.1-flash-lite, et les requêtes contenant des parties média sont rejetées.

Comment sélectionner gemini-3.1-flash-lite ?

Passez l'ID de modèle affiché dans le quickstart.

Les tarifs sont-ils à l'usage ?

Oui. Les tarifs sont mesurés par appel ou par unité.

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter