Couverture des endpoints
Expose 1 endpoint(s) public(s) : chat_completion.
Gemini 3.1 Flash-Lite ; contexte 1M, thinking réglable ; requêtes texte via Chat Completions compatible OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
11 versions disponibles
Gemini 3.1 Flash-Lite est le modèle à faible latence et à faible coût de la série Gemini 3 de Google. Google le conçoit pour les tâches simples à fort volume, comme la traduction, la classification et l'extraction d'entités, le tri de documents et l'aiguillage des requêtes entre modèles. La version stable gemini-3.1-flash-lite est disponible pour tous depuis le 7 mai 2026. La fenêtre de contexte atteint 1 048 576 tokens et la sortie jusqu'à 65 536 tokens.
Le thinking est réglable : Google propose quatre niveaux de thinking, de minimal à élevé, et compte les tokens de thinking dans la sortie. Google prend en charge l'appel de fonctions et les sorties structurées sur ce modèle.
Le modèle de Google accepte en entrée le texte, les images, la vidéo, l'audio et les PDF. Sur RunAPI, gemini-3.1-flash-lite n'accepte que l'entrée texte. Envoyez vos requêtes via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages ou Gemini generateContent. Google désigne Gemini 3.5 Flash-Lite comme remplaçant, que RunAPI propose sous l'ID gemini-3.5-flash-lite.
Choisissez un modèle et générez en quelques secondes.
| Fournisseur | |
| ID du modèle | gemini-3.1-flash-lite |
| Modalité | Texte |
| Types de tâche | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| Unité de facturation | 1 000 jetons |
| État du catalogue | Opérationnel |
Inscrivez-vous gratuitement et créez une clé API pour gemini-3.1-flash-lite depuis le tableau de bord.
Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle gemini-3.1-flash-lite et vos paramètres.
Lisez directement la réponse gemini-3.1-flash-lite terminée depuis l’endpoint.
Expose 1 endpoint(s) public(s) : chat_completion.
Mesuré par 1 000 jetons, sans abonnement requis.
Aucun paramètre de requête n'est publié pour cet endpoint.
Utilisez les LLM pour le chat et le raisonnement.
Générez et révisez le travail d'implémentation.
Connectez les modèles aux tâches backend.
Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.
Google désigne Gemini 3.5 Flash-Lite comme remplaçant de 3.1 Flash-Lite. Démarrez les nouveaux projets avec gemini-3.5-flash-lite, et choisissez gemini-3.1-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API.
Google indique le 7 mai 2027 comme date d'arrêt au plus tôt de gemini-3.1-flash-lite. Le modèle en préversion a été arrêté en mai 2026, utilisez donc l'ID de modèle stable.
Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-3.1-flash-lite. Les outils suivent le format standard d'OpenAI.
Pas encore. Le modèle de Google lit les images, la vidéo, l'audio et les PDF, mais RunAPI n'accepte que l'entrée texte pour gemini-3.1-flash-lite, et les requêtes contenant des parties média sont rejetées.
Passez l'ID de modèle affiché dans le quickstart.
Oui. Les tarifs sont mesurés par appel ou par unité.
Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.
Nous contacter