Pokrycie endpointów
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Gemini 3.1 Flash-Lite; kontekst 1M, regulowany thinking; zapytania tekstowe przez Chat Completions zgodne z OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po." }]
});
11 dostępnych wariantów
Gemini 3.1 Flash-Lite to model o niskich opóźnieniach i niskim koszcie z serii Gemini 3 od Google. Google projektuje go do prostych zadań w dużej skali, takich jak tłumaczenie, klasyfikacja i ekstrakcja encji, wstępna selekcja dokumentów oraz kierowanie żądań między modelami. Stabilny gemini-3.1-flash-lite stał się ogólnie dostępny 7 maja 2026 roku. Okno kontekstu wynosi 1 048 576 tokenów, a output sięga 65 536 tokenów.
Thinking jest regulowany: Google oferuje cztery poziomy thinking, od minimal do high, i wlicza tokeny thinking do outputu. Google obsługuje w tym modelu function calling i structured outputs.
Model Google przyjmuje na wejściu tekst, obrazy, wideo, audio i pliki PDF. W RunAPI gemini-3.1-flash-lite przyjmuje na wejściu tylko tekst. Wysyłaj żądania przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions), OpenAI Responses, Anthropic Messages lub Gemini generateContent. Google wskazuje jako następcę Gemini 3.5 Flash-Lite, który RunAPI udostępnia jako gemini-3.5-flash-lite.
Wybierz dowolny model i generuj w kilka sekund.
| Dostawca | |
| ID modelu | gemini-3.1-flash-lite |
| Modalność | Tekst |
| Typy zadań | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| Jednostka rozliczeniowa | 1 tys. tokenów |
| Status katalogu | Operacyjny |
Zarejestruj się bezpłatnie i utwórz klucz API dla gemini-3.1-flash-lite w panelu.
Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu gemini-3.1-flash-lite i parametrami.
Odczytaj bezpośrednio z endpointu ukończoną odpowiedź gemini-3.1-flash-lite.
Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.
Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.
Dla tego endpointu nie opublikowano parametrów żądania.
Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.
Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.
Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.
Zweryfikowane opinie klientów nie są jeszcze dostępne dla tego modelu.
Google wskazuje Gemini 3.5 Flash-Lite jako następcę 3.1 Flash-Lite. Nowe projekty zacznij od gemini-3.5-flash-lite, a gemini-3.1-flash-lite wybierz, gdy istniejące obciążenie, zestaw promptów lub ewaluacja zostały na nim zbudowane. Oba modele są dostępne w RunAPI pod tym samym kluczem API.
Google podaje 7 maja 2027 jako najwcześniejszą datę wyłączenia gemini-3.1-flash-lite. Model w wersji preview wyłączono w maju 2026 roku, więc używaj stabilnego ID modelu.
Tak. Skieruj SDK OpenAI na https://runapi.ai/v1 z kluczem API RunAPI i wysyłaj żądania Chat Completions z model ustawionym na gemini-3.1-flash-lite. Narzędzia używają standardowego formatu tools OpenAI.
Jeszcze nie. Model Google czyta obrazy, wideo, audio i pliki PDF, ale RunAPI przyjmuje dla gemini-3.1-flash-lite tylko tekst, a żądania z elementami multimedialnymi są odrzucane.
Przekaż identyfikator modelu wyświetlony w quickstarcie.
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.
Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.
Skontaktuj się