Google

Gemini 3.1 Flash-Lite

Tekst

Gemini 3.1 Flash-Lite; kontekst 1M, regulowany thinking; zapytania tekstowe przez Chat Completions zgodne z OpenAI

Wejście $0.25 / 1M tokenów | Wyjście $1.50 / 1M tokenów Gemini 3.1 Flash-Lite Dokumentacja API →
Kondycja modelu Niewystarczające dane
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Do czego służy Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite to model o niskich opóźnieniach i niskim koszcie z serii Gemini 3 od Google. Google projektuje go do prostych zadań w dużej skali, takich jak tłumaczenie, klasyfikacja i ekstrakcja encji, wstępna selekcja dokumentów oraz kierowanie żądań między modelami. Stabilny gemini-3.1-flash-lite stał się ogólnie dostępny 7 maja 2026 roku. Okno kontekstu wynosi 1 048 576 tokenów, a output sięga 65 536 tokenów.

Thinking jest regulowany: Google oferuje cztery poziomy thinking, od minimal do high, i wlicza tokeny thinking do outputu. Google obsługuje w tym modelu function calling i structured outputs.

Model Google przyjmuje na wejściu tekst, obrazy, wideo, audio i pliki PDF. W RunAPI gemini-3.1-flash-lite przyjmuje na wejściu tylko tekst. Wysyłaj żądania przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions), OpenAI Responses, Anthropic Messages lub Gemini generateContent. Google wskazuje jako następcę Gemini 3.5 Flash-Lite, który RunAPI udostępnia jako gemini-3.5-flash-lite.

ID modelu
gemini-3.1-flash-lite
Data premiery
7 maja 2026 (ogólna dostępność)
Okno kontekstu
1 048 576 tokenów
Maksymalny output
65 536 tokenów
Thinking
Regulowany, od minimal do high
Najwcześniejsze wyłączenie (Google)
7 maja 2027
Endpoint w RunAPI
OpenAI Chat Completions, tekst na wejściu
Playground

Wypróbuj Gemini 3.1 Flash-Lite

Wybierz dowolny model i generuj w kilka sekund.

Szacunkowo: Wejście $0.25 / 1M tokenów | Wyjście $1.50 / 1M tokenów

Zaloguj się, aby generować przez RunAPI.

Zaloguj się, aby generować

Zaloguj się, aby rozpocząć generowanie z dostępnymi modelami językowymi.

Specyfikacja

Szczegóły techniczne

Dostawca Google
ID modelu gemini-3.1-flash-lite
Modalność Tekst
Typy zadań Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Jednostka rozliczeniowa 1 tys. tokenów
Status katalogu Operacyjny
JAK TO DZIAŁA

Użyj tego modelu w 3 krokach

  1. Uzyskaj klucz

    Zarejestruj się bezpłatnie i utwórz klucz API dla gemini-3.1-flash-lite w panelu.

  2. Wyślij żądanie

    Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu gemini-3.1-flash-lite i parametrami.

  3. Pobierz wyniki

    Odczytaj bezpośrednio z endpointu ukończoną odpowiedź gemini-3.1-flash-lite.

Co oferuje ten model

Pokrycie endpointów

Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.

Rozliczenia według użycia

Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.

Gemini 3.1 Flash-Lite Cennik

Endpoint
Cena
chat_completion
Wejście: $0.25 / 1M tokenów Wyjście: $1.50 / 1M tokenów
  • Odczyt z cache: $0.03 / 1M tokenów
ODNIESIENIE API

Specyfikacja endpointu

Endpoint
POST /v1/chat/completions
ID modelu
gemini-3.1-flash-lite
Typy zadań
chat_completion

Parametry żądania

Dla tego endpointu nie opublikowano parametrów żądania.

PRZYPADKI UŻYCIA

Obsługa klienta

Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.

Analiza dokumentów

Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.

Generowanie kodu

Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.

Metryki użycia

Zaufany przez deweloperów
6
Wywołania API / dzień
100.0%
Wskaźnik sukcesu
1.9s
Śr. czas generowania

Zweryfikowane opinie klientów nie są jeszcze dostępne dla tego modelu.

FAQ

Najczęściej zadawane pytania o Gemini 3.1 Flash-Lite

Wybrać Gemini 3.1 Flash-Lite czy Gemini 3.5 Flash-Lite?

Google wskazuje Gemini 3.5 Flash-Lite jako następcę 3.1 Flash-Lite. Nowe projekty zacznij od gemini-3.5-flash-lite, a gemini-3.1-flash-lite wybierz, gdy istniejące obciążenie, zestaw promptów lub ewaluacja zostały na nim zbudowane. Oba modele są dostępne w RunAPI pod tym samym kluczem API.

Jak długo Gemini 3.1 Flash-Lite będzie dostępny?

Google podaje 7 maja 2027 jako najwcześniejszą datę wyłączenia gemini-3.1-flash-lite. Model w wersji preview wyłączono w maju 2026 roku, więc używaj stabilnego ID modelu.

Czy mogę wywołać Gemini 3.1 Flash-Lite przez SDK OpenAI?

Tak. Skieruj SDK OpenAI na https://runapi.ai/v1 z kluczem API RunAPI i wysyłaj żądania Chat Completions z model ustawionym na gemini-3.1-flash-lite. Narzędzia używają standardowego formatu tools OpenAI.

Czy mogę wysyłać obrazy lub audio do gemini-3.1-flash-lite w RunAPI?

Jeszcze nie. Model Google czyta obrazy, wideo, audio i pliki PDF, ale RunAPI przyjmuje dla gemini-3.1-flash-lite tylko tekst, a żądania z elementami multimedialnymi są odrzucane.

Jak wybrać gemini-3.1-flash-lite?

Przekaż identyfikator modelu wyświetlony w quickstarcie.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się