Google

Gemini 2.5 Flash-Lite

Tekst

Gemini 2.5 Flash-Lite; kontekst 1M, thinking domyślnie wyłączony; Chat Completions zgodne z OpenAI

Wejście $0.10 / 1M tokenów | Wyjście $0.40 / 1M tokenów Gemini 2.5 Flash-Lite Dokumentacja API →
Kondycja modelu Niewystarczające dane
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "Przeanalizuj ten kod i zaproponuj trzy usprawnienia wydajności wraz z przykładami przed i po." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Do czego służy Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite to poziom Flash-Lite w generacji Gemini 2.5 od Google, przeznaczony do klasyfikacji, ekstrakcji i innych zadań o niskich opóźnieniach w dużej skali. Stał się ogólnie dostępny 22 lipca 2025 roku, a jego granica wiedzy to styczeń 2025. Okno kontekstu wynosi 1 048 576 tokenów, a output sięga 65 536 tokenów.

Thinking jest domyślnie wyłączony, a Google dokumentuje opcjonalny tryb thinking do trudniejszych promptów. Google obsługuje w tym modelu function calling i structured outputs.

Model Google przyjmuje na wejściu tekst, obrazy, wideo, audio i pliki PDF. W RunAPI wysyłaj tekst przez zgodny z OpenAI endpoint Chat Completions (/v1/chat/completions); dla tego modelu RunAPI przyjmuje na wejściu tylko tekst. Do nowych projektów Google poleca Gemini 3.5 Flash-Lite, który RunAPI udostępnia jako gemini-3.5-flash-lite.

ID modelu
gemini-2.5-flash-lite
Data premiery
22 lipca 2025 (ogólna dostępność)
Granica wiedzy
Styczeń 2025
Okno kontekstu
1 048 576 tokenów
Maksymalny output
65 536 tokenów
Thinking
Opcjonalny, domyślnie wyłączony
Endpoint w RunAPI
OpenAI Chat Completions, tekst na wejściu
Playground

Wypróbuj Gemini 2.5 Flash-Lite

Wybierz dowolny model i generuj w kilka sekund.

Szacunkowo: Wejście $0.10 / 1M tokenów | Wyjście $0.40 / 1M tokenów

Zaloguj się, aby generować przez RunAPI.

Zaloguj się, aby generować

Zaloguj się, aby rozpocząć generowanie z dostępnymi modelami językowymi.

Specyfikacja

Szczegóły techniczne

Dostawca Google
ID modelu gemini-2.5-flash-lite
Modalność Tekst
Typy zadań Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
Jednostka rozliczeniowa 1 tys. tokenów
Status katalogu Operacyjny
JAK TO DZIAŁA

Użyj tego modelu w 3 krokach

  1. Uzyskaj klucz

    Zarejestruj się bezpłatnie i utwórz klucz API dla gemini-2.5-flash-lite w panelu.

  2. Wyślij żądanie

    Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu gemini-2.5-flash-lite i parametrami.

  3. Pobierz wyniki

    Odczytaj bezpośrednio z endpointu ukończoną odpowiedź gemini-2.5-flash-lite.

Co oferuje ten model

Pokrycie endpointów

Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.

Rozliczenia według użycia

Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.

Gemini 2.5 Flash-Lite Cennik

Endpoint
Cena
chat_completion
Wejście: $0.10 / 1M tokenów Wyjście: $0.40 / 1M tokenów
  • Odczyt z cache: $0.01 / 1M tokenów
ODNIESIENIE API

Specyfikacja endpointu

Endpoint
POST /v1/chat/completions
ID modelu
gemini-2.5-flash-lite
Typy zadań
chat_completion

Parametry żądania

Dla tego endpointu nie opublikowano parametrów żądania.

PRZYPADKI UŻYCIA

Obsługa klienta

Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.

Analiza dokumentów

Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.

Generowanie kodu

Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.

Metryki użycia

Zaufany przez deweloperów
6
Wywołania API / dzień
100.0%
Wskaźnik sukcesu
1.8s
Śr. czas generowania

Zweryfikowane opinie klientów nie są jeszcze dostępne dla tego modelu.

FAQ

Najczęściej zadawane pytania o Gemini 2.5 Flash-Lite

Wybrać Gemini 2.5 Flash-Lite czy Gemini 3.5 Flash-Lite?

Do nowej pracy Google poleca Gemini 3.5 Flash-Lite lub Gemini 3.8 Flash. Wybierz gemini-2.5-flash-lite, gdy istniejące obciążenie, zestaw promptów lub ewaluacja zostały zbudowane na tym modelu. Oba modele są dostępne w RunAPI pod tym samym kluczem API.

Czy nadal mogę korzystać z Gemini 2.5 Flash-Lite?

Tak. Google nie ogłosiło daty jego wyłączenia, choć własne API Google ogranicza teraz dostęp do modeli 2.5 do użytkowników, którzy korzystali z nich wcześniej. W RunAPI gemini-2.5-flash-lite jest dostępny dla każdego konta.

Czy mogę wywołać Gemini 2.5 Flash-Lite przez SDK OpenAI?

Tak. Skieruj SDK OpenAI na https://runapi.ai/v1 z kluczem API RunAPI i wysyłaj żądania Chat Completions z model ustawionym na gemini-2.5-flash-lite. Narzędzia używają standardowego formatu tools OpenAI.

Czy Gemini 2.5 Flash-Lite rozumuje przed odpowiedzią?

Domyślnie nie. Google udostępnia go z wyłączonym thinking, z myślą o zadaniach o niskich opóźnieniach w dużej skali, i dokumentuje opcjonalny tryb thinking.

Jak wybrać gemini-2.5-flash-lite?

Przekaż identyfikator modelu wyświetlony w quickstarcie.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się