Dzienny limit żądań
Do 500 żądań dziennie w Gemini 2.5 Flash przez darmową warstwę. Wystarczy do prototypowania i małych projektów pobocznych, ale agenci AI i narzędzia do kodowania mogą wyczerpać ten limit w kilka godzin.
Google pobiera $1.25–$10 za milion tokenów dla Gemini 2.5 Pro i znacznie mniej dla Flash. Darmowa warstwa daje około 20 żądań na minutę, zanim osiągniesz limit. RunAPI udostępnia każdy model Gemini za połowę oficjalnej stawki — wklej swój klucz bezpośrednio do dowolnego klienta zgodnego z OpenAI.
Google publikuje ceny za token dla dwóch głównych warstw: Flash do szybkich, tanich zadań oraz Pro dla maksymalnych możliwości. Istnieje też darmowa warstwa z dziennymi limitami żądań — przydatna do testów, ale agenci AI i narzędzia do kodowania mogą szybko ją zużyć. Wszystkie ceny poniżej są podane za milion tokenów, czyli jednostkę rozliczeniową używaną przez Google.
Gemini 2.5 Flash po $0,08/M wejście i $0,30/M wyjście przez RunAPI. Oficjalna stawka to $0,15/$0,60.
Gemini 2.5 Pro po $0,63/M wejście i $5,00/M wyjście przez RunAPI. Oficjalna stawka to $1,25/$10.
Darmowa warstwa Google daje około 20 żądań na minutę i 500 żądań dziennie w Flash — wystarczy do prototypowania, ale z agentem AI można ją wyczerpać w kilka godzin.
Gemini 2.5 Pro bije Claude Sonnet i GPT-5.4 ceną wejścia, co czyni go najtańszym modelem flagowym wielkiej trójki.
Poniższa tabela pokazuje oficjalne ceny Google obok cen RunAPI. RunAPI stosuje płaski rabat 50% na wszystkie modele Gemini. Bez zobowiązań wolumenowych, bez subskrypcji.
| Model | Oficjalne wejście /M | Oficjalne wyjście /M | RunAPI wejście /M | RunAPI wyjście /M | Okno kontekstowe |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |
Google oferuje darmową warstwę, aby można było tworzyć prototypy przed przejściem na płatny plan. Darmowa warstwa ogranicza żądania do około 20 na minutę i 500 dziennie w Gemini 2.5 Flash. Gdy osiągniesz limit, otrzymasz błąd — opłata nie zostanie naliczona automatycznie. Darmowa warstwa jest dostępna tylko w wybranych krajach; jeśli darmowy endpoint nie jest dostępny w Twoim regionie, kolejnym krokiem jest płatne API lub RunAPI.
Do 500 żądań dziennie w Gemini 2.5 Flash przez darmową warstwę. Wystarczy do prototypowania i małych projektów pobocznych, ale agenci AI i narzędzia do kodowania mogą wyczerpać ten limit w kilka godzin.
Darmowa warstwa ogranicza żądania do około 20 na minutę. Każdy nagły wzrost ruchu — na przykład uruchomienie agenta AI — szybko osiągnie ten limit i zacznie zwracać błędy.
Dane wejściowe z bezpłatnego poziomu mogą być używane do ulepszania produktów Google. Ruch płatny i RunAPI nie jest używany do trenowania, co ma znaczenie przy wrażliwych danych.
Przejdź na płatny lub RunAPI, gdy potrzebujesz stałej przepustowości, wyższych limitów szybkości lub lepszego zarządzania danymi. RunAPI pobiera 50% oficjalnej stawki płatnej bez dziennego limitu.
Programiści często porównują Gemini z Claude Sonnet i GPT-5.4. Oto jak modele flagowe wypada w porównaniu na podstawie miliona tokenów przez RunAPI.
| Dostawca | Model flagowy | Wejście /M | Wyjście /M | Stawka RunAPI |
|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 | |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |
RunAPI stosuje 50% rabatu u wszystkich wymienionych powyżej dostawców. Gemini 2.5 Pro jest najtańszym modelem flagowym pod względem ceny wejścia. Ceny zweryfikowane w czerwcu 2026.
Koszty tokenów wydają się abstrakcyjne, dopóki nie przypisze się ich do rzeczywistych zadań. Poniżej przedstawiono pięć typowych obciążeń programistycznych z szacowanymi miesięcznymi kosztami na dwóch poziomach użycia przez RunAPI.
| Obciążenie | Model | Lekkie użycie (~50 zadań/dzień) | Intensywne użycie (~200 zadań/dzień) | Miesięczna oszczędność vs oficjalne |
|---|---|---|---|---|
| Analiza dokumentów z długim kontekstem | Gemini 2.5 Pro | $18/mies. | $72/mies. | $18–$72 |
| Klasyfikacja dużego wolumenu | Gemini 2.5 Flash | $3/mies. | $12/mies. | $3–$12 |
| Chatbot dokumentacji oparty na RAG | Gemini 2.5 Flash | $5/mies. | $20/mies. | $5–$20 |
| Potok generowania treści | Gemini 2.5 Pro | $15/mies. | $60/mies. | $15–$60 |
| Orkiestrator wieloagentowy | Gemini 2.5 Pro | $60/mies. | $240/mies. | $60–$240 |
Zarejestruj się na runapi.ai. Bezpłatny poziom nie wymaga karty kredytowej.
Przejdź do Dashboard → Klucze API. Utwórz klucz i zapisz go — użyjesz go jako klucz OpenAI API.
Ustaw bazowy URL na https://api.runapi.ai/v1 i użyj klucza RunAPI API. Działa każdy klient zgodny z OpenAI — Python, Node.js, Go, Ruby lub curl.
Użyj gemini-2.5-pro, gemini-2.5-flash lub dowolnego identyfikatora modelu Gemini w parametrze model. RunAPI obsługuje routing i rozliczenia po 50% oficjalnej stawki.
Oficjalna cena Google dla Gemini 2.5 Pro to $1,25/M wejście i $10/M wyjście. Gemini 2.5 Flash to $0,15/M wejście i $0,60/M wyjście. Przez RunAPI każdy model Gemini jest rozliczany po połowie tej stawki, bez subskrypcji ani zobowiązania wolumenowego. Płacisz tylko za tokeny faktycznie użyte przez każde żądanie.
Pod względem ceny wejścia tak. Gemini 2.5 Pro po $1,25/M wejście bije GPT-5.4 ($2,50) i Claude Sonnet ($6) przy oficjalnej stawce, co czyni go najtańszym modelem flagowym wielkiej trójki. RunAPI obniża wszystkie trzy o połowę, więc przewaga utrzymuje się.
Darmowy pakiet ogranicza Cię do około 20 żądań na minutę i 500 żądań dziennie na Gemini 2.5 Flash. Gdy osiągniesz limit, żądania zwrócą błąd — nie zostaniesz automatycznie obciążony opłatą. Dane wejściowe w darmowym pakiecie mogą być używane do ulepszania produktów Google, więc unikaj danych wrażliwych. Gdy potrzebujesz stabilnej przepustowości, przejdź na płatny plan.
RunAPI negocjuje ceny wolumenowe z dostawcami modeli i przekazuje oszczędności programistom. Nie ma różnicy w jakości — te same modele, to samo API zgodne z OpenAI, ten sam wynik. Zmieniasz tylko bazowy URL i klucz, a istniejący kod klienta działa bez zmian.
Tak. RunAPI jest zgodne z OpenAI. Skieruj dowolnego klienta OpenAI na api.runapi.ai/v1 i użyj identyfikatorów modeli Gemini, takich jak gemini-2.5-pro. Istniejący kod SDK OpenAI działa bez zmian poza bazowym URL i kluczem.
Gemini 2.5 Pro i Flash oferują okno kontekstowe 1M tokenów, większe niż większość modeli Claude i GPT. W połączeniu z niską ceną wejścia sprawia to, że Gemini jest opłacalne do analizy długich dokumentów, dużych baz kodu lub wielu plików jednocześnie.
RunAPI daje Ci jeden klucz API, który działa z Gemini, Claude i GPT — bez konfiguracji projektu Google Cloud i bez konta rozliczeniowego do zarządzania. Jeśli osiągnąłeś limity darmowej warstwy albo okazało się, że w Twoim regionie nie działa ani jeden darmowy klucz API, płatny dostęp RunAPI jest dostępny globalnie za 50% oficjalnych stawek.
Pay-as-you-go. Zasilasz konto saldem, a każde wywołanie API odejmuje koszt tokenów po połowie oficjalnej stawki. Bez subskrypcji, bez faktur, bez umów. Możesz monitorować wydatki per klucz z dashboardu RunAPI i ustawiać alerty przed wyczerpaniem salda.
Claude Opus, Sonnet i Haiku w cenie 50% stawek oficjalnych Anthropic.
Cennik GPT-5.4, GPT-5.4-mini i o3: RunAPI vs stawki oficjalne.
Koszty Windsurf: własne kredyty vs rozliczenie API.
Przeglądaj ponad 130 modeli z cenami, parametrami i przykładami kodu.
Utwórz darmowe konto RunAPI, pobierz klucz API i zacznij wywoływać Gemini 2.5 Pro lub Flash ze zniżką 50% względem oficjalnych cen Google — najtańszy model flagowy wielkiej trójki.