Publiczne wersje i endpointy
| ID modelu | Endpointy | Cena początkowa | Katalog |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1M tokenów | Szczegóły modelu |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1M tokenów | Szczegóły modelu |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1M tokenów | Szczegóły modelu |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1M tokenów | Szczegóły modelu |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1M tokenów | Szczegóły modelu |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1M tokenów | Szczegóły modelu |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1M tokenów | Szczegóły modelu |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1M tokenów | Szczegóły modelu |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1M tokenów | Szczegóły modelu |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1M tokenów | Szczegóły modelu |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1M tokenów | Szczegóły modelu |
Weryfikacja
Odpytywanie do momentu osiągnięcia przez Task stanu końcowego
Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.
Konfiguracja
Endpoint przewodnika: <endpoint>
Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Zacznij w 3 krokach
-
Wybierz ID modelu
Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.
-
Skonfiguruj RunAPI
Dodaj konfigurację dostawcy dla tego agenta.
-
Zweryfikuj wynik
Uruchom pokazane poniżej polecenia stanu i wyboru modelu.
Co możesz zbudować za pomocą Hermes Agent + Gemini
-
Agenci multimodalni
Wykorzystaj multimodalne wejście Gemini, aby budować przepływy Hermes Agent, które jednocześnie rozumują na podstawie tekstu, obrazów, audio i wideo.
-
Analiza długich dokumentów
Przekaż Gemini duże bazy kodu, umowy lub kolekcje badań w jednym żądaniu i pozwól Hermes Agent zadawać pytania uzupełniające do tego samego materiału.
-
Ekonomiczne łańcuchy wywołań narzędzi
Uruchamiaj wersję Flash Gemini w szybkich i tanich pętlach narzędzi, w których agent wykonuje wiele wywołań po kolei.
Dlaczego warto używać Gemini przez RunAPI + Hermes Agent
-
11 wariantów, jeden klucz API
Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.
-
Przejrzyste ceny użycia
Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.
-
Bezpośrednie odpowiedzi
Wywołania synchroniczne zwracają wynik w tej samej odpowiedzi, więc agent może od razu go użyć bez odpytywania o stan zadania.
Pytania o Hermes Agent + Gemini
Czy mogę używać Gemini w Hermes Agent bez danych logowania Google Cloud?
Tak. RunAPI udostępnia Gemini przez swój endpoint zgodny z OpenAI. Skonfiguruj RunAPI jako dostawcę w Hermes Agent ze swoim kluczem API RunAPI; projekt Google Cloud ani konfiguracja Vertex AI nie są potrzebne.
Jak cache'owanie kontekstu pomaga przy długich dokumentach?
Gdy ten sam duży kontekst jest wysyłany w wielu żądaniach, cache obniża koszt wejścia kolejnych wywołań. Pomaga to w pętlach agenta, w których powtarzają się instrukcje i materiały referencyjne.
Czy Hermes Agent może w trakcie sesji przełączać się między Gemini a innymi modelami?
Tak. Wszystkie modele językowe RunAPI korzystają z tego samego dostawcy i klucza API, więc możesz zmienić model w trakcie sesji bez zmiany konfiguracji dostawcy.
Którego ID modelu użyć?
Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.
Czy ten przewodnik konfiguruje model czatu?
Tak. Ta linia modeli obsługuje protokół LLM przeznaczony dla klienta.