API LLM

API LLM — zgodne z OpenAI

Uzyskaj dostęp do Claude, GPT, Gemini, DeepSeek i Grok przez jeden endpoint zgodny z OpenAI. /v1/chat/completions, /v1/messages, /v1/responses.

67 modeli podmiana base_url bez zmian w kodzie płatność za token

67
Modele LLM
15-25%
Poniżej cen oficjalnych
2 linie
Aby przeprowadzić migrację

Playground

na żywo
Model
Wiadomość
Refactor this handler to stream partial results and return a typed error on timeout.
Maks. tokenów
integer | null
Temperatura
number | null
Streaming
false
Endpoint
/v1/chat/completions
Szac. koszt
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Przykłady

Porównanie wielu modeli

Prompt Wyjaśnij obliczenia kwantowe w jednym zdaniu

Claude/claude-fable-5

Wywołaj Claude/claude-fable-5 przez /v1/messages.
Używaj tego samego klucza RunAPI i tej samej struktury żądań, porównując wyniki.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Wywołaj Claude/claude-fable-5-1 przez /v1/messages.
Używaj tego samego klucza RunAPI i tej samej struktury żądań, porównując wyniki.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Wywołaj Claude/claude-haiku-4-5-20251001 przez /v1/messages.
Używaj tego samego klucza RunAPI i tej samej struktury żądań, porównując wyniki.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 kształty endpoint, jeden klucz

Chat completion

Kształt OpenAI obsługiwany przez każde SDK. Podmień base_url i zachowaj istniejący kod żądań.

Message

Kształt Messages API dla promptów systemowych, wywołań narzędzi i bloków treści strukturalnej.

Response

Kształt stanowy dla wieloturowych pętli agentów z obsługą konwersacji po stronie serwera.

Embedding

Embeddingi wektorowe do wyszukiwania, rozliczane za token na tym samym kluczu RunAPI.

Modele LLM na jednym kluczu

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Zobacz wszystkie 67 modeli LLM
Szybki start

Wywołaj dowolny model kształtem OpenAI

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Jak to działa

Cztery kroki do pierwszej generacji

  1. Uzyskaj klucz API

    Utwórz jeden klucz dla swojego konta RunAPI.

  2. Użyj formatu OpenAI

    Wysyłaj żądania przez udokumentowany endpoint zgodny z OpenAI.

  3. Inteligentne routowanie

    RunAPI wybiera obsługiwaną trasę dla Twojego żądania.

  4. Strumieniuj odpowiedzi

    Otrzymuj dane strumieniowe, gdy wybrany endpoint obsługuje SSE.

Dlaczego deweloperzy wybierają RunAPI

Jeden klucz, wszystkie modele

Koniec z żonglowaniem kluczami API. Jedna integracja daje dostęp do 230+ modeli od wszystkich dostawców.

Oszczędności 15–25%

Nasze umowy wolumenowe z dostawcami oznaczają niższe ceny niż przy bezpośrednim korzystaniu. Żadnych dodatkowych marż.

Automatyczne przełączanie awaryjne

Jeśli dostawca przestanie działać, przekierowujemy do najlepszej alternatywy. Twoja aplikacja pozostaje dostępna.

Zgodność z OpenAI

Bezpośredni zamiennik SDK OpenAI. Zmień jedną linię kodu, aby uzyskać dostęp do dowolnego modelu.

Rozliczenia w czasie rzeczywistym

Płać tylko za to, czego używasz. Cennik za żądanie bez minimów. Śledź koszty według modelu i projektu.

Prywatność danych

Nasza polityka prywatności wyjaśnia, jak przetwarzamy i przechowujemy dane żądań oraz wygenerowane treści.

Do czego zespoły tego używają

Agenty kodujące

Kieruj planowanie do Opus, a edycje do tańszego modelu – na jednym kluczu i jednej fakturze.

Potoki RAG

Embeddingi i generowanie na tym samym endpoint, dzięki czemu wyszukiwanie i odpowiadanie współdzielą budżet.

Generowanie treści

Rozdziel szkice między modele i zachowaj najlepszy – bez podpisywania pięciu umów z dostawcami.

Porównanie wielu modeli

Testuj A/B ten sam prompt na Claude, GPT i Gemini, zmieniając jeden ciąg znaków.

RunAPI a alternatywy

Funkcja RunAPI OpenRouter Bezpośrednie API
Modele LLM 66 300+ 1 dostawca
Inne modalności Wideo, obraz, muzyka, audio Nie Według dostawcy
Cennik 15–25% poniżej cen oficjalnych Cena rynkowa Oficjalna stawka
Natywne Messages API Tak Nie Tak
Ujednolicone kredyty Tak Tak Nie
Serwer MCP + CLI Tak Nie Nie

Pytania dotyczące LLM API

Jak przeprowadzić migrację z klienta zgodnego z OpenAI?

Skieruj klienta na udokumentowany base URL RunAPI i użyj swojego klucza RunAPI. Zachowaj kształt żądania obsługiwany przez wybrany endpoint.

Czy streaming jest obsługiwany?

Streaming jest dostępny, gdy wybrany model i endpoint udostępniają odpowiedź strumieniową.

Czy wywołania narzędzi działają?

Wywoływanie narzędzi jest dostępne na modelach i kształtach endpoint, które deklarują obsługę narzędzi w swoim kontrakcie środowiska uruchomieniowego.

Jak są rozliczane tokeny?

Stawki za wejście i wyjście są podane w katalogu modeli. Użycie jest rozliczane na podstawie liczby tokenów zgłoszonych dla żądania.

Którego endpoint powinienem używać?

Wybierz kształt endpoint pasujący do istniejącego klienta i możliwości wymaganych przez Twoje żądanie.

Co zrobić, gdy trasa jest niedostępna?

API zwraca status żądania za pośrednictwem udokumentowanego kontraktu odpowiedzi, dzięki czemu aplikacja może ponowić próbę lub wybrać inny obsługiwany model.

Zmień dwie linie, zachowaj kod

67 modeli w formacie OpenAI, którego już używasz. Zacznij za darmo, bez karty kredytowej.