LLM API

LLM API — OpenAI-compatibel

Toegang tot Claude, GPT, Gemini, DeepSeek en Grok via één OpenAI-compatibel endpoint. /v1/chat/completions, /v1/messages, /v1/responses.

67 modellen directe base_url-wissel betaal per token

67
LLM-modellen
15-25%
Onder officieel
2 regels
Om te migreren

Playground

live
Model
Bericht
Refactor this handler to stream partial results and return a typed error on timeout.
Max tokens
integer | null
Temperatuur
number | null
Stream
false
Endpoint
/v1/chat/completions
Geschatte kosten
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Voorbeelden

Multi-modelvergelijking

Prompt Leg kwantumcomputing uit in één zin

Claude/claude-fable-5

Roep Claude/claude-fable-5 aan via /v1/messages.
Gebruik dezelfde RunAPI-sleutel en verzoekstructuur terwijl je uitvoer vergelijkt.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Roep Claude/claude-fable-5-1 aan via /v1/messages.
Gebruik dezelfde RunAPI-sleutel en verzoekstructuur terwijl je uitvoer vergelijkt.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Roep Claude/claude-haiku-4-5-20251001 aan via /v1/messages.
Gebruik dezelfde RunAPI-sleutel en verzoekstructuur terwijl je uitvoer vergelijkt.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 endpoint-vormen, één sleutel

Chat completion

De OpenAI-vorm die elke SDK al spreekt. Wissel base_url en behoud je bestaande verzoekcode.

Message

De Messages API-vorm voor systeemprompts, toolgebruik en gestructureerde inhoudsblokken.

Response

De stateful vorm voor meerdere agent-rondes met gespreksafhandeling aan de serverzijde.

Embedding

Vectorembeddings voor retrieval, gefactureerd per token op dezelfde RunAPI-sleutel.

LLM's op één sleutel

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Bekijk alle 67 LLM-modellen
Quickstart

Roep elk model aan met de OpenAI-vorm

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Zo werkt het

Vier stappen naar je eerste generatie

  1. Vraag je API-sleutel aan

    Maak één sleutel voor je RunAPI-account.

  2. Gebruik OpenAI-formaat

    Stuur verzoeken via het gedocumenteerde OpenAI-compatibele endpoint.

  3. We routeren slim

    RunAPI selecteert een ondersteunde route voor je verzoek.

  4. Stream antwoorden

    Ontvang gestreamde uitvoer wanneer het gekozen endpoint SSE ondersteunt.

Waarom ontwikkelaars kiezen voor RunAPI

Één sleutel, alle modellen

Stop met het bijhouden van meerdere API-sleutels. Één integratie geeft je toegang tot 230+ modellen van alle aanbieders.

15-25% kostenbesparing

Onze volume-overeenkomsten met aanbieders betekenen lagere prijzen dan direct afnemen. Geen opslag bovenop.

Automatische failover

Als een aanbieder uitvalt, routeren we naar de beste volgende optie. Je app blijft beschikbaar.

OpenAI-compatibel

Directe vervanging voor de OpenAI SDK. Wijzig één regel code om toegang te krijgen tot elk model.

Facturering in realtime

Betaal alleen voor wat je gebruikt. Prijzen per verzoek zonder minimum. Volg kosten per model, per project.

Gegevensprivacy

Ons privacybeleid legt uit hoe aanvraaggegevens en gegenereerde inhoud worden verwerkt en bewaard.

Wat teams ermee bouwen

Codeeragenten

Routeer planning naar Opus en bewerkingen naar een goedkoop model, op één sleutel met één factuur.

RAG-pipelines

Embeddings en generatie op hetzelfde endpoint, zodat retrieval en beantwoording een gedeeld budget hebben.

Contentgeneratie

Verspreid concepten over modellen en bewaar het beste, zonder vijf aanbiederscontracten te tekenen.

Multi-modelvergelijking

A/B-test dezelfde prompt over Claude, GPT en Gemini door één string te wijzigen.

RunAPI vs alternatieven

Functie RunAPI OpenRouter Directe API
LLM-modellen 66 300+ 1 provider
Andere modaliteiten Video, Afbeelding, Muziek, Audio Nee Per provider
Prijzen 15-25% onder officieel Markttarief Officieel tarief
Native Messages API Ja Nee Ja
Gecombineerde credits Ja Ja Nee
MCP server + CLI Ja Nee Nee

LLM API-vragen

Hoe migreer ik vanuit een OpenAI-compatibele client?

Wijs de client naar de gedocumenteerde RunAPI-basis-URL en gebruik je RunAPI-sleutel. Behoud de verzoekstructuur die wordt ondersteund door het geselecteerde endpoint.

Wordt streaming ondersteund?

Streaming is beschikbaar wanneer het geselecteerde model en endpoint een streaming-respons bieden.

Werken toolaanroepen?

Toolaanroepen zijn beschikbaar op modellen en endpoint-vormen die toolondersteuning declareren in hun runtime-contract.

Hoe worden tokens gefactureerd?

Invoer- en uitvoertarieven staan vermeld in de modelcatalogus. Gebruik wordt gefactureerd op basis van de tokentellingen die voor het verzoek worden gerapporteerd.

Welk endpoint moet ik gebruiken?

Kies de endpoint-vorm die overeenkomt met je bestaande client en de vereiste mogelijkheden van je verzoek.

Wat als een route niet beschikbaar is?

De API geeft de verzoekstatus terug via zijn gedocumenteerde responscontract, zodat je applicatie opnieuw kan proberen of een ander ondersteund model kan kiezen.

Wissel twee regels, behoud je code

67 modellen achter de OpenAI-structuur die je al gebruikt. Gratis starten, geen creditcard vereist.