LLM API

API LLM — Compatible OpenAI

Accédez à Claude, GPT, Gemini, DeepSeek et Grok via un seul endpoint compatible OpenAI. /v1/chat/completions, /v1/messages, /v1/responses.

67 modèles remplacement drop-in de base_url paiement par token

67
Modèles LLM
15-25%
En dessous du tarif officiel
2 lignes
Pour migrer

Playground

en direct
Modèle
Message
Refactor this handler to stream partial results and return a typed error on timeout.
Tokens max
integer | null
Température
number | null
Stream
false
Endpoint
/v1/chat/completions
Coût estimé
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Exemples

Comparaison multi-modèles

Prompt Expliquer l'informatique quantique en une phrase

Claude/claude-fable-5

Appeler Claude/claude-fable-5 via /v1/messages.
Conservez la même clé RunAPI et la même structure de requête tout en comparant les sorties.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Appeler Claude/claude-fable-5-1 via /v1/messages.
Conservez la même clé RunAPI et la même structure de requête tout en comparant les sorties.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Appeler Claude/claude-haiku-4-5-20251001 via /v1/messages.
Conservez la même clé RunAPI et la même structure de requête tout en comparant les sorties.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 formes d'endpoint, une seule clé

Chat completion

La forme OpenAI que chaque SDK comprend déjà. Remplacez base_url et conservez votre code de requête existant.

Message

La forme Messages API pour les prompts système, l'utilisation d'outils et les blocs de contenu structurés.

Response

La forme avec état pour les boucles d'agents multi-tours avec gestion de la conversation côté serveur.

Embedding

Embeddings vectoriels pour la récupération, facturés par token sur la même clé RunAPI.

LLMs sur une seule clé

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Voir tous les 67 modèles LLM
Démarrage rapide

Appelez n'importe quel modèle avec la forme OpenAI

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Comment ça marche

Quatre étapes jusqu'à votre première génération

  1. Obtenez votre clé API

    Créez une clé pour votre compte RunAPI.

  2. Utilisez le format OpenAI

    Envoyez des requêtes via le point de terminaison documenté compatible avec OpenAI.

  3. Nous routons intelligemment

    RunAPI sélectionne une route prise en charge pour votre requête.

  4. Diffusez les réponses

    Recevez la sortie en streaming lorsque le point de terminaison sélectionné prend en charge SSE.

Pourquoi les développeurs choisissent RunAPI

Une clé, tous les modèles

Fini la jonglerie de clés API. Une seule intégration vous donne accès à 230+ modèles chez tous les fournisseurs.

15 à 25 % d'économies

Nos accords de volume avec les fournisseurs permettent des prix inférieurs à ceux pratiqués en direct. Sans marge supplémentaire.

Basculement automatique

Si un fournisseur tombe en panne, nous routons vers la meilleure alternative. Votre application reste disponible.

Compatible OpenAI

Remplacement drop-in pour le SDK OpenAI. Changez une ligne de code pour accéder à n'importe quel modèle.

Facturation en temps réel

Payez uniquement ce que vous utilisez. Tarification à la requête sans minimum. Suivez les coûts par modèle et par projet.

Confidentialité des données

Notre politique de confidentialité explique comment les données des requêtes et les contenus générés sont traités et conservés.

Ce que les équipes construisent avec

Agents de développement

Routez la planification vers Opus et les modifications vers un modèle économique, avec une seule clé et une seule facture.

Pipelines RAG

Embeddings et génération sur le même endpoint, afin que la récupération et les réponses partagent un budget.

Génération de contenu

Diffusez des brouillons sur plusieurs modèles et conservez le meilleur, sans signer cinq contrats fournisseur.

Comparaison multi-modèles

Testez le même prompt sur Claude, GPT et Gemini en changeant une seule chaîne.

RunAPI vs alternatives

Fonctionnalité RunAPI OpenRouter API directe
Modèles LLM 66 300+ 1 fournisseur
Autres modalités Vidéo, Image, Musique, Audio Non Par fournisseur
Tarification 15 à 25 % en dessous du tarif officiel Tarif du marché Tarif officiel
API de messages natifs Oui Non Oui
Crédits unifiés Oui Oui Non
Serveur MCP + CLI Oui Non Non

Questions sur l'API LLM

Comment migrer depuis un client compatible OpenAI ?

Pointez le client vers l'URL de base RunAPI documentée et utilisez votre clé RunAPI. Conservez la structure de requête prise en charge par l'endpoint sélectionné.

Le streaming est-il pris en charge ?

Le streaming est disponible lorsque le modèle et l'endpoint sélectionnés exposent une réponse en streaming.

Les appels d'outils fonctionnent-ils ?

L'appel d'outils est disponible sur les modèles et les formes d'endpoint qui déclarent la prise en charge des outils dans leur contrat d'exécution.

Comment les tokens sont-ils facturés ?

Les tarifs d'entrée et de sortie sont listés dans le catalogue de modèles. L'utilisation est facturée d'après les comptages de tokens rapportés pour la requête.

Quel endpoint utiliser ?

Choisissez la forme d'endpoint qui correspond à votre client existant et aux capacités requises par votre requête.

Que se passe-t-il si une route est indisponible ?

L'API retourne le statut de la requête via son contrat de réponse documenté afin que votre application puisse réessayer ou choisir un autre modèle pris en charge.

Échangez deux lignes, gardez votre code

67 modèles derrière la structure OpenAI que vous utilisez déjà. Démarrez gratuitement, sans carte bancaire.