LLM API

LLM API — OpenAI互換

Claude、GPT、GeminiDeepSeek、GrokにOpenAI互換のendpointひとつでアクセス。/v1/chat/completions、/v1/messages、/v1/responses対応。

67モデル base_urlを置き換えるだけで移行完了 トークン従量課金

67
LLMモデル
15-25%
公式価格より低価格
2行で完了
移行方法

プレイグラウンド

ライブ
モデル
メッセージ
Refactor this handler to stream partial results and return a typed error on timeout.
最大トークン数
integer | null
温度
number | null
ストリーム
false
Endpoint
/v1/chat/completions
推定コスト
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
サンプルコード

マルチモデル比較

プロンプト 量子コンピューティングを1文で説明してください

Claude/claude-fable-5

/v1/messages経由でClaude/claude-fable-5を呼び出します。
同じRunAPI keyとリクエスト形式を維持しながら出力を比較できます。

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

/v1/messages経由でClaude/claude-fable-5-1を呼び出します。
同じRunAPI keyとリクエスト形式を維持しながら出力を比較できます。

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

/v1/messages経由でClaude/claude-haiku-4-5-20251001を呼び出します。
同じRunAPI keyとリクエスト形式を維持しながら出力を比較できます。

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4種類のendpoint形式、キー1つ

Chat completion

すべてのSDKが対応済みのOpenAI形式。base_urlを置き換えるだけで既存のリクエストコードをそのまま使用できます。

Message

システムプロンプト、ツール使用、構造化コンテンツブロック向けのMessages API形式。

Response

サーバーサイドの会話管理を持つマルチターンエージェントループ向けのステートフルな形式。

Embedding

検索用のベクトル埋め込み。同じRunAPI keyでトークン単位の課金。

1つのキーで複数のLLMを利用

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

全67件のLLMモデルを表示
クイックスタート

OpenAI形式で任意のモデルを呼び出す

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
使い方

初回生成までの4ステップ

  1. APIキーを取得

    RunAPIアカウント用に1つのキーを作成します。

  2. OpenAI形式を使用

    ドキュメント化されたOpenAI互換エンドポイントにリクエストを送信します。

  3. スマートにルーティング

    RunAPIがリクエストに対応するサポート対象ルートを選択します。

  4. レスポンスをストリーミング

    選択したエンドポイントがSSEをサポートしている場合、ストリーミング出力を受け取れます。

開発者がRunAPIを選ぶ理由

1 つの API キーで全モデルに対応

API キーの使い分けはもう不要。1 つの統合で全プロバイダーの 230+ モデルにアクセスできます。

15〜25%のコスト削減

プロバイダーとのボリューム契約により、直接利用より低価格を実現。追加マージンなし。

自動フェイルオーバー

プロバイダーがダウンしても、次善のオプションにルーティングします。アプリの稼働を維持します。

OpenAI互換

OpenAI SDKのドロップイン代替品。1行変えるだけであらゆるモデルにアクセス。

リアルタイム請求

使った分だけ支払い。最低利用額なしのリクエスト単位料金。モデル別・プロジェクト別にコストを追跡。

データのプライバシー

リクエストデータと生成コンテンツの処理および保存方法は、プライバシーポリシーでご確認いただけます。

チームの活用事例

コーディングエージェント

プランニングをOpusに、編集を低コストモデルに。1つのキーと1つの請求書で。

RAGパイプライン

同じendpointでEmbeddingと生成を処理。検索と回答でコストを共有。

コンテンツ生成

複数モデルで下書きを並列生成して最良を選択。5つのプロバイダー契約は不要。

マルチモデル比較

文字列1つ変えるだけで、Claude・GPT・Geminiに同じプロンプトをA/Bテスト。

RunAPI と代替サービスの比較

機能 RunAPI OpenRouter ダイレクトAPI
LLMモデル 66 300以上 1 プロバイダー
その他のモダリティ 動画・画像・音楽・音声 いいえ プロバイダーごと
料金 公式より15〜25%安 市場価格 公式レート
ネイティブMessages API はい いいえ はい
統合クレジット はい はい いいえ
MCP server + CLI はい いいえ いいえ

LLM APIに関するよくある質問

OpenAI互換クライアントから移行するには?

クライアントのendpointをRunAPIのドキュメントに記載のbase URLに変更し、RunAPI keyを使用してください。選択したendpointがサポートするリクエスト形式を維持してください。

ストリーミングは対応していますか?

選択したモデルとendpointがストリーミングレスポンスを公開している場合に利用可能です。

ツール呼び出しは機能しますか?

ツール呼び出しは、ランタイム仕様でツールサポートを宣言しているモデルとendpoint形式で利用可能です。

トークンはどのように課金されますか?

入出力レートはモデルカタログに記載されています。リクエストで報告されたトークン数に基づいて課金されます。

どのendpointを使用すればよいですか?

既存のクライアントと、リクエストに必要な機能に合ったendpoint形式を選択してください。

ルートが利用できない場合はどうなりますか?

APIはドキュメントに記載のレスポンス仕様を通じてリクエストのステータスを返すため、アプリケーションでリトライするか、サポートされている別のモデルを選択できます。

2行変えるだけ、コードはそのまま

すでに使っているOpenAI形式で67モデルにアクセス。無料で始められ、クレジットカード不要。