Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
テキスト読み上げ、音声クローン、文字起こし、効果音を ElevenLabs, Fish Audio, Google 公開音声カタログで利用できます。
サンプルコード
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
すべてのTTSと音声モデルに1つのキーでアクセスできます。
対応する音声モデルから利用できる音声を探します。
テキストと音声の選択を /api/v1/elevenlabs/text_to_speech に送信します。
タスク結果から生成された音声を受け取ります。
複数のAPIキーを使い分ける必要はありません。1つの統合で全プロバイダーの200以上のモデルにアクセスできます。
プロバイダーとのボリューム契約により、直接契約より低い価格を追加料金なしで提供します。
プロバイダーが停止した場合は、次に最適な選択肢へルーティングします。アプリは稼働し続けます。
OpenAI SDKのドロップイン置換です。コードを1行変えるだけで任意のモデルにアクセスできます。
使った分だけ支払います。最低利用料なしのリクエスト単位で、モデルやプロジェクトごとに費用を追跡できます。
RunAPI API キーを使用して音声 API リクエストを認証します。
ストリーミングTTSをLLMと文字起こしに組み合わせ、1つのキーで全二重の音声ループを実現します。
既存の動画を、聞き分けやすいクローン音声で新しい言語に吹き替えます。
話者ラベル付きで文字起こしし、同じパイプラインのLLMエンドポイントで要約します。
録音セッションなしで、記事やドキュメント、アプリ内コンテンツにナレーションを追加します。
| 機能 | RunAPI | ElevenLabs 直接利用 | OpenAI TTS |
|---|---|---|---|
| 音声モデル | 32 個の音声モデル | 1 プロバイダー | 6 音声 |
| 料金 | $0.12 / minute から | 公式料金 | 公式料金 |
| リアルタイムストリーミング | 対応 | 対応 | 非対応 |
| 統合請求 | 対応 | 非対応 | 非対応 |
| MCP サーバー | 対応 | 非対応 | 非対応 |
| プロバイダーのフェイルオーバー | 対応 | 非対応 | 非対応 |
入力テキスト1,000文字あたり、モデルの料金に基づいて課金されます。文字起こしは音声1分あたりの課金です。
はい。リファレンス音声をアップロードしてvoice idを作成し、以降のリクエストでそのidを指定してください。
ストリーミング対応は選択したエンドポイントによって異なります。再生機能を組み込む前に、ドキュメントのレスポンス形式を確認してください。
対応言語はモデルによって異なります。選択したモデルのドキュメントで確認してください。
リクエストとレスポンスの内容が保持される場合があります。データの取り扱いについてはプライバシーポリシーをご覧ください。
タイムスタンプの対応状況と粒度は文字起こしエンドポイントによって異なります。レスポンスフィールドを確認してください。話者ラベルは別の機能です。