音声API

AI音声・スピーチAPI

テキスト読み上げ、音声クローン、文字起こし、効果音を ElevenLabs, Fish Audio, Google 公開音声カタログで利用できます。

32 音声モデル · 公開音声エンドポイント
32
音声モデル
6
プロバイダー
89
公開エンドポイント
プレイグラウンド ライブ
モデル
テキスト
次の音声生成をここから始めましょう。公開モデルを選ぶと、現在の料金とエンドポイントの詳細を確認できます。
音声 デフォルト音声
形式 mp3
速度 1.0x
モード text_to_speech

サンプルコード

音声を聴いてみる

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

audio endpointでできること

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
クイックスタート

音声を合成

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
使い方

初回生成までの4ステップ

  1. APIキーを取得

    すべてのTTSと音声モデルに1つのキーでアクセスできます。

  2. 音声を選択

    対応する音声モデルから利用できる音声を探します。

  3. テキストを送信

    テキストと音声の選択を /api/v1/elevenlabs/text_to_speech に送信します。

  4. 音声を取得

    タスク結果から生成された音声を受け取ります。

開発者がRunAPIを選ぶ理由

1つのキーですべてのモデル

複数のAPIキーを使い分ける必要はありません。1つの統合で全プロバイダーの200以上のモデルにアクセスできます。

15〜25%のコスト削減

プロバイダーとのボリューム契約により、直接契約より低い価格を追加料金なしで提供します。

自動フェイルオーバー

プロバイダーが停止した場合は、次に最適な選択肢へルーティングします。アプリは稼働し続けます。

OpenAI互換

OpenAI SDKのドロップイン置換です。コードを1行変えるだけで任意のモデルにアクセスできます。

リアルタイム請求

使った分だけ支払います。最低利用料なしのリクエスト単位で、モデルやプロジェクトごとに費用を追跡できます。

API キー認証

RunAPI API キーを使用して音声 API リクエストを認証します。

チームがこれで作るもの

音声エージェント

ストリーミングTTSをLLMと文字起こしに組み合わせ、1つのキーで全二重の音声ループを実現します。

ローカライズ

既存の動画を、聞き分けやすいクローン音声で新しい言語に吹き替えます。

会議メモ

話者ラベル付きで文字起こしし、同じパイプラインのLLMエンドポイントで要約します。

アクセシビリティ

録音セッションなしで、記事やドキュメント、アプリ内コンテンツにナレーションを追加します。

RunAPI と代替サービスの比較

機能 RunAPI ElevenLabs 直接利用 OpenAI TTS
音声モデル 32 個の音声モデル 1 プロバイダー 6 音声
料金 $0.12 / minute から 公式料金 公式料金
リアルタイムストリーミング 対応 対応 非対応
統合請求 対応 非対応 非対応
MCP サーバー 対応 非対応 非対応
プロバイダーのフェイルオーバー 対応 非対応 非対応

Audio APIに関するよくある質問

TTSの料金はどのように計算されますか?

入力テキスト1,000文字あたり、モデルの料金に基づいて課金されます。文字起こしは音声1分あたりの課金です。

音声のクローンは作成できますか?

はい。リファレンス音声をアップロードしてvoice idを作成し、以降のリクエストでそのidを指定してください。

ストリーミングは対応していますか?

ストリーミング対応は選択したエンドポイントによって異なります。再生機能を組み込む前に、ドキュメントのレスポンス形式を確認してください。

対応言語は何ですか?

対応言語はモデルによって異なります。選択したモデルのドキュメントで確認してください。

音声やボイスサンプルは保存されますか?

リクエストとレスポンスの内容が保持される場合があります。データの取り扱いについてはプライバシーポリシーをご覧ください。

単語レベルのタイムスタンプは取得できますか?

タイムスタンプの対応状況と粒度は文字起こしエンドポイントによって異なります。レスポンスフィールドを確認してください。話者ラベルは別の機能です。

プロダクトに声を与えましょう

音声合成・クローニング・文字起こしをひとつのキーで。クレジットカード不要、無料でスタート。

ログインして生成

APIキーを作成すると、アカウントから音声リクエストを実行できます。