ElevenLabs · 音声・音楽

Hermes Agent x ElevenLabs

ElevenLabsは音声AI企業で、そのモデルはTTS、ダイアログ、効果音、文字起こし、音声分離をカバーしています。RunAPI経由では、すべてのElevenLabsエンドポイントが1つのキーと呼び出し単位の課金を共有します。

6 variants から $0.04 / 分 商用利用対応

Prerequisite: npx runapi mcp install

Prompt

プロンプトモデル

タスクに合う場合は audio-isolation を使用してください: 混合音声ソースからボーカルを抽出。

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: 混合音声ソースからボーカルを抽出
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: ゲーム、動画、ポッドキャスト向けテキスト→効果音
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: 話者識別付き29以上の言語の文字起こし
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: 自然なターンテイキングによる複数話者ダイアログ生成
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29言語、最もリアルな感情表現、オーディオブックに最適
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32言語、非英語で3倍高速、4万文字上限
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: この段落を、温かみのある英国男性の声で、適度なペースで自然な音声に変換してください。
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/isolate_audio を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/elevenlabs/isolate_audio/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_sound を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/elevenlabs/text_to_sound/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/speech_to_text を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/elevenlabs/speech_to_text/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_dialogue を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/elevenlabs/text_to_dialogue/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_speech を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/elevenlabs/text_to_speech/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。

公開バージョンとエンドポイント

モデル ID エンドポイント 開始価格 モデルカタログ
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / 分 モデル詳細
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / 分 モデル詳細
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / 分 モデル詳細
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K文字 モデル詳細
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K文字 モデル詳細
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K文字 モデル詳細

検証

Task が終端状態になるまでポーリングします

<model-id> を選択すると検証コマンドが生成されます。

設定

ガイドエンドポイント: <endpoint>

<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
利用手順

3ステップで始める

  1. モデル ID を選択

    公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。

  2. RunAPI を設定

    エンドポイントを呼び出す前に RUNAPI_API_KEY を設定します。

  3. 結果を検証

    非同期エンドポイントでは、Task が終端状態になるまで同じエンドポイントをポーリングします。

Hermes Agent + ElevenLabs で作れるもの

  • 会話型の音声エージェント

    低遅延の音声で自然に話す音声エージェントを作り、カスタマーサポートのボット、アシスタント、電話窓口に使います。

  • YouTube コンテンツのナレーション

    シリーズ全体で一貫したキャラクターボイスを使い、YouTube 動画のナレーションを制作します。

  • テキストから話す動画までのパイプライン

    Hermes Agent のワークフローで ElevenLabs の音声とトーキングアバターのモデルをつなぎ、テキストからナレーション付き動画を作ります。

ElevenLabs を RunAPI + Hermes Agent で使う理由

  • 6 個のバリアントを 1 つの API キーで

    RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。

  • わかりやすい利用料金

    リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。

  • タスクの自動ワークフロー

    手動のポーリングコードを書かずに、統一されたタスクフローで非同期の結果を送信、確認、取得できます。

Hermes Agent + ElevenLabs に関するよくある質問

Hermes Agent で ElevenLabs を使えますか?

はい。Hermes Agent で RunAPI をプロバイダーとして設定すれば、音声合成、文字起こし、対話、効果音、音声分離など、このページに表示されている ElevenLabs の任意のエンドポイントを呼び出せます。

Hermes Agent で ElevenLabs を使って音声を文字起こしできますか?

はい。音声 URL を指定して音声認識のエンドポイントを呼び出してください。話者の分離や音声イベントのタグ付けに対応し、結果は非同期で返されます。

Hermes Agent は ElevenLabs を動画生成とつなげられますか?

はい。Hermes Agent は ElevenLabs で音声を生成し、同じ実行の中でその音声 URL をトーキングアバターや音声から動画のモデルに渡せます。

どのモデル ID を使うべきですか?

バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。

このガイドはチャットモデルを設定しますか?

いいえ。この Model Line はここに示すエンドポイント手順を使用し、Agent のチャットモデルとしては扱いません。

Hermes AgentでElevenLabsを使い始める

チームで構築していますか?

エンタープライズ導入、連携、技術的なご相談をお手伝いします。

お問い合わせ