公開バージョンとエンドポイント
| モデル ID | エンドポイント | 開始価格 | モデルカタログ |
|---|---|---|---|
audio-isolation
|
/api/v1/elevenlabs/isolate_audio
|
$0.12 / 分 | モデル詳細 |
sound-effect-v2
|
/api/v1/elevenlabs/text_to_sound
|
$0.15 / 分 | モデル詳細 |
speech-to-text
|
/api/v1/elevenlabs/speech_to_text
|
$0.04 / 分 | モデル詳細 |
text-to-dialogue-v3
|
/api/v1/elevenlabs/text_to_dialogue
|
$0.14 / 1K文字 | モデル詳細 |
text-to-speech-multilingual-v2
|
/api/v1/elevenlabs/text_to_speech
|
$0.12 / 1K文字 | モデル詳細 |
text-to-speech-turbo-v2.5
|
/api/v1/elevenlabs/text_to_speech
|
$0.06 / 1K文字 | モデル詳細 |
検証
Task が終端状態になるまでポーリングします
<model-id> を選択すると検証コマンドが生成されます。
設定
ガイドエンドポイント: <endpoint>
<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
3ステップで始める
-
モデル ID を選択
公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。
-
RunAPI を設定
エンドポイントを呼び出す前に RUNAPI_API_KEY を設定します。
-
結果を検証
非同期エンドポイントでは、Task が終端状態になるまで同じエンドポイントをポーリングします。
Hermes Agent + ElevenLabs で作れるもの
-
会話型の音声エージェント
低遅延の音声で自然に話す音声エージェントを作り、カスタマーサポートのボット、アシスタント、電話窓口に使います。
-
YouTube コンテンツのナレーション
シリーズ全体で一貫したキャラクターボイスを使い、YouTube 動画のナレーションを制作します。
-
テキストから話す動画までのパイプライン
Hermes Agent のワークフローで ElevenLabs の音声とトーキングアバターのモデルをつなぎ、テキストからナレーション付き動画を作ります。
ElevenLabs を RunAPI + Hermes Agent で使う理由
-
6 個のバリアントを 1 つの API キーで
RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。
-
わかりやすい利用料金
リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。
-
タスクの自動ワークフロー
手動のポーリングコードを書かずに、統一されたタスクフローで非同期の結果を送信、確認、取得できます。
Hermes Agent + ElevenLabs に関するよくある質問
Hermes Agent で ElevenLabs を使えますか?
はい。Hermes Agent で RunAPI をプロバイダーとして設定すれば、音声合成、文字起こし、対話、効果音、音声分離など、このページに表示されている ElevenLabs の任意のエンドポイントを呼び出せます。
Hermes Agent で ElevenLabs を使って音声を文字起こしできますか?
はい。音声 URL を指定して音声認識のエンドポイントを呼び出してください。話者の分離や音声イベントのタグ付けに対応し、結果は非同期で返されます。
Hermes Agent は ElevenLabs を動画生成とつなげられますか?
はい。Hermes Agent は ElevenLabs で音声を生成し、同じ実行の中でその音声 URL をトーキングアバターや音声から動画のモデルに渡せます。
どのモデル ID を使うべきですか?
バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。
このガイドはチャットモデルを設定しますか?
いいえ。この Model Line はここに示すエンドポイント手順を使用し、Agent のチャットモデルとしては扱いません。