ElevenLabs · Audio & Music

Hermes Agent x ElevenLabs

ElevenLabs 是一家语音 AI 公司,模型覆盖 TTS、对话、音效、转录和音频隔离。通过 RunAPI,所有 ElevenLabs 端点共享一把 key 和按次计费。

公开版本与端点

模型 ID版本端点起步价格模型目录
audio-isolation从混合音频中提取人声
/api/v1/elevenlabs/isolate_audio
$0.120模型详情
sound-effect-v2文字生成音效,适用于游戏、视频和播客
/api/v1/elevenlabs/text_to_sound
$0.150模型详情
speech-to-text29+ 种语言转录,支持说话人分离
/api/v1/elevenlabs/speech_to_text
$0.040模型详情
text-to-dialogue-v3多说话人对话生成,自然轮流交替
/api/v1/elevenlabs/text_to_dialogue
$0.140模型详情
text-to-speech-multilingual-v229 种语言;最逼真的情感表达;适合有声书和配音
/api/v1/elevenlabs/text_to_speech
$0.120模型详情
text-to-speech-turbo-v2.532 种语言;非英语快 3 倍;4 万字符上限;最便宜
/api/v1/elevenlabs/text_to_speech
$0.060模型详情

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。

验证

选择 <model-id> 后生成验证命令。

使用流程

  1. 1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 2. 配置 RunAPI

    调用端点前设置 RUNAPI_API_KEY。

  3. 3. 验证结果

    对于异步端点,轮询同一端点,直到 Task 进入终态。

常见问题

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。