公开版本与端点
| 模型 ID | 端点 | 起步价格 | 模型目录 |
|---|---|---|---|
audio-isolation
|
/api/v1/elevenlabs/isolate_audio
|
$0.12 / 分钟 | 模型详情 |
sound-effect-v2
|
/api/v1/elevenlabs/text_to_sound
|
$0.15 / 分钟 | 模型详情 |
speech-to-text
|
/api/v1/elevenlabs/speech_to_text
|
$0.04 / 分钟 | 模型详情 |
text-to-dialogue-v3
|
/api/v1/elevenlabs/text_to_dialogue
|
$0.14 / 1K 个字符 | 模型详情 |
text-to-speech-multilingual-v2
|
/api/v1/elevenlabs/text_to_speech
|
$0.12 / 1K 个字符 | 模型详情 |
text-to-speech-turbo-v2.5
|
/api/v1/elevenlabs/text_to_speech
|
$0.06 / 1K 个字符 | 模型详情 |
验证
轮询,直到 Task 进入终态
选择 <model-id> 后生成验证命令。
配置
指南端点: <endpoint>
选择 <model-id> 后,按端点的公开输入契约生成请求。
三步开始使用
-
选择模型 ID
选择公开模型 ID,并查看其端点与当前起步价格。
-
配置 RunAPI
调用端点前设置 RUNAPI_API_KEY。
-
验证结果
对于异步端点,轮询同一端点,直到 Task 进入终态。
使用 Hermes Agent + ElevenLabs 可以构建什么
-
对话式语音 Agent
搭建说话自然的语音 Agent,用低延迟语音支撑客服机器人、助手或电话交互。
-
YouTube 内容旁白
为 YouTube 视频制作旁白,整个系列保持一致的角色音色。
-
文字转口播视频流水线
在 Hermes Agent 工作流中把 ElevenLabs 语音与数字人模型串联,从文字直接得到带旁白的视频。
为什么通过 RunAPI + Hermes Agent 使用 ElevenLabs
-
6 个变体,一个 API 密钥
通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。
-
清晰的用量价格
发送请求前查看目录中的当前价格,无需订阅或最低消费。
-
自动化任务流程
通过一致的任务流程提交任务、查询状态并收集异步结果,无需编写手动轮询代码。
Hermes Agent + ElevenLabs 常见问题
可以在 Hermes Agent 中使用 ElevenLabs 吗?
可以。在 Hermes Agent 中把 RunAPI 配置为提供方,然后调用本页列出的任意 ElevenLabs 端点,包括语音合成、转写、对话、音效和人声分离。
可以在 Hermes Agent 中用 ElevenLabs 转写音频吗?
可以。用音频 URL 调用语音转文字端点。它支持区分说话人并标注音频事件,结果以异步方式返回。
Hermes Agent 能把 ElevenLabs 与视频生成串联吗?
可以。Hermes Agent 可以先用 ElevenLabs 生成语音,再在同一次运行中把音频 URL 交给数字人或语音生视频模型。
应该使用哪个模型 ID?
从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。
本指南会配置聊天模型吗?
不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。