Fish Audio · Audio & Music

Hermes Agent x Fish Audio

Fish Audio 为表现力对话和可靠的生产语音工作流提供文本转语音模型。RunAPI 会校验每个结果,并返回带音频元数据的托管 MP3 URL。

公开版本与端点

模型 ID版本端点起步价格模型目录
s1面向对话与叙事音频的富有表现力的多语言语音
/api/v1/fish_audio/text_to_speech
$0.020模型详情
s2-pro适合现有生产工作流的上一代自然、稳定语音模型
/api/v1/fish_audio/text_to_speech
$0.020模型详情
s2.1-pro推荐用于生产的语音合成模型,支持 83 种语言与自然语言表情控制
/api/v1/fish_audio/text_to_speech
$0.020模型详情

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。

验证

选择 <model-id> 后生成验证命令。

其他操作

这些操作不使用模型 ID。

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice

使用流程

  1. 1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 2. 配置 RunAPI

    调用端点前设置 RUNAPI_API_KEY。

  3. 3. 验证结果

    对于异步端点,轮询同一端点,直到 Task 进入终态。

常见问题

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。