公开版本与端点
验证
轮询,直到 Task 进入终态
选择 <model-id> 后生成验证命令。
配置
指南端点: <endpoint>
选择 <model-id> 后,按端点的公开输入契约生成请求。
其他操作
这些操作不使用模型 ID。
/api/v1/fish_audio/list_voices/api/v1/fish_audio/create_voice/api/v1/fish_audio/get_voice
三步开始使用
-
选择模型 ID
选择公开模型 ID,并查看其端点与当前起步价格。
-
配置 RunAPI
调用端点前设置 RUNAPI_API_KEY。
-
验证结果
对于异步端点,轮询同一端点,直到 Task 进入终态。
使用 OpenClaw + Fish Audio 可以构建什么
-
配音与旁白
使用支持语音生成的模型,把脚本转成视频、课程和产品演示所需的语音。
-
音乐与配乐
使用支持音乐生成的模型,根据曲风、情绪和节奏的描述制作背景音乐和广告短曲。
-
转写与音频处理
使用支持音频输入的模型,转写录音,或清理、转换现有音频。
为什么通过 RunAPI + OpenClaw 使用 Fish Audio
-
3 个变体,一个 API 密钥
通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。
-
清晰的用量价格
发送请求前查看目录中的当前价格,无需订阅或最低消费。
-
直接返回结果
同步调用在同一个响应中返回结果,Agent 无需轮询任务即可直接使用。
OpenClaw + Fish Audio 常见问题
s1、s2-pro 和 s2.1-pro 有什么区别?
s1 面向富有表现力的语音;s2.1-pro 是推荐的生产模型,支持 83 种语言与自然语言表情控制;s2-pro 仍作为上一代选项提供。
Fish Audio 返回什么音频格式?
默认返回 MP3,也可选择 WAV。RunAPI 响应会准确提供实际格式、MIME 类型与字节大小。
可以用参考样本引导音色吗?
你可以尝试在后续文本转语音请求中使用返回的 RunAPI voice_id,但不保证始终可用。若只需影响当前请求,也可以通过 references 传入 base64 音频及其精确文本。
生成的音频由 RunAPI 托管吗?
是。RunAPI 会在返回托管音频 URL 前校验并存储结果。
需要轮询任务状态吗?
不需要。该端点为同步请求,成功响应会直接返回已完成的音频结果。
应该使用哪个模型 ID?
从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。
本指南会配置聊天模型吗?
不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。