Fish Audio · 音訊與音樂

OpenClaw x Fish Audio

Fish Audio 提供文字轉語音模型,適用於富有表現力的對話與穩定可靠的正式製作語音工作流程。RunAPI 會驗證每次生成結果,並回傳代管 MP3 URL 與音訊中繼資料。

3 variants 起價 $0.02 / 1K UTF-8 位元組 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 s1:富有表現力的多語言語音,適用於對話與敘事音訊。

You have access to RunAPI task tools for Fish Audio.

Available Fish Audio models:
- s1: 富有表現力的多語言語音,適用於對話與敘事音訊
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2-pro: 適合既有製作工作流程的上一代自然語音
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2.1-pro: 建議用於正式製作,支援 83 種語言與自然語言表情控制
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text

Use the model ID and endpoint that match the user's request.
Example prompt: 將這段簡短的紀錄片旁白轉成自然、富有表現力且節奏一致的語音。
/api/v1/fish_audio/text_to_speech: Submit the request and verify the synchronous output. POST /api/v1/fish_audio/text_to_speech。確認同步回應符合該端點的 API 參考。

公開版本與端點

模型 ID 端點 起始價格 模型目錄
s1
/api/v1/fish_audio/text_to_speech
$0.02 / 1K UTF-8 位元組 模型詳情
s2-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1K UTF-8 位元組 模型詳情
s2.1-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1K UTF-8 位元組 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。

其他操作

這些操作不使用模型 ID。

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

使用 OpenClaw + Fish Audio 可以打造什麼

  • 配音與旁白

    使用支援語音生成的模型,把腳本轉成影片、課程和產品展示所需的語音。

  • 音樂與配樂

    使用支援音樂生成的模型,根據曲風、情緒和節奏的描述製作背景音樂和廣告短曲。

  • 轉錄與音訊處理

    使用支援音訊輸入的模型,轉錄錄音,或清理、轉換現有音訊。

為什麼透過 RunAPI + OpenClaw 使用 Fish Audio

  • 3 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需變更現有整合。

  • 清楚的用量價格

    送出請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 直接回傳結果

    同步呼叫會在同一個回應中回傳結果,Agent 不需輪詢工作即可直接使用。

OpenClaw + Fish Audio 常見問題

s1、s2-pro 和 s2.1-pro 有什麼差別?

s1 適合富有表現力的語音;s2.1-pro 建議用於正式製作,支援 83 種語言與表情控制;s2-pro 仍是可用的上一代選項。

Fish Audio 會回傳哪種音訊格式?

預設回傳 MP3,也可選擇 WAV。RunAPI 回應會準確提供實際格式、MIME 類型與位元組大小。

可以用參考語音樣本引導音色嗎?

你可以嘗試在後續文字轉語音請求中使用回傳的 RunAPI voice_id,但不保證一直可用。若只需影響目前請求,也可以透過 references 傳入 base64 音訊及其逐字文字稿。

生成的音訊由 RunAPI 代管嗎?

是。RunAPI 會先驗證並儲存結果,再回傳代管音訊 URL。

需要輪詢完成狀態嗎?

不需要。此端點採同步處理,請求成功後會直接回傳完整的音訊結果。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。

開始在 OpenClaw 中使用 Fish Audio

正在與團隊一起打造?

我們可以協助企業接入、整合與技術問題。

聯絡我們