公開版本與端點
驗證
輪詢,直到 Task 進入終態
選擇 <model-id> 後產生驗證命令。
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。
其他操作
這些操作不使用模型 ID。
/api/v1/fish_audio/list_voices/api/v1/fish_audio/create_voice/api/v1/fish_audio/get_voice
三步開始使用
-
選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
-
設定 RunAPI
呼叫端點前設定 RUNAPI_API_KEY。
-
驗證結果
對非同步端點輪詢同一路徑,直到 Task 進入終態。
使用 Hermes Agent + Fish Audio 可以打造什麼
-
配音與旁白
使用支援語音生成的模型,把腳本轉成影片、課程和產品展示所需的語音。
-
音樂與配樂
使用支援音樂生成的模型,根據曲風、情緒和節奏的描述製作背景音樂和廣告短曲。
-
轉錄與音訊處理
使用支援音訊輸入的模型,轉錄錄音,或清理、轉換現有音訊。
為什麼透過 RunAPI + Hermes Agent 使用 Fish Audio
-
3 個變體,一個 API 金鑰
透過一個 RunAPI 連線選擇可用的模型變體,無需變更現有整合。
-
清楚的用量價格
送出請求前查看目錄中的目前價格,無需訂閱或最低消費。
-
直接回傳結果
同步呼叫會在同一個回應中回傳結果,Agent 不需輪詢工作即可直接使用。
Hermes Agent + Fish Audio 常見問題
s1、s2-pro 和 s2.1-pro 有什麼差別?
s1 適合富有表現力的語音;s2.1-pro 建議用於正式製作,支援 83 種語言與表情控制;s2-pro 仍是可用的上一代選項。
Fish Audio 會回傳哪種音訊格式?
預設回傳 MP3,也可選擇 WAV。RunAPI 回應會準確提供實際格式、MIME 類型與位元組大小。
可以用參考語音樣本引導音色嗎?
你可以嘗試在後續文字轉語音請求中使用回傳的 RunAPI voice_id,但不保證一直可用。若只需影響目前請求,也可以透過 references 傳入 base64 音訊及其逐字文字稿。
生成的音訊由 RunAPI 代管嗎?
是。RunAPI 會先驗證並儲存結果,再回傳代管音訊 URL。
需要輪詢完成狀態嗎?
不需要。此端點採同步處理,請求成功後會直接回傳完整的音訊結果。
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。
本指南會設定聊天模型嗎?
不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。