Fish Audio API
多言語対応で表現力に優れ、制作向けの安定したテキスト読み上げに対応し、RunAPIで管理されたMP3を返すFish Audio APIにアクセスできます。
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "この短いドキュメンタリーのナレーションを、一定の話速を保った表現力豊かで自然な音声に変換してください。"
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "この短いドキュメンタリーのナレーションを、一定の話速を保った表現力豊かで自然な音声に変換してください。",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "この短いドキュメンタリーのナレーションを、一定の話速を保った表現力豊かで自然な音声に変換してください。"
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audioは同期型RunAPIエンドポイントでテキストを音声に変換します。表現力豊かな音声にはs1、83言語と自然言語の表現制御に対応する制作向け推奨モデルにはs2.1-proを選択できます。s2-proも前世代の選択肢として利用できます。
- 品質とレイテンシ目標に合わせたモデルバリアント
- 統合 API key
- Model skill に docs、schema、セットアップメモを同梱
- 失敗した生成は課金されません
バリアント
Utility endpoints
Shared endpoints for this model line, such as extension, enhancement, or conversion actions.
アプリ開発用に Fish Audio skill をインストール
モデル docs、schema、料金メモ、セットアップ手順をコード作業環境に読み込みます。
# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Install the Fish Audio skill for this app: 1. Add runapi-ai/fish-audio with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
この model skill で構築する方法
モデルを選ぶ
出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。
一度だけ認証
対応するすべてのモデルに RunAPI key を使います。
skill をインストール
機能実装の前に model skill をコード作業環境へ追加します。
出力を受け取る
task ID でポーリングするか、生成完了時の callback を処理します。
Fish Audio の位置づけ
Fish Audioは、表現力豊かな会話音声と、安定した制作向け音声ワークフローのためのテキスト読み上げモデルを提供します。RunAPIは各結果を検証し、音声メタデータを含む、管理されたMP3 URLを返します。
RunAPI 経由で Fish Audio を使う理由
1つの API key
モデルやプロバイダーをまたいで同じ認証情報を使えます。
Skill-ready
model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。
予測しやすい請求
呼び出し前に従量料金を確認できます。
よくある質問
s1、s2-pro、s2.1-proの違いは何ですか?
s1は表現力豊かな会話や物語向けです。s2.1-proは83言語と自然言語による表現制御を備えた制作向け推奨モデルで、s2-proも前世代モデルとして引き続き利用できます。
Fish Audioはどの音声形式を返しますか?
デフォルトはMP3で、WAVも選択できます。RunAPIのレスポンスには実際の形式、MIMEタイプ、バイト数が含まれます。
リファレンスサンプルで音声をガイドできますか?
返されたRunAPIのvoice_idを後続のテキスト読み上げリクエストで試用できますが、利用可能性は保証されません。現在のリクエストだけを調整する場合は、referencesでbase64音声と正確な文字起こしを渡します。
生成された音声はRunAPIでホストされますか?
はい。RunAPIは結果を検証して保存した後、管理された音声URLを返します。
完了までポーリングする必要がありますか?
いいえ。このエンドポイントは同期型で、成功レスポンス内に生成済みの音声を直接返します。
このモデルはどう呼び出しますか?
model skill をインストールし、RunAPI key とセットアップメモに従ってください。
失敗した生成は課金されますか?
失敗した生成は課金されません
アプリケーションから呼び出せますか?
はい。コード作業環境に model skill をインストールし、モデル機能を追加するときに利用してください。