1つの API key
モデルやプロバイダーをまたいで同じ認証情報を使えます。
It looks like you may prefer a different language. Switch anytime.
RunAPIのモデルスキル、統合認証、従量課金制の料金でGemini TTS APIを利用できます。
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-tts",
"text": "落ち着いたイギリス人のホストと快活なアメリカ人ゲストによる、2人の話者のポッドキャスト導入音声を生成してください。"
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-3.1-flash-tts",
text: "落ち着いたイギリス人のホストと快活なアメリカ人ゲストによる、2人の話者のポッドキャスト導入音声を生成してください。",
});
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-3.1-flash-tts",
text: "落ち着いたイギリス人のホストと快活なアメリカ人ゲストによる、2人の話者のポッドキャスト導入音声を生成してください。"
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Gemini TTSは、話者ごとに個別の音声設定を維持しながら、順番に並べた会話を音声に変換します。リクエストでは、シーン、会話全体の表現を指定するコンテキスト、サンプリング温度も設定できます。
| Endpoint | 解像度 | 尺 | 価格 | |
|---|---|---|---|---|
| text_to_speech | — | — | Input $1.40 / 1M tokens | Output $28.00 / 1M tokens |
gemini-2.5-pro-tts の料金を表示しています。他のバリアントはそれぞれの endpoint 料金が適用されます。
出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。
対応するすべてのモデルに RunAPI key を使います。
機能実装の前に model skill をコード作業環境へ追加します。
task ID でポーリングするか、生成完了時の callback を処理します。
モデルやプロバイダーをまたいで同じ認証情報を使えます。
model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。
呼び出し前に従量料金を確認できます。
RunAPIは、同じテキスト読み上げエンドポイントとリクエスト形式でGemini 2.5 Pro TTSとGemini 3.1 Flash TTSに対応しています。
一意のSpeaker N識別子を使って参加者ごとに話者設定を追加し、会話の各発話をいずれかの識別子に割り当てます。
話者ごとに音声、アクセント、話し方、話速を設定でき、音声表現をさらに指定するオプションのオーディオプロファイルも追加できます。
シーンは収録環境を表し、サンプルコンテキストは会話全体のトーンと話し方の指針を設定します。
完了後にタスクを照会するか、コールバックを受信します。レスポンスのaudiosリストには、生成されたファイルのURLが含まれます。
model skill をインストールし、RunAPI key とセットアップメモに従ってください。