VARIANT · Google / Gemini TTS

gemini-3.1-flash-tts API

Google / Gemini TTS

透過 RunAPI 使用 Gemini TTS 系列的 gemini-3.1-flash-tts。按次計費,無訂閱費,失敗的生成不收費。

可直接上線 · audio_music · 可商用
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-tts",
  "text": "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";

const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
    model: "gemini-3.1-flash-tts",
    text: "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。",
});
require "runapi/gemini_tts"

client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
    model: "gemini-3.1-flash-tts",
    text: "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-tts v1
切換 variant
gemini-2.5-pro-tts
OVERVIEW

gemini-3.1-flash-tts 在 Gemini TTS 系列中,兼顧品質與成本的最佳平衡。

  • 以美元按次計費
  • 生成失敗不收費
  • 模型支援時可串流輸出
  • Model skill setup
PRICING

價格

失敗的生成不收費
Text to speech
Input $1.40 / 1M tokens
Output $28.00 / 1M tokens
規格表

技術細節

Model ID gemini-3.1-flash-tts
供應商 Google
模態 audio_music
任務類型 asynchronous
計費單位 1K tokens
API endpoint /api/v1/gemini_tts/text_to_speech
商用授權 是 — 已透過 API 包含
目錄狀態 可直接上線
SKILLS

快速開始 — gemini-3.1-flash-tts

相同格式 · variant 固定在 model 中

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-tts -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini TTS skill for this app:

1. Add runapi-ai/gemini-tts with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
運作方式

四步驟使用 gemini-3.1-flash-tts

01

安裝

安裝此 model line 的 model skill。

02

設定

將 model 欄位設定為此頁面顯示的完整 model ID。

03

呼叫

使用您的 prompt、inputs 和 callback 設定送出型別化請求。

04

接收

讀取 RunAPI 的 task 回應、webhook callback 或快取輸出 URL。

DIFFERENCES

gemini-3.1-flash-tts 有什麼不同

VS GEMINI-2.5-PRO-TTS

適合即時對話與大量音訊工作流程的快速多角色語音

適合長篇對話的高傳真多角色語音,支援細緻表達控制

使用情境

最適合

Podcast 與影片配樂

依照單集情緒生成免版稅背景音樂,無需支付授權費。

遊戲音效

為程序化生成的關卡產生可自適應的環境音景與效果音。

廣告旁白與音效

無需錄音室即可為客戶廣告製作客製化旁白與音效。

FAQ

關於 gemini-3.1-flash-tts 的常見問題

模型 ID 在不同版本之間會保持穩定嗎?

RunAPI 會維持 model ID 穩定,並在不改變請求格式的情況下處理相容版本更新。

這個 variant 的速率限制是多少?

每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。

之後可以切換 variant 嗎?

可以——variant 只是旗標。只要變更 model 參數即可切換。

它支援串流嗎?

只要支援串流,RunAPI 就會端到端串流。

我該在哪裡回報品質問題?

請在公開 GitHub repo 提交 issue,或寄信給支援。

立即開始

開始使用 Gemini TTS 進行開發。