It looks like you may prefer a different language. Switch anytime.

Google

Gemini TTS gemini 3.1 flash tts

Audio & Music

適合即時對話與大量音訊工作流程的快速多角色語音

Input $1.40 / 1M tokens | Output $28.00 / 1M tokens Gemini TTS gemini 3.1 flash tts API reference →
模型健康狀態 資料不足
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-tts",
  "text": "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"
}'
https://runapi.ai 1 endpoint

2 個版本可用

Playground

試用 Gemini TTS gemini 3.1 flash tts

選擇任一模型,幾秒內即可開始生成。

立即試用模型

選擇任一模型,幾秒內即可開始生成。

模型
Mode
預估: Input $1.40 / 1M tokens | Output $28.00 / 1M tokens
生成

請登入以使用 RunAPI 生成。

規格

技術細節

提供者 Google
模型 ID gemini-3.1-flash-tts
模態 Audio & Music
任務類型 Asynchronous
API 端點 /api/v1/gemini_tts/text_to_speech
計費單位 1K tokens
輸入參數 callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature
目錄狀態 可直接上線
使用方式

3 個步驟使用此模型

  1. 取得 API 金鑰

    免費註冊後,從控制台建立 gemini-3.1-flash-tts 的 API 金鑰。

  2. 傳送請求

    向 /api/v1/gemini_tts/text_to_speech 傳送 POST 請求,並傳入 gemini-3.1-flash-tts 模型 ID 與參數。

  3. 取得結果

    輪詢工作或依照回呼取得已完成的 gemini-3.1-flash-tts 結果。

此模型提供的功能

彈性參數

可設定 5 個已記錄的參數,包括 dialogue_turns, sample_context, scene, speakers, temperature。

Endpoint 覆蓋範圍

公開 1 個公共 endpoint:text_to_speech。

Webhook 傳送

非同步任務接受回呼 URL 以接收完成通知。

用量計費

依 1K tokens 計量,無需訂閱。

Gemini TTS gemini 3.1 flash tts 價格

API endpoint
解析度
時長
價格
text_to_speech
暫無資料
1K tokens
Input: $1.40 / 1M tokens Output: $28.00 / 1M tokens
API 參考

端點規格

端點
POST /api/v1/gemini_tts/text_to_speech
模型 ID
gemini-3.1-flash-tts
工作類型
text_to_speech
最長時長
暫無資料
解析度
暫無資料
長寬比
暫無資料
輸出格式
暫無資料
平均生成時間
暫無資料

請求參數

scene

選填 string

Scene and recording environment.

speakers

必填 array

Non-empty speaker configurations with unique Speaker N identifiers.

temperature

選填 number

Sampling temperature.

callback_url

選填 string

Webhook URL for async notifications.

dialogue_turns

必填 array

Non-empty ordered dialogue turns whose speaker ids reference configured speakers.

sample_context

選填 string

Overall delivery context and tone.

使用情境

Podcast 與影片配樂

依照單集情緒生成免版稅背景音樂,無需支付授權費。

遊戲音效

為程序化生成的關卡產生可自適應的環境音景與效果音。

廣告旁白與音效

無需錄音室即可為客戶廣告製作客製化旁白與音效。

FAQ

關於 Gemini TTS gemini 3.1 flash tts 的常見問題

如何選擇 gemini-3.1-flash-tts?

傳入 quickstart 顯示的 model ID。

這個 variant 的速率限制是多少?

每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。

之後可以切換 variant 嗎?

可以——variant 只是旗標。只要變更 model 參數即可切換。

它支援串流嗎?

只要支援串流,RunAPI 就會端到端串流。

我該在哪裡回報品質問題?

請在公開 GitHub repo 提交 issue,或寄信給支援。

正在與團隊一起打造?

我們可以協助企業接入、整合與技術問題。

聯絡我們