彈性參數
可設定 5 個已記錄的參數,包括 dialogue_turns, sample_context, scene, speakers, temperature。
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-tts",
"text": "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-3.1-flash-tts",
text: "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。",
});
import os
import requests
response = requests.post(
"https://runapi.ai/api/v1/gemini_tts/text_to_speech",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gemini-3.1-flash-tts","text":"生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/api/v1/gemini_tts/text_to_speech");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gemini-3.1-flash-tts',
'text' => '生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.textToSpeech().run({"model":"gemini-3.1-flash-tts","text":"生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"});
task.waitForResult();
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-3.1-flash-tts",
text: "生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.textToSpeech.Run({"model":"gemini-3.1-flash-tts","text":"生成一段雙人 Podcast 開場白,由沉穩的英國主持人和充滿活力的美國來賓對談。"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gemini-3.1-flash-tts \
--endpoint text_to_speech \
--wait
2 個版本可用
選擇任一模型,幾秒內即可開始生成。
選擇任一模型,幾秒內即可開始生成。
| 提供者 | |
| 模型 ID | gemini-3.1-flash-tts |
| 模態 | Audio & Music |
| 任務類型 | Asynchronous |
| API 端點 | /api/v1/gemini_tts/text_to_speech |
| 計費單位 | 1K tokens |
| 輸入參數 | callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature |
| 目錄狀態 | 可直接上線 |
免費註冊後,從控制台建立 gemini-3.1-flash-tts 的 API 金鑰。
向 /api/v1/gemini_tts/text_to_speech 傳送 POST 請求,並傳入 gemini-3.1-flash-tts 模型 ID 與參數。
輪詢工作或依照回呼取得已完成的 gemini-3.1-flash-tts 結果。
可設定 5 個已記錄的參數,包括 dialogue_turns, sample_context, scene, speakers, temperature。
公開 1 個公共 endpoint:text_to_speech。
非同步任務接受回呼 URL 以接收完成通知。
依 1K tokens 計量,無需訂閱。
sceneScene and recording environment.
speakersNon-empty speaker configurations with unique Speaker N identifiers.
temperatureSampling temperature.
callback_urlWebhook URL for async notifications.
dialogue_turnsNon-empty ordered dialogue turns whose speaker ids reference configured speakers.
sample_contextOverall delivery context and tone.
依照單集情緒生成免版稅背景音樂,無需支付授權費。
為程序化生成的關卡產生可自適應的環境音景與效果音。
無需錄音室即可為客戶廣告製作客製化旁白與音效。
傳入 quickstart 顯示的 model ID。
每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。
可以——variant 只是旗標。只要變更 model 參數即可切換。
只要支援串流,RunAPI 就會端到端串流。
請在公開 GitHub repo 提交 issue,或寄信給支援。