靈活的參數
可設定 5 個已記錄的參數,包括 dialogue_turns, sample_context, scene, speakers, temperature。
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-pro-tts",
"text": "生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。"
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-2.5-pro-tts",
text: "生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。",
});
import os
import requests
response = requests.post(
"https://runapi.ai/api/v1/gemini_tts/text_to_speech",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gemini-2.5-pro-tts","text":"生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/api/v1/gemini_tts/text_to_speech");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gemini-2.5-pro-tts',
'text' => '生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.textToSpeech().run({"model":"gemini-2.5-pro-tts","text":"生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。"});
task.waitForResult();
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-2.5-pro-tts",
text: "生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.textToSpeech.Run({"model":"gemini-2.5-pro-tts","text":"生成一段雙講者 podcast 開場,由語氣沉穩嘅英國主持同充滿活力嘅美國嘉賓對談。"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gemini-2.5-pro-tts \
--endpoint text_to_speech \
--wait
2 個版本可用
選擇任意模型,數秒內即可開始生成。
選擇任意模型,數秒內即可開始生成。
| 提供者 | |
| 模型 ID | gemini-2.5-pro-tts |
| 模態 | Audio & Music |
| 任務類型 | Asynchronous |
| API 端點 | /api/v1/gemini_tts/text_to_speech |
| 計費單位 | 1K tokens |
| 輸入參數 | callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature |
| 目錄狀態 | 可正常運作 |
免費註冊後,在控制台建立 gemini-2.5-pro-tts 的 API 金鑰。
向 /api/v1/gemini_tts/text_to_speech 發送 POST 請求,並傳入 gemini-2.5-pro-tts 模型 ID 和參數。
輪詢工作或按照回呼取得已完成的 gemini-2.5-pro-tts 結果。
可設定 5 個已記錄的參數,包括 dialogue_turns, sample_context, scene, speakers, temperature。
開放 1 個公開 endpoint:text_to_speech。
非同步任務接受回調 URL,用於接收完成通知。
按 1K tokens 計量,無需訂閱。
sceneScene and recording environment.
speakersNon-empty speaker configurations with unique Speaker N identifiers.
temperatureSampling temperature.
callback_urlWebhook URL for async notifications.
dialogue_turnsNon-empty ordered dialogue turns whose speaker ids reference configured speakers.
sample_contextOverall delivery context and tone.
生成同集數氛圍匹配的免版稅背景音樂,無需付授權費。
為程序生成關卡製作可自適應的環境音景同音效。
無需錄音室,都可以為客戶廣告生成自訂旁白同音效。
傳入 quickstart 顯示嘅 model ID。
每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。
可以——variant 只係一個旗標。只要更改 model 參數就可以切換。
在可用 streaming 的情況下,RunAPI 會端到端串流。
可以在公開 GitHub repo 開 issue,或者電郵支援團隊。