하나의 API key
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
It looks like you may prefer a different language. Switch anytime.
RunAPI를 통해 모델 스킬, 통합 인증, 종량제 요금으로 Gemini TTS API를 사용하세요.
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-tts",
"text": "차분한 영국인 진행자와 활기찬 미국인 게스트가 등장하는 2인 팟캐스트 오프닝을 만들어 주세요."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-3.1-flash-tts",
text: "차분한 영국인 진행자와 활기찬 미국인 게스트가 등장하는 2인 팟캐스트 오프닝을 만들어 주세요.",
});
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-3.1-flash-tts",
text: "차분한 영국인 진행자와 활기찬 미국인 게스트가 등장하는 2인 팟캐스트 오프닝을 만들어 주세요."
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Gemini TTS는 정해진 순서의 대화를 음성으로 변환하면서 화자별 음성 설정을 따로 유지합니다. 요청에는 장면, 전반적인 말하기 지침, 샘플링 온도도 지정할 수 있습니다.
| endpoint | 해상도 | 길이 | 가격 | |
|---|---|---|---|---|
| text_to_speech | — | — | Input $1.40 / 1M tokens | Output $28.00 / 1M tokens |
gemini-2.5-pro-tts 기준 요금입니다. 다른 변형은 각자의 endpoint 요금이 적용됩니다.
출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.
모든 지원 모델에 RunAPI key를 사용합니다.
기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.
task ID로 조회하거나 생성 완료 시 callback을 처리합니다.
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.
호출 전에 사용량 기반 가격을 확인할 수 있습니다.
RunAPI는 Gemini 2.5 Pro TTS와 Gemini 3.1 Flash TTS를 동일한 텍스트 음성 변환(TTS) 엔드포인트와 요청 형식으로 지원합니다.
참여자마다 고유한 `Speaker N` 식별자로 화자 설정을 추가한 다음, 각 발화를 해당 식별자 중 하나에 지정하세요.
화자마다 음성, 억양, 말하기 스타일, 속도를 지정할 수 있고, 세부 음성 지침이 필요하면 오디오 프로필도 선택적으로 사용할 수 있습니다.
장면은 녹음 환경을 설명하고, 샘플 컨텍스트는 대화 전반의 어조와 말하기 지침을 정합니다.
작업을 조회하거나 완료된 뒤 콜백으로 결과를 받으세요. 응답의 `audios` 목록에 생성된 파일 URL이 포함됩니다.
model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.