OpenAI TTS API
OpenAI TTS API 提供低延迟与高质量文本转语音,并返回 RunAPI 托管的 MP3。
curl -X POST https://runapi.ai/api/v1/openai_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "tts-1-hd",
"text": "将这段产品引导文案转换为清晰、自然的语音,用于应用内操作介绍。"
}'
import { OpenaiTtsClient } from "@runapi.ai/openai-tts";
const client = new OpenaiTtsClient();
const result = await client.textToSpeech.run({
model: "tts-1-hd",
text: "将这段产品引导文案转换为清晰、自然的语音,用于应用内操作介绍。",
});
require "runapi/openai_tts"
client = RunApi::OpenaiTts::Client.new
result = client.text_to_speech.run(
model: "tts-1-hd",
text: "将这段产品引导文案转换为清晰、自然的语音,用于应用内操作介绍。"
)
npx skills add runapi-ai/openai-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OpenAI TTS 通过同步 RunAPI 端点将文本转换为语音。延迟敏感的应用可选择 tts-1,高保真旁白可选择 tts-1-hd;两者都会返回托管 MP3 URL。
- 多变体覆盖不同速度/质量层级
- Model skill 包含文档、schema 和接入说明
- 适合面向应用的编码工作流
- 失败的生成不计费
对比全部 API 变体
为应用开发安装 OpenAI TTS skill
把模型文档、schema、定价说明和接入步骤加载进代码工作区。
# Install the model skill for app development workflows
npx skills add runapi-ai/openai-tts -g
Install the OpenAI TTS skill for this app: 1. Add runapi-ai/openai-tts with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
四步从 model skill 到首次结果
选择模型
根据输出类型、质量要求和延迟目标选择模型与变体。
配置
设置 RunAPI key,并在代码工作区安装对应 model skill。
调用
按 skill 里的说明,把模型能力接入到你的应用里。
接收
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
OpenAI TTS API 是什么?
OpenAI TTS 为交互式播放与精细旁白提供专用文本转语音模型。通过 RunAPI,两个变体共享同一请求结构,并返回托管音频元数据。
为什么用 RunAPI 调用 OpenAI TTS API
一把认证,覆盖所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
统一的定价与账单
USD 按次定价,按月结算。失败的生成不计费。
Schema 优先的 SDK
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
常见问题
tts-1 和 tts-1-hd 有什么区别?
tts-1 优先降低交互式播放的延迟,tts-1-hd 则优先提升旁白和成品内容的音频质量。
OpenAI TTS 返回什么音频格式?
两个变体都返回 MP3,并在 RunAPI 响应中包含格式、MIME 类型与字节大小元数据。
生成的音频由 RunAPI 托管吗?
是。RunAPI 会校验音频并返回托管 URL,不会暴露临时来源 URL。
可以选择自定义音色或语速吗?
初版端点使用已公开的默认音色和语速,自定义音色与语速不属于当前端点合同。
文本转语音是同步请求吗?
是。请求成功后会直接返回已完成的音频结果,无需单独轮询。
应该从哪个变体开始?
选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。
有免费额度吗?
新账户每个模型都有免费调用额度,之后按次计费。
支持流式吗?
模型支持流式时,RunAPI 端到端流式。
失败怎么计费?
失败的生成不计费。
输出会缓存吗?
输出按任务 ID 存储在 R2 供回取。输入不缓存。
可以商用吗?
可以——所有变体默认含商用许可,除非模型许可明确限制;有例外会在变体页面注明。
速率限制?
Key 级限流随使用层级伸缩。当前限制见定价页。
在哪里报问题?
在公共 GitHub 仓库提 issue 或邮件联系 support。