Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
通过公开音频目录使用文本转语音、声音克隆、转写和音效能力。 ElevenLabs, Fish Audio, Google
示例
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
一个密钥即可使用所有 TTS 和声音模型。
浏览受支持音频模型中的可用声音。
将文本和声音选择发送到 /api/v1/elevenlabs/text_to_speech。
从任务结果中接收生成的音频。
无需再管理多组 API 密钥。一次集成即可访问所有提供商的 200 多个模型。
我们与提供商的批量协议带来低于直接采购的价格,且不额外加价。
提供商发生故障时,我们会将请求路由到下一个最佳选项,让你的应用持续运行。
可直接替换 OpenAI SDK。只需修改一行代码即可访问任意模型。
只为实际使用付费。按请求计价、没有最低消费,并可按模型和项目追踪成本。
使用你的 RunAPI API key 验证音频 API 请求。
将流式 TTS 与 LLM 和转写结合,用一个密钥构建全双工语音循环。
用辨识度稳定的克隆声音,将现有视频配音为新的语言。
使用说话人标签进行转写,再通过同一流程中的 LLM 端点生成摘要。
无需录音,为文章、文档和应用内内容添加旁白。
| 功能 | RunAPI | 直接使用 ElevenLabs | OpenAI TTS |
|---|---|---|---|
| 声音模型 | 32 个音频模型 | 1 个提供商 | 6 个声音 |
| 价格 | 低至 $0.12 / minute | 官方价格 | 官方价格 |
| 实时流式传输 | 支持 | 支持 | 不支持 |
| 统一计费 | 支持 | 不支持 | 不支持 |
| MCP 服务器 | 支持 | 不支持 | 不支持 |
| 提供商故障切换 | 支持 | 不支持 | 不支持 |
按输入文本每 1,000 个字符以模型单价计费。转录按音频分钟数计费。
可以。上传参考音频样本以创建 voice id,之后的请求中传入该 id 即可。
是否支持流式输出取决于所选端点。集成播放功能前,请查看文档中的响应格式。
支持的语言因模型而异,请查看所选模型文档中的语言说明。
请求和响应内容可能会被保留。数据处理详情请参阅隐私政策。
时间戳支持情况及粒度取决于所选转写端点,请查看文档中的响应字段;说话人标签属于单独的能力。