音訊 API

AI 音訊與語音 API

透過公開音訊目錄使用文字轉語音、聲音克隆、轉錄與音效功能。 ElevenLabs, Fish Audio, Google

32 個音訊模型 · 個公開音訊端點
32
音訊模型
6
供應商
89
公開端點
線上試用 即時
模型
文字
從這裡開始下一次音訊生成。選擇公開模型,查看目前價格與端點詳細資訊。
聲音 預設聲音
格式 mp3
速度 1.0x
模式 text_to_speech

範例

聆聽聲音

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

音訊 endpoint 的所有功能

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
快速開始

合成語音

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
使用方式

生成首段音訊的四個步驟

  1. 取得 API 金鑰

    一個金鑰即可使用所有 TTS 和聲音模型。

  2. 選擇聲音

    瀏覽支援的音訊模型中的可用聲音。

  3. 傳送文字

    將文字和聲音選擇傳送到 /api/v1/elevenlabs/text_to_speech。

  4. 取得音訊

    從工作結果接收生成的音訊。

開發者選擇 RunAPI 的理由

一個金鑰,所有模型

不用再管理多組 API 金鑰。一次整合即可存取所有提供商的 200 多個模型。

節省 15-25% 成本

我們與提供商的批量協議帶來低於直接採購的價格,且不額外加價。

自動故障切換

提供商發生故障時,我們會將請求路由到下一個最佳選項,讓你的應用程式持續運作。

相容 OpenAI

可直接取代 OpenAI SDK。只需修改一行程式碼即可存取任何模型。

即時計費

只為實際使用付費。按請求計價、沒有最低消費,並可按模型和專案追蹤成本。

API Key 身分驗證

使用你的 RunAPI API key 驗證音訊 API 請求。

團隊用它打造的內容

語音代理

將串流 TTS 與 LLM 及轉錄結合,用一個金鑰打造全雙工語音循環。

在地化

以辨識度穩定的克隆聲音,將現有影片配音成新語言。

會議筆記

使用說話者標籤進行轉錄,再透過同一流程中的 LLM 端點製作摘要。

無障礙

無需錄音,為文章、文件與應用程式內內容加入旁白。

RunAPI 與替代方案

功能 RunAPI 直接使用 ElevenLabs OpenAI TTS
聲音模型 32 個音訊模型 1 個供應商 6 個聲音
價格 低至 $0.12 / minute 官方價格 官方價格
即時串流 支援 支援 不支援
統一計費 支援 不支援 不支援
MCP 伺服器 支援 不支援 不支援
供應商故障切換 支援 不支援 不支援

Audio API 常見問題

TTS 如何計費?

依模型費率,按輸入文字每 1,000 個字元計費。轉錄則按每分鐘音訊計費。

我可以複製聲音嗎?

可以。上傳參考樣本以建立 voice id,之後的任何請求都可傳入該 id。

支援串流嗎?

是否支援串流取決於所選端點。整合播放功能前,請查看文件中的回應格式。

支援哪些語言?

支援的語言因模型而異,請查看所選模型文件中的語言說明。

你們會保留音訊或聲音樣本嗎?

請求與回應內容可能會被保留。資料處理詳情請參閱隱私權政策。

我可以取得字詞層級的時間戳記嗎?

時間戳記支援情況及粒度取決於所選轉錄端點,請查看文件中的回應欄位;說話者標籤屬於另一項功能。

為你的產品賦予聲音

透過一把 key 即可使用語音、複製和轉錄功能。免費開始,無需信用卡。

登入後生成

建立 API 金鑰,透過帳戶執行音訊請求。