Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
텍스트 음성 변환, 음성 복제, 전사, 음향 효과를 ElevenLabs, Fish Audio, Google 공개 오디오 카탈로그에서 제공합니다.
예시
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
모든 TTS 및 음성 모델에 하나의 키를 사용합니다.
지원되는 오디오 모델에서 사용할 수 있는 음성을 찾아보세요.
텍스트와 선택한 음성을 /api/v1/elevenlabs/text_to_speech로 전송합니다.
작업 결과에서 생성된 오디오를 받습니다.
여러 API 키를 번갈아 관리하지 마세요. 하나의 통합으로 모든 제공업체의 200개 이상 모델을 이용할 수 있습니다.
제공업체와의 대량 계약으로 직접 이용하는 것보다 낮은 가격을 추가 인상 없이 제공합니다.
제공업체에 장애가 발생하면 다음으로 적합한 선택지로 라우팅합니다. 앱은 계속 실행됩니다.
OpenAI SDK를 바로 대체할 수 있습니다. 코드 한 줄만 바꾸면 모든 모델에 접근할 수 있습니다.
사용한 만큼만 지불하세요. 최소 금액 없이 요청 단위로 청구하고 모델과 프로젝트별 비용을 추적합니다.
RunAPI API 키로 오디오 API 요청을 인증하세요.
스트리밍 TTS를 LLM 및 전사와 결합해 하나의 키로 완전 양방향 음성 루프를 구축합니다.
기존 영상을 알아볼 수 있는 클론 음성으로 새로운 언어에 더빙합니다.
화자 라벨과 함께 전사한 다음 같은 파이프라인의 LLM 엔드포인트로 요약합니다.
녹음 세션 없이 기사, 문서 및 앱 콘텐츠에 내레이션을 추가합니다.
| 기능 | RunAPI | ElevenLabs 직접 사용 | OpenAI TTS |
|---|---|---|---|
| 음성 모델 | 32개 오디오 모델 | 1개 제공업체 | 6개 음성 |
| 가격 | $0.12 / minute부터 | 공식 요금 | 공식 요금 |
| 실시간 스트리밍 | 지원 | 지원 | 미지원 |
| 통합 청구 | 지원 | 미지원 | 미지원 |
| MCP 서버 | 지원 | 미지원 | 미지원 |
| 제공업체 장애 조치 | 지원 | 미지원 | 미지원 |
입력 텍스트 1,000자당 해당 모델 요금으로 과금됩니다. 음성 인식은 오디오 1분당 과금됩니다.
가능합니다. 참조 샘플을 업로드하여 voice id를 생성한 뒤, 이후 요청에 해당 id를 전달하면 됩니다.
스트리밍 지원 여부는 선택한 엔드포인트에 따라 다릅니다. 재생 기능을 통합하기 전에 문서의 응답 형식을 확인하세요.
지원 언어는 모델마다 다릅니다. 선택한 모델의 문서에서 지원 언어를 확인하세요.
요청 및 응답 내용이 보관될 수 있습니다. 데이터 처리에 관한 자세한 내용은 개인정보 처리방침을 확인하세요.
타임스탬프 지원 여부와 단위는 선택한 전사 엔드포인트에 따라 다릅니다. 문서의 응답 필드를 확인하세요. 화자 레이블은 별도 기능입니다.