오디오 API

AI 오디오 및 음성 API

텍스트 음성 변환, 음성 복제, 전사, 음향 효과를 ElevenLabs, Fish Audio, Google 공개 오디오 카탈로그에서 제공합니다.

32 오디오 모델 · 공개 오디오 엔드포인트
32
오디오 모델
6
제공업체
89
공개 엔드포인트
플레이그라운드 실시간
모델
텍스트
다음 오디오 생성을 여기서 시작하세요. 공개 모델을 선택하면 현재 가격과 엔드포인트 세부 정보를 확인할 수 있습니다.
음성 기본 음성
형식 mp3
속도 1.0x
모드 text_to_speech

예시

음성을 직접 들어보세요

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

오디오 endpoint가 할 수 있는 모든 것

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
빠른 시작

음성 합성

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
사용 방법

첫 생성까지 4단계

  1. API 키 받기

    모든 TTS 및 음성 모델에 하나의 키를 사용합니다.

  2. 음성 선택

    지원되는 오디오 모델에서 사용할 수 있는 음성을 찾아보세요.

  3. 텍스트 보내기

    텍스트와 선택한 음성을 /api/v1/elevenlabs/text_to_speech로 전송합니다.

  4. 오디오 받기

    작업 결과에서 생성된 오디오를 받습니다.

개발자가 RunAPI를 선택하는 이유

하나의 키, 모든 모델

여러 API 키를 번갈아 관리하지 마세요. 하나의 통합으로 모든 제공업체의 200개 이상 모델을 이용할 수 있습니다.

15-25% 비용 절감

제공업체와의 대량 계약으로 직접 이용하는 것보다 낮은 가격을 추가 인상 없이 제공합니다.

자동 장애 조치

제공업체에 장애가 발생하면 다음으로 적합한 선택지로 라우팅합니다. 앱은 계속 실행됩니다.

OpenAI 호환

OpenAI SDK를 바로 대체할 수 있습니다. 코드 한 줄만 바꾸면 모든 모델에 접근할 수 있습니다.

실시간 청구

사용한 만큼만 지불하세요. 최소 금액 없이 요청 단위로 청구하고 모델과 프로젝트별 비용을 추적합니다.

API 키 인증

RunAPI API 키로 오디오 API 요청을 인증하세요.

팀이 이것으로 만드는 것

음성 에이전트

스트리밍 TTS를 LLM 및 전사와 결합해 하나의 키로 완전 양방향 음성 루프를 구축합니다.

현지화

기존 영상을 알아볼 수 있는 클론 음성으로 새로운 언어에 더빙합니다.

회의 메모

화자 라벨과 함께 전사한 다음 같은 파이프라인의 LLM 엔드포인트로 요약합니다.

접근성

녹음 세션 없이 기사, 문서 및 앱 콘텐츠에 내레이션을 추가합니다.

RunAPI와 대안 비교

기능 RunAPI ElevenLabs 직접 사용 OpenAI TTS
음성 모델 32개 오디오 모델 1개 제공업체 6개 음성
가격 $0.12 / minute부터 공식 요금 공식 요금
실시간 스트리밍 지원 지원 미지원
통합 청구 지원 미지원 미지원
MCP 서버 지원 미지원 미지원
제공업체 장애 조치 지원 미지원 미지원

Audio API 자주 묻는 질문

TTS는 어떻게 과금되나요?

입력 텍스트 1,000자당 해당 모델 요금으로 과금됩니다. 음성 인식은 오디오 1분당 과금됩니다.

음성 복제가 가능한가요?

가능합니다. 참조 샘플을 업로드하여 voice id를 생성한 뒤, 이후 요청에 해당 id를 전달하면 됩니다.

스트리밍을 지원하나요?

스트리밍 지원 여부는 선택한 엔드포인트에 따라 다릅니다. 재생 기능을 통합하기 전에 문서의 응답 형식을 확인하세요.

지원되는 언어는 어떻게 되나요?

지원 언어는 모델마다 다릅니다. 선택한 모델의 문서에서 지원 언어를 확인하세요.

오디오나 음성 샘플이 저장되나요?

요청 및 응답 내용이 보관될 수 있습니다. 데이터 처리에 관한 자세한 내용은 개인정보 처리방침을 확인하세요.

단어 단위 타임스탬프를 받을 수 있나요?

타임스탬프 지원 여부와 단위는 선택한 전사 엔드포인트에 따라 다릅니다. 문서의 응답 필드를 확인하세요. 화자 레이블은 별도 기능입니다.

제품에 목소리를 더하세요

하나의 키로 음성 합성, 복제, 음성 인식까지. 신용카드 없이 무료로 시작하세요.

로그인 후 생성

API 키를 만들어 계정에서 오디오 요청을 실행하세요.