It looks like you may prefer a different language. Switch anytime.

Audio & Music Fish Audio

Fish Audio API

RunAPI를 통해 모델 스킬, 통합 인증, 종량제 요금으로 Fish Audio API를 사용하세요.

runapi.ai
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "s1",
  "text": "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";

const client = new FishAudioClient();
const result = await client.textToSpeech.run({
    model: "s1",
    text: "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요.",
});
require "runapi/fish_audio"

client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
    model: "s1",
    text: "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/fish-audio v1
개요

Fish Audio 소개

Fish Audio는 RunAPI의 동기식 엔드포인트에서 텍스트를 음성으로 변환합니다. 표현력 있는 음성에는 s1을, 83개 언어와 자연어 표현 제어를 지원하는 프로덕션 권장 모델에는 s2.1-pro를 선택하세요. s2-pro도 이전 세대 옵션으로 계속 사용할 수 있습니다.

제공사
Fish Audio
모달리티
Audio & Music

변형

변형 과금 요금
s1 1K UTF-8 bytes $0.020 보기 →
s2-pro 1K UTF-8 bytes $0.020 보기 →
s2.1-pro 1K UTF-8 bytes $0.020 보기 →
요금

Fish Audio 요금

endpoint 해상도 길이 가격
text_to_speech $0.02 / 1K UTF-8 bytes

s1 기준 요금입니다. 다른 변형은 각자의 endpoint 요금이 적용됩니다.

요금

유틸리티 endpoint

확장, 향상, 변환 등 이 모델 라인의 공용 endpoint입니다.

List voices
Free / request
Create voice
Free / track
Get voice
Free / request
에이전트 통합

에이전트에서 Fish Audio 실행

작동 방식

Fish Audio 시작하기

  1. 모델 선택

    출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.

  2. 한 번 인증

    모든 지원 모델에 RunAPI key를 사용합니다.

  3. skill 설치

    기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.

  4. 결과 받기

    task ID로 조회하거나 생성 완료 시 callback을 처리합니다.

컨텍스트

Fish Audio의 위치

Fish Audio는 표현력 있는 대화와 안정적인 프로덕션 음성 워크플로에 특화된 텍스트 음성 변환(TTS) 모델을 제공합니다. RunAPI는 결과를 검증한 뒤 오디오 메타데이터와 함께 RunAPI가 관리하는 MP3 URL을 반환합니다.

제공사
Fish Audio
모두 보기 →
모달리티
Audio & Music
모델 보기 →

RunAPI로 Fish Audio을 쓰는 이유

하나의 API key

모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.

Skill-ready

model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.

예측 가능한 과금

호출 전에 사용량 기반 가격을 확인할 수 있습니다.

Fish Audio FAQ

s1, s2-pro, s2.1-pro의 차이점은 무엇인가요?

s1은 표현력 있는 대화와 내레이션에 적합합니다. s2.1-pro는 83개 언어와 자연어 표현 제어를 지원하는 프로덕션 권장 모델이며, s2-pro도 이전 세대 옵션으로 계속 사용할 수 있습니다.

Fish Audio는 어떤 오디오 형식을 반환하나요?

기본 형식은 MP3이며 WAV도 선택할 수 있습니다. RunAPI 응답에는 실제 형식, MIME 유형, 바이트 크기가 포함됩니다.

참조 샘플로 음성을 유도할 수 있나요?

반환된 RunAPI voice_id를 이후 텍스트 음성 변환 요청에서 사용해 볼 수 있지만 가용성은 보장되지 않습니다. 현재 요청에만 적용하려면 references로 base64 오디오와 정확한 스크립트를 전달하세요.

생성된 오디오는 RunAPI에서 호스팅하나요?

네. RunAPI는 결과를 검증해 저장한 뒤 RunAPI가 관리하는 오디오 URL을 반환합니다.

완료될 때까지 폴링해야 하나요?

아니요. 이 엔드포인트는 동기식이며 요청이 성공하면 완성된 오디오를 바로 반환합니다.

이 모델은 어떻게 호출하나요?

model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.

유사 모델

Fish Audio와 비슷한 모델

Fish Audio로 개발을 시작하세요.