Audio & Music · Fish Audio

Fish Audio API

RunAPI에서 Fish Audio 텍스트 음성 변환(TTS) API를 사용하세요. 표현력 있는 다국어 음성을 프로덕션 수준으로 합성하고, 결과는 RunAPI가 관리하는 MP3로 반환합니다.

운영 중 · 3 variants · 최저 $0.0000
runapi.ai
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "s1",
  "text": "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";

const client = new FishAudioClient();
const result = await client.textToSpeech.run({
    model: "s1",
    text: "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요.",
});
require "runapi/fish_audio"

client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
    model: "s1",
    text: "이 짧은 다큐멘터리 내레이션을 일정한 말하기 속도와 자연스럽고 풍부한 감정 표현을 갖춘 음성으로 변환하세요."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/fish-audio v1
개요

Fish Audio는 RunAPI의 동기식 엔드포인트에서 텍스트를 음성으로 변환합니다. 표현력 있는 음성에는 s1을, 83개 언어와 자연어 표현 제어를 지원하는 프로덕션 권장 모델에는 s2.1-pro를 선택하세요. s2-pro도 이전 세대 옵션으로 계속 사용할 수 있습니다.

  • 품질과 지연 시간 목표에 맞춘 모델 변형
  • 통합 API key
  • Model skill에 docs, schema, 설정 메모 포함
  • 실패한 생성은 과금되지 않습니다
변형

변형

Variant Billing Pricing
s1 1K UTF-8 bytes $0.020 보기 →
s2-pro 1K UTF-8 bytes $0.020 보기 →
s2.1-pro 1K UTF-8 bytes $0.020 보기 →
요금

Utility endpoints

Shared endpoints for this model line, such as extension, enhancement, or conversion actions.

List voices
Free / request
Create voice
Free / track
Get voice
Free / request
MODELS

앱 개발을 위해 Fish Audio skill 설치

모델 docs, schema, 가격 메모, 설정 단계를 코딩 워크스페이스로 불러옵니다.

# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Fish Audio skill for this app:

1. Add runapi-ai/fish-audio with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
작동 방식

이 model skill로 구현하는 방법

01

모델 선택

출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.

02

한 번 인증

모든 지원 모델에 RunAPI key를 사용합니다.

03

skill 설치

기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.

04

결과 받기

task ID로 조회하거나 생성 완료 시 callback을 처리합니다.

컨텍스트

Fish Audio의 위치

Fish Audio는 표현력 있는 대화와 안정적인 프로덕션 음성 워크플로에 특화된 텍스트 음성 변환(TTS) 모델을 제공합니다. RunAPI는 결과를 검증한 뒤 오디오 메타데이터와 함께 RunAPI가 관리하는 MP3 URL을 반환합니다.

Provider
Fish Audio
Modality
Audio & Music
RUNAPI를 선택하는 이유

RunAPI로 Fish Audio을 쓰는 이유

하나의 API key

모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.

Skill-ready

model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.

예측 가능한 과금

호출 전에 사용량 기반 가격을 확인할 수 있습니다.

FAQ

자주 묻는 질문

s1, s2-pro, s2.1-pro의 차이점은 무엇인가요?

s1은 표현력 있는 대화와 내레이션에 적합합니다. s2.1-pro는 83개 언어와 자연어 표현 제어를 지원하는 프로덕션 권장 모델이며, s2-pro도 이전 세대 옵션으로 계속 사용할 수 있습니다.

Fish Audio는 어떤 오디오 형식을 반환하나요?

기본 형식은 MP3이며 WAV도 선택할 수 있습니다. RunAPI 응답에는 실제 형식, MIME 유형, 바이트 크기가 포함됩니다.

참조 샘플로 음성을 유도할 수 있나요?

반환된 RunAPI voice_id를 이후 텍스트 음성 변환 요청에서 사용해 볼 수 있지만 가용성은 보장되지 않습니다. 현재 요청에만 적용하려면 references로 base64 오디오와 정확한 스크립트를 전달하세요.

생성된 오디오는 RunAPI에서 호스팅하나요?

네. RunAPI는 결과를 검증해 저장한 뒤 RunAPI가 관리하는 오디오 URL을 반환합니다.

완료될 때까지 폴링해야 하나요?

아니요. 이 엔드포인트는 동기식이며 요청이 성공하면 완성된 오디오를 바로 반환합니다.

이 모델은 어떻게 호출하나요?

model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.

실패한 생성도 비용이 드나요?

실패한 생성은 과금되지 않습니다

애플리케이션에서 호출할 수 있나요?

네. 코딩 워크스페이스에 model skill을 설치하고 모델 기능을 추가할 때 사용하세요.

지금 시작

Fish Audio로 개발을 시작하세요.