Jedno uwierzytelnienie, wszyscy providerzy
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
It looks like you may prefer a different language. Switch anytime.
Korzystaj z API Fish Audio przez RunAPI z model skillem, wspólnym uwierzytelnianiem i cennikiem pay-as-you-go.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Zamień tę krótką narrację dokumentalną na ekspresyjną, naturalną mowę o równym tempie."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Zamień tę krótką narrację dokumentalną na ekspresyjną, naturalną mowę o równym tempie.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Zamień tę krótką narrację dokumentalną na ekspresyjną, naturalną mowę o równym tempie."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio zamienia tekst na mowę przez synchroniczny endpoint RunAPI. Wybierz s1 do ekspresyjnych nagrań albo s2.1-pro jako zalecany model produkcyjny z 83 językami i naturalnym sterowaniem ekspresją. s2-pro pozostaje dostępną opcją poprzedniej generacji.
| Endpoint | Rozdzielczość | Czas trwania | Cena | |
|---|---|---|---|---|
| text_to_speech | — | — | $0.02 / 1K UTF-8 bytes |
Ceny podane dla s1. Pozostałe warianty mają własne cenniki endpointów.
Wspólne endpointy dla tej linii modeli, takie jak rozszerzanie, ulepszanie lub konwersja.
Wybierz model i wariant pasujące do typu wyjścia, progu jakości i celu opóźnienia.
Ustaw klucz RunAPI i zainstaluj model skill w workspace kodu.
Użyj instrukcji skilla, aby dodać funkcję modelu w swojej aplikacji.
Odpytuj po task ID, streamuj gdy wspierane albo obsłuż callback webhook.
Fish Audio oferuje modele syntezy mowy do ekspresyjnych dialogów i niezawodnych procesów produkcji nagrań głosowych. RunAPI weryfikuje każdy wynik i zwraca zarządzany adres URL pliku MP3 wraz z metadanymi audio.
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
Rozliczanie za wywołanie w USD, fakturowane co miesiąc. Nieudane generacje nie są naliczane.
Typowane schematy i notatki setupu są spakowane w model skill, więc implementacja startuje od właściwego kontraktu.
s1 służy do ekspresyjnej mowy. s2.1-pro jest zalecany do produkcji, obsługuje 83 języki i sterowanie ekspresją; s2-pro pozostaje opcją poprzedniej generacji.
Domyślnym formatem jest MP3, a opcjonalnie można wybrać WAV. Odpowiedź RunAPI zawiera prawidłowy format, typ MIME i rozmiar w bajtach.
Tak. Utwórz głos należący do konta i używaj jego RunAPI voice_id w kolejnych żądaniach zamiany tekstu na mowę. Aby wpłynąć tylko na bieżące żądanie, przekaż przez references dźwięk base64 z dokładnym transkryptem.
Tak. RunAPI weryfikuje i zapisuje wynik, zanim zwróci zarządzany adres URL pliku audio.
Nie. Endpoint działa synchronicznie i zwraca gotowy wynik audio w odpowiedzi na pomyślne żądanie.
Wybierz najtańszy wariant, który spełnia Twoje wymagania jakościowe. Większość zespołów zaczyna od szybkiego wariantu, a do produkcji przechodzi na pro.