Fish Audio · Audio i muzyka

OpenClaw x Fish Audio

Fish Audio oferuje modele syntezy mowy do ekspresyjnych dialogów i niezawodnych procesów produkcji nagrań głosowych. RunAPI weryfikuje każdy wynik i zwraca zarządzany adres URL pliku MP3 wraz z metadanymi audio.

3 variants od $0.02 / 1 tys. bajtów UTF-8 Do użytku komercyjnego

Prerequisite: npx runapi mcp install

Prompt

Modele promptów

Użyj s1, gdy pasuje do zadania: Ekspresyjna mowa w wielu językach do dialogów i narracji.

You have access to RunAPI task tools for Fish Audio.

Available Fish Audio models:
- s1: Ekspresyjna mowa w wielu językach do dialogów i narracji
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2-pro: Naturalna mowa poprzedniej generacji do istniejących przepływów produkcyjnych
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2.1-pro: Zalecany model produkcyjny z 83 językami i naturalnym sterowaniem ekspresją
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text

Use the model ID and endpoint that match the user's request.
Example prompt: Zamień tę krótką narrację dokumentalną na ekspresyjną, naturalną mowę o równym tempie.
/api/v1/fish_audio/text_to_speech: Submit the request and verify the synchronous output. Wyślij POST do /api/v1/fish_audio/text_to_speech. Sprawdź, czy synchroniczna odpowiedź jest zgodna z dokumentacją API endpointu.

Publiczne wersje i endpointy

ID modelu Endpointy Cena początkowa Katalog
s1
/api/v1/fish_audio/text_to_speech
$0.02 / 1 tys. bajtów UTF-8 Szczegóły modelu
s2-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1 tys. bajtów UTF-8 Szczegóły modelu
s2.1-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1 tys. bajtów UTF-8 Szczegóły modelu

Weryfikacja

Odpytywanie do momentu osiągnięcia przez Task stanu końcowego

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.

Dodatkowe operacje

Te operacje nie używają ID modelu.

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice
Jak to działa

Zacznij w 3 krokach

  1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. Skonfiguruj RunAPI

    Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.

  3. Zweryfikuj wynik

    Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.

Co możesz zbudować za pomocą OpenClaw + Fish Audio

  • Lektor i narracja

    Zamieniaj scenariusze na mówione audio do filmów, kursów i demonstracji produktów za pomocą modeli generujących mowę.

  • Muzyka i ścieżki dźwiękowe

    Twórz podkłady muzyczne i dżingle na podstawie opisu gatunku, nastroju i tempa za pomocą modeli generujących muzykę.

  • Transkrypcja i przetwarzanie audio

    Transkrybuj nagrania albo oczyszczaj i przekształcaj istniejące audio za pomocą modeli, które przyjmują audio na wejściu.

Dlaczego warto używać Fish Audio przez RunAPI + OpenClaw

  • 3 wariantów, jeden klucz API

    Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.

  • Przejrzyste ceny użycia

    Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.

  • Bezpośrednie odpowiedzi

    Wywołania synchroniczne zwracają wynik w tej samej odpowiedzi, więc agent może od razu go użyć bez odpytywania o stan zadania.

Pytania o OpenClaw + Fish Audio

Czym różnią się s1, s2-pro i s2.1-pro?

s1 służy do ekspresyjnej mowy. s2.1-pro jest zalecany do produkcji, obsługuje 83 języki i sterowanie ekspresją; s2-pro pozostaje opcją poprzedniej generacji.

Jaki format audio zwraca Fish Audio?

Domyślnym formatem jest MP3, a opcjonalnie można wybrać WAV. Odpowiedź RunAPI zawiera prawidłowy format, typ MIME i rozmiar w bajtach.

Czy mogę pokierować głosem za pomocą próbki referencyjnej?

Tak. Utwórz głos należący do konta i używaj jego RunAPI voice_id w kolejnych żądaniach zamiany tekstu na mowę. Aby wpłynąć tylko na bieżące żądanie, przekaż przez references dźwięk base64 z dokładnym transkryptem.

Czy RunAPI przechowuje wygenerowany plik audio?

Tak. RunAPI weryfikuje i zapisuje wynik, zanim zwróci zarządzany adres URL pliku audio.

Czy muszę odpytywać endpoint o zakończenie?

Nie. Endpoint działa synchronicznie i zwraca gotowy wynik audio w odpowiedzi na pomyślne żądanie.

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.

Zacznij używać Fish Audio z OpenClaw

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się