Publiczne wersje i endpointy
| ID modelu | Endpointy | Cena początkowa | Katalog |
|---|---|---|---|
s1
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 tys. bajtów UTF-8 | Szczegóły modelu |
s2-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 tys. bajtów UTF-8 | Szczegóły modelu |
s2.1-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 tys. bajtów UTF-8 | Szczegóły modelu |
Weryfikacja
Odpytywanie do momentu osiągnięcia przez Task stanu końcowego
Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.
Konfiguracja
Endpoint przewodnika: <endpoint>
Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Dodatkowe operacje
Te operacje nie używają ID modelu.
/api/v1/fish_audio/list_voices/api/v1/fish_audio/create_voice/api/v1/fish_audio/get_voice
Zacznij w 3 krokach
-
Wybierz ID modelu
Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.
-
Skonfiguruj RunAPI
Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.
-
Zweryfikuj wynik
Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.
Co możesz zbudować za pomocą Hermes Agent + Fish Audio
-
Lektor i narracja
Zamieniaj scenariusze na mówione audio do filmów, kursów i demonstracji produktów za pomocą modeli generujących mowę.
-
Muzyka i ścieżki dźwiękowe
Twórz podkłady muzyczne i dżingle na podstawie opisu gatunku, nastroju i tempa za pomocą modeli generujących muzykę.
-
Transkrypcja i przetwarzanie audio
Transkrybuj nagrania albo oczyszczaj i przekształcaj istniejące audio za pomocą modeli, które przyjmują audio na wejściu.
Dlaczego warto używać Fish Audio przez RunAPI + Hermes Agent
-
3 wariantów, jeden klucz API
Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.
-
Przejrzyste ceny użycia
Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.
-
Bezpośrednie odpowiedzi
Wywołania synchroniczne zwracają wynik w tej samej odpowiedzi, więc agent może od razu go użyć bez odpytywania o stan zadania.
Pytania o Hermes Agent + Fish Audio
Czym różnią się s1, s2-pro i s2.1-pro?
s1 służy do ekspresyjnej mowy. s2.1-pro jest zalecany do produkcji, obsługuje 83 języki i sterowanie ekspresją; s2-pro pozostaje opcją poprzedniej generacji.
Jaki format audio zwraca Fish Audio?
Domyślnym formatem jest MP3, a opcjonalnie można wybrać WAV. Odpowiedź RunAPI zawiera prawidłowy format, typ MIME i rozmiar w bajtach.
Czy mogę pokierować głosem za pomocą próbki referencyjnej?
Tak. Utwórz głos należący do konta i używaj jego RunAPI voice_id w kolejnych żądaniach zamiany tekstu na mowę. Aby wpłynąć tylko na bieżące żądanie, przekaż przez references dźwięk base64 z dokładnym transkryptem.
Czy RunAPI przechowuje wygenerowany plik audio?
Tak. RunAPI weryfikuje i zapisuje wynik, zanim zwróci zarządzany adres URL pliku audio.
Czy muszę odpytywać endpoint o zakończenie?
Nie. Endpoint działa synchronicznie i zwraca gotowy wynik audio w odpowiedzi na pomyślne żądanie.
Którego ID modelu użyć?
Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.
Czy ten przewodnik konfiguruje model czatu?
Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.