Versions et endpoints publics
| ID du modèle | Endpoints | Prix de départ | Catalogue |
|---|---|---|---|
s1
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 000 octets UTF-8 | Détail du modèle |
s2-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 000 octets UTF-8 | Détail du modèle |
s2.1-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1 000 octets UTF-8 | Détail du modèle |
Vérification
Interrogez jusqu’à ce que la tâche atteigne un état final
Sélectionnez <model-id> pour générer les commandes de vérification.
Configuration
Endpoint du guide: <endpoint>
Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Opérations supplémentaires
Ces opérations n’utilisent pas d’ID de modèle.
/api/v1/fish_audio/list_voices/api/v1/fish_audio/create_voice/api/v1/fish_audio/get_voice
Démarrer en 3 étapes
-
Choisir un ID de modèle
Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.
-
Configurer RunAPI
Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.
-
Vérifier le résultat
Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.
Ce que vous pouvez créer avec OpenClaw + Fish Audio
-
Voix off et narration
Transformez des scripts en audio parlé pour des vidéos, des cours et des démos produit avec des modèles qui génèrent de la voix.
-
Musique et bandes sonores
Créez des musiques de fond et des jingles à partir d'une description du genre, de l'ambiance et du tempo avec des modèles qui génèrent de la musique.
-
Transcription et traitement audio
Transcrivez des enregistrements ou nettoyez et transformez de l'audio existant avec des modèles qui acceptent l'audio en entrée.
Pourquoi utiliser Fish Audio avec RunAPI + OpenClaw
-
3 variantes, une clé API
Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.
-
Des tarifs d'utilisation clairs
Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.
-
Réponses directes
Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.
Questions sur OpenClaw + Fish Audio
Comment choisir entre s1, s2-pro et s2.1-pro ?
s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.
Quel format audio Fish Audio renvoie-t-il ?
Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.
Puis-je guider la voix avec un échantillon de référence ?
Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.
Le fichier audio généré est-il hébergé par RunAPI ?
Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.
Dois-je suivre la tâche par polling ?
Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.
Quel ID de modèle utiliser ?
Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.
Ce guide configure-t-il un modèle de chat ?
Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.