Fish Audio · Audio & Musique

OpenClaw x Fish Audio

Fish Audio propose des modèles de synthèse vocale pour les dialogues expressifs et les workflows de production vocale exigeants. RunAPI valide chaque résultat et renvoie une URL MP3 gérée avec ses métadonnées audio.

3 variants à partir de $0.02 / 1 000 octets UTF-8 Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez s1 lorsqu'il correspond à la tâche : Voix multilingue expressive pour l'audio conversationnel et narratif.

You have access to RunAPI task tools for Fish Audio.

Available Fish Audio models:
- s1: Voix multilingue expressive pour l'audio conversationnel et narratif
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2-pro: Voix naturelle de génération précédente pour les workflows de production établis
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2.1-pro: Synthèse vocale recommandée en production, 83 langues et contrôle naturel de l’expression
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text

Use the model ID and endpoint that match the user's request.
Example prompt: Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier.
/api/v1/fish_audio/text_to_speech: Submit the request and verify the synchronous output. Envoyez POST à /api/v1/fish_audio/text_to_speech. Vérifiez que la réponse synchrone correspond à la référence API de l’endpoint.

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
s1
/api/v1/fish_audio/text_to_speech
$0.02 / 1 000 octets UTF-8 Détail du modèle
s2-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1 000 octets UTF-8 Détail du modèle
s2.1-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1 000 octets UTF-8 Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.

Opérations supplémentaires

Ces opérations n’utilisent pas d’ID de modèle.

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.

  3. Vérifier le résultat

    Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.

Ce que vous pouvez créer avec OpenClaw + Fish Audio

  • Voix off et narration

    Transformez des scripts en audio parlé pour des vidéos, des cours et des démos produit avec des modèles qui génèrent de la voix.

  • Musique et bandes sonores

    Créez des musiques de fond et des jingles à partir d'une description du genre, de l'ambiance et du tempo avec des modèles qui génèrent de la musique.

  • Transcription et traitement audio

    Transcrivez des enregistrements ou nettoyez et transformez de l'audio existant avec des modèles qui acceptent l'audio en entrée.

Pourquoi utiliser Fish Audio avec RunAPI + OpenClaw

  • 3 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur OpenClaw + Fish Audio

Comment choisir entre s1, s2-pro et s2.1-pro ?

s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.

Quel format audio Fish Audio renvoie-t-il ?

Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.

Puis-je guider la voix avec un échantillon de référence ?

Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.

Le fichier audio généré est-il hébergé par RunAPI ?

Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.

Dois-je suivre la tâche par polling ?

Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.

Commencer à utiliser Fish Audio avec OpenClaw

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter