Fish Audio API
Accès à l’API Fish Audio pour une synthèse vocale multilingue expressive et adaptée à la production, avec fichiers MP3 gérés.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio convertit du texte en parole via un endpoint RunAPI synchrone. Choisissez s1 pour une voix expressive, s2.1-pro comme modèle recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste disponible pour les workflows de génération précédente.
- Variantes de modèle pour différents objectifs de qualité et de latence
- API key unifiée
- Le model skill inclut docs, schémas et notes de setup
- Les générations échouées ne sont pas facturées
Variantes
Utility endpoints
Shared endpoints for this model line, such as extension, enhancement, or conversion actions.
Installez le skill Fish Audio pour développer des apps
Chargez les docs du modèle, les schémas, les notes de tarifs et les étapes de setup dans votre workspace de code.
# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Install the Fish Audio skill for this app: 1. Add runapi-ai/fish-audio with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Construire avec ce model skill
Choisir le modèle
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
S'authentifier une fois
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Installer le skill
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Recevoir la sortie
Interrogez par task ID ou traitez le callback quand la génération se termine.
Où utiliser Fish Audio
Fish Audio propose des modèles de synthèse vocale pour les dialogues expressifs et les workflows de production vocale exigeants. RunAPI valide chaque résultat et renvoie une URL MP3 gérée avec ses métadonnées audio.
Pourquoi utiliser Fish Audio via RunAPI
Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Prêt pour les skills
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Facturation prévisible
Les tarifs à l'usage sont visibles avant l'appel.
Questions fréquentes
Comment choisir entre s1, s2-pro et s2.1-pro ?
s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.
Quel format audio Fish Audio renvoie-t-il ?
Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.
Puis-je guider la voix avec un échantillon de référence ?
Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.
Le fichier audio généré est-il hébergé par RunAPI ?
Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.
Dois-je suivre la tâche par polling ?
Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.
Comment appeler ce modèle ?
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.
Les générations échouées coûtent-elles quelque chose ?
Les générations échouées ne sont pas facturées
Puis-je l'appeler depuis mon application ?
Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.