Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
It looks like you may prefer a different language. Switch anytime.
Utilisez l'API Fish Audio via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio convertit du texte en parole via un endpoint RunAPI synchrone. Choisissez s1 pour une voix expressive, s2.1-pro comme modèle recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste disponible pour les workflows de génération précédente.
| Endpoint | Résolution | Durée | Prix | |
|---|---|---|---|---|
| text_to_speech | — | — | $0.02 / 1K UTF-8 bytes |
Prix affichés pour s1. Les autres variantes conservent leurs propres tarifs par endpoint.
Endpoints partagés pour cette ligne de modèles, tels que les actions d'extension, d'amélioration ou de conversion.
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Interrogez par task ID ou traitez le callback quand la génération se termine.
Fish Audio propose des modèles de synthèse vocale pour les dialogues expressifs et les workflows de production vocale exigeants. RunAPI valide chaque résultat et renvoie une URL MP3 gérée avec ses métadonnées audio.
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Les tarifs à l'usage sont visibles avant l'appel.
s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.
Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.
Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.
Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.
Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.