It looks like you may prefer a different language. Switch anytime.

Audio & Music Fish Audio

Fish Audio API

Utilisez l'API Fish Audio via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.

runapi.ai
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "s1",
  "text": "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";

const client = new FishAudioClient();
const result = await client.textToSpeech.run({
    model: "s1",
    text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier.",
});
require "runapi/fish_audio"

client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
    model: "s1",
    text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/fish-audio v1
APERÇU

À propos de Fish Audio

Fish Audio convertit du texte en parole via un endpoint RunAPI synchrone. Choisissez s1 pour une voix expressive, s2.1-pro comme modèle recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste disponible pour les workflows de génération précédente.

Fournisseur
Fish Audio
Modalité
Audio & Music

Variantes

Variante Facturation Tarifs
s1 1K UTF-8 bytes $0.020 Voir →
s2-pro 1K UTF-8 bytes $0.020 Voir →
s2.1-pro 1K UTF-8 bytes $0.020 Voir →
TARIFS

Tarifs Fish Audio

Endpoint Résolution Durée Prix
text_to_speech $0.02 / 1K UTF-8 bytes

Prix affichés pour s1. Les autres variantes conservent leurs propres tarifs par endpoint.

TARIFS

Endpoints utilitaires

Endpoints partagés pour cette ligne de modèles, tels que les actions d'extension, d'amélioration ou de conversion.

List voices
Free / request
Create voice
Free / track
Get voice
Free / request
Intégration d'agents

Exécutez Fish Audio depuis un agent

FONCTIONNEMENT

Démarrer avec Fish Audio

  1. Choisir le modèle

    Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

  2. S'authentifier une fois

    Utilisez votre clé RunAPI pour tous les modèles pris en charge.

  3. Installer le skill

    Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

  4. Recevoir la sortie

    Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser Fish Audio

Fish Audio propose des modèles de synthèse vocale pour les dialogues expressifs et les workflows de production vocale exigeants. RunAPI valide chaque résultat et renvoie une URL MP3 gérée avec ses métadonnées audio.

Fournisseur
Fish Audio
Tout voir →
Modalité
Audio & Music
Parcourir les modèles →

Pourquoi utiliser Fish Audio via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

Questions sur Fish Audio

Comment choisir entre s1, s2-pro et s2.1-pro ?

s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.

Quel format audio Fish Audio renvoie-t-il ?

Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.

Puis-je guider la voix avec un échantillon de référence ?

Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.

Le fichier audio généré est-il hébergé par RunAPI ?

Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.

Dois-je suivre la tâche par polling ?

Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

MODÈLES SIMILAIRES

Modèles similaires à Fish Audio

Commencez à construire avec Fish Audio.