Audio & Music · Fish Audio

Fish Audio API

Accès à l’API Fish Audio pour une synthèse vocale multilingue expressive et adaptée à la production, avec fichiers MP3 gérés.

Opérationnel · 3 variants · à partir de $0.0000
runapi.ai
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "s1",
  "text": "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";

const client = new FishAudioClient();
const result = await client.textToSpeech.run({
    model: "s1",
    text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier.",
});
require "runapi/fish_audio"

client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
    model: "s1",
    text: "Transformez cette courte narration documentaire en une voix naturelle et expressive au rythme régulier."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/fish-audio v1
APERÇU

Fish Audio convertit du texte en parole via un endpoint RunAPI synchrone. Choisissez s1 pour une voix expressive, s2.1-pro comme modèle recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste disponible pour les workflows de génération précédente.

  • Variantes de modèle pour différents objectifs de qualité et de latence
  • API key unifiée
  • Le model skill inclut docs, schémas et notes de setup
  • Les générations échouées ne sont pas facturées
VARIANTES

Variantes

Variant Billing Pricing
s1 1K UTF-8 bytes $0.020 Voir →
s2-pro 1K UTF-8 bytes $0.020 Voir →
s2.1-pro 1K UTF-8 bytes $0.020 Voir →
TARIFS

Utility endpoints

Shared endpoints for this model line, such as extension, enhancement, or conversion actions.

List voices
Free / request
Create voice
Free / track
Get voice
Free / request
MODELS

Installez le skill Fish Audio pour développer des apps

Chargez les docs du modèle, les schémas, les notes de tarifs et les étapes de setup dans votre workspace de code.

# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Fish Audio skill for this app:

1. Add runapi-ai/fish-audio with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
FONCTIONNEMENT

Construire avec ce model skill

01

Choisir le modèle

Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

02

S'authentifier une fois

Utilisez votre clé RunAPI pour tous les modèles pris en charge.

03

Installer le skill

Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

04

Recevoir la sortie

Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser Fish Audio

Fish Audio propose des modèles de synthèse vocale pour les dialogues expressifs et les workflows de production vocale exigeants. RunAPI valide chaque résultat et renvoie une URL MP3 gérée avec ses métadonnées audio.

Provider
Fish Audio
Modality
Audio & Music
POURQUOI RUNAPI

Pourquoi utiliser Fish Audio via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

FAQ

Questions fréquentes

Comment choisir entre s1, s2-pro et s2.1-pro ?

s1 vise une voix expressive. s2.1-pro est recommandé en production avec 83 langues et le contrôle naturel de l’expression ; s2-pro reste une option disponible de génération précédente.

Quel format audio Fish Audio renvoie-t-il ?

Le format par défaut est MP3 et WAV peut être sélectionné. La réponse RunAPI fournit le format, le type MIME et la taille en octets exacts.

Puis-je guider la voix avec un échantillon de référence ?

Vous pouvez essayer d’utiliser un voice_id RunAPI renvoyé dans les requêtes de synthèse vocale suivantes, mais sa disponibilité n’est pas garantie. Pour une seule requête, transmettez l’audio en base64 et sa transcription exacte via references.

Le fichier audio généré est-il hébergé par RunAPI ?

Oui. Le résultat est validé et stocké par RunAPI, qui fournit ensuite une URL audio gérée.

Dois-je suivre la tâche par polling ?

Non. L’endpoint est synchrone et renvoie le fichier audio final dès que la requête aboutit.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

Les générations échouées coûtent-elles quelque chose ?

Les générations échouées ne sont pas facturées

Puis-je l'appeler depuis mon application ?

Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.

COMMENCER

Commencez à construire avec Fish Audio.