Fish Audio API
Fish Audio API-Zugang für ausdrucksstarke, mehrsprachige Text-to-Speech-Ausgabe in Produktionsqualität als über RunAPI bereitgestellte MP3-Datei.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Wandle diesen kurzen Dokumentartext in ausdrucksstarke, natürliche Sprache mit gleichmäßigem Sprechtempo um."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Wandle diesen kurzen Dokumentartext in ausdrucksstarke, natürliche Sprache mit gleichmäßigem Sprechtempo um.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Wandle diesen kurzen Dokumentartext in ausdrucksstarke, natürliche Sprache mit gleichmäßigem Sprechtempo um."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio wandelt Text über einen synchronen RunAPI-Endpunkt in Sprache um. Wähle s1 für ausdrucksstarke Dialoge und Erzählungen, s2.1-pro als empfohlenes Produktionsmodell mit 83 Sprachen und natürlicher Ausdruckssteuerung; s2-pro bleibt für Workflows der vorherigen Generation verfügbar.
- Modellvarianten für verschiedene Qualitäts- und Latenzziele
- Einheitlicher API Key
- Model Skill enthält Docs, Schemas und Setup-Hinweise
- Fehlgeschlagene Generierungen werden nicht berechnet
Varianten
Utility endpoints
Shared endpoints for this model line, such as extension, enhancement, or conversion actions.
Installiere den Fish Audio Skill für App-Entwicklung
Lade Modelldokumentation, Schemas, Preishinweise und Setup-Schritte in deinen Coding-Workspace.
# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Install the Fish Audio skill for this app: 1. Add runapi-ai/fish-audio with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Mit diesem Model Skill bauen
Modell wählen
Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.
Einmal authentifizieren
Nutze deinen RunAPI Key für jedes unterstützte Modell.
Skill installieren
Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.
Ergebnis empfangen
Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.
Wo Fish Audio passt
Fish Audio bietet Text-to-Speech-Modelle für ausdrucksstarke Dialoge und zuverlässige professionelle Sprach-Workflows. RunAPI validiert jedes Ergebnis und gibt eine von RunAPI bereitgestellte MP3-URL mit Audio-Metadaten zurück.
Warum Fish Audio über RunAPI nutzen
Ein API Key
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Skill-ready
Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.
Planbare Abrechnung
Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.
Häufige Fragen
Was ist der Unterschied zwischen s1, s2-pro und s2.1-pro?
s1 ist auf ausdrucksstarke Dialoge und Erzählungen ausgelegt. s2.1-pro ist das empfohlene Produktionsmodell mit 83 Sprachen und natürlicher Ausdruckssteuerung; s2-pro bleibt als Modell der vorherigen Generation verfügbar.
Welches Audioformat gibt Fish Audio zurück?
Standardmäßig wird MP3 zurückgegeben; WAV kann explizit gewählt werden. Die RunAPI-Antwort enthält korrekte Metadaten zu Format, MIME-Typ und Dateigröße.
Kann ich die Stimme mit einer Referenzprobe steuern?
Du kannst eine zurückgegebene RunAPI voice_id in späteren Text-to-Speech- Anfragen ausprobieren, ihre Verfügbarkeit ist jedoch nicht garantiert. Nur für die aktuelle Anfrage kannst du über references Base64-Audio mit dem exakten Transkript übergeben.
Wird das generierte Audio von RunAPI gehostet?
Ja. RunAPI validiert und speichert das Ergebnis, bevor eine von RunAPI bereitgestellte Audio-URL zurückgegeben wird.
Muss ich den Abschluss per Polling abfragen?
Nein. Der Endpunkt arbeitet synchron und gibt das fertige Audio direkt in der erfolgreichen Antwort zurück.
Wie rufe ich dieses Modell auf?
Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.
Kosten fehlgeschlagene Generierungen Geld?
Fehlgeschlagene Generierungen werden nicht berechnet
Kann ich es aus meiner Anwendung aufrufen?
Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.