It looks like you may prefer a different language. Switch anytime.

Audio & Music Fish Audio

Fish Audio API

Usa l'API Fish Audio tramite RunAPI con model skill, autenticazione unificata e prezzi pay-as-you-go.

runapi.ai
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "s1",
  "text": "Trasforma questa breve narrazione documentaria in una voce espressiva e naturale, mantenendo un ritmo uniforme."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";

const client = new FishAudioClient();
const result = await client.textToSpeech.run({
    model: "s1",
    text: "Trasforma questa breve narrazione documentaria in una voce espressiva e naturale, mantenendo un ritmo uniforme.",
});
require "runapi/fish_audio"

client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
    model: "s1",
    text: "Trasforma questa breve narrazione documentaria in una voce espressiva e naturale, mantenendo un ritmo uniforme."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/fish-audio v1
OVERVIEW

Informazioni su Fish Audio

Fish Audio converte il testo in voce tramite un endpoint sincrono RunAPI. Scegli s1 per audio espressivi, s2.1-pro come modello consigliato per la produzione con 83 lingue e controllo naturale dell'espressione; s2-pro resta disponibile per i workflow della generazione precedente.

Provider
Fish Audio
Modalità
Audio & Music

Confronta tutte le varianti API

Variante Fatturazione Prezzo
s1 1K UTF-8 bytes $0.020 Visualizza →
s2-pro 1K UTF-8 bytes $0.020 Visualizza →
s2.1-pro 1K UTF-8 bytes $0.020 Visualizza →
PRICING

Prezzi Fish Audio

Endpoint Risoluzione Durata Prezzo
text_to_speech $0.02 / 1K UTF-8 bytes

Prezzi mostrati per s1. Le altre varianti mantengono i propri prezzi per endpoint.

PRICING

Endpoint di utilità

Endpoint condivisi per questa linea di modelli, come azioni di estensione, miglioramento o conversione.

List voices
Free / request
Create voice
Free / track
Get voice
Free / request
Integrazione agenti

Esegui Fish Audio da un agente

COME FUNZIONA

Inizia con Fish Audio

  1. Scegli il modello

    Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.

  2. Configura

    Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.

  3. Implementa

    Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.

  4. Ricevi

    Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.

CONTEXT

Che cos'è l'API Fish Audio?

Fish Audio offre modelli di sintesi vocale per dialoghi espressivi e workflow vocali di produzione affidabili. RunAPI convalida ogni risultato e restituisce un URL MP3 gestito con i relativi metadati audio.

Provider
Fish Audio
Vedi tutto →
Modalità
Audio & Music
Sfoglia i modelli →

Perché usare l'API Fish Audio tramite RunAPI

Un’unica autenticazione, tutti i provider

Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.

Prezzi e billing unificati

Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.

Skill con schema

Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.

Domande su Fish Audio

Qual è la differenza tra s1, s2-pro e s2.1-pro?

s1 è pensato per conversazioni e narrazioni espressive. s2.1-pro è consigliato per la produzione con 83 lingue e controllo dell'espressione; s2-pro resta disponibile come opzione della generazione precedente.

Quale formato audio restituisce Fish Audio?

Il formato predefinito è MP3 ed è possibile scegliere WAV. La risposta RunAPI include formato, tipo MIME e dimensione in byte accurati.

Posso guidare la voce con un campione di riferimento?

Sì. Crea una voce appartenente all'account e usa il relativo voice_id RunAPI nelle richieste di sintesi vocale successive. Per influire solo sulla richiesta corrente, passa l'audio in base64 e la trascrizione esatta tramite references.

L'audio generato è ospitato da RunAPI?

Sì. RunAPI convalida e archivia il risultato prima di restituire un URL audio gestito.

Devo usare il polling fino al completamento?

No. L'endpoint è sincrono e restituisce il risultato audio completato direttamente nella risposta alla richiesta riuscita.

Da quale variante dovrei iniziare?

Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.

MODELLI SIMILI

Se ti piace l'API Fish Audio, prova questi

Inizia a sviluppare con l'API Fish Audio.