Fish Audio API
Acceso a la API de Fish Audio para texto a voz expresivo y multilingüe, apto para producción, con salida MP3 gestionada.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Convierte esta breve narración documental en una voz expresiva y natural, con un ritmo uniforme."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Convierte esta breve narración documental en una voz expresiva y natural, con un ritmo uniforme.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Convierte esta breve narración documental en una voz expresiva y natural, con un ritmo uniforme."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio convierte texto en voz mediante un endpoint síncrono de RunAPI. Elige s1 para audio conversacional o narrativo expresivo, s2.1-pro como modelo recomendado para producción con 83 idiomas y control de expresión en lenguaje natural; s2-pro sigue disponible para flujos de la generación anterior.
- Variantes para distintos objetivos de calidad y latencia
- API key unificada
- El model skill incluye documentación, schemas y notas de setup
- Las generaciones fallidas no se cobran
Variantes
Utility endpoints
Shared endpoints for this model line, such as extension, enhancement, or conversion actions.
Instala el skill de Fish Audio para desarrollar apps
Carga documentación del modelo, schemas, notas de precios y pasos de setup en tu workspace de código.
# Install the model skill for app development workflows
npx skills add runapi-ai/fish-audio -g
Install the Fish Audio skill for this app: 1. Add runapi-ai/fish-audio with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Cómo construir con este model skill
Elige el modelo
Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.
Autentica una vez
Usa tu clave RunAPI para todos los modelos compatibles.
Instala el skill
Añade el model skill a tu workspace de código antes de implementar la función.
Recibe la salida
Consulta por task ID o procesa el callback cuando termine la generación.
Dónde encaja Fish Audio
Fish Audio ofrece modelos de texto a voz para diálogos expresivos y flujos fiables de producción de voz. RunAPI valida cada resultado y devuelve una URL de audio MP3 gestionada junto con sus metadatos.
Por qué usar Fish Audio mediante RunAPI
Una API key
Usa las mismas credenciales entre modelos y proveedores.
Listo para skills
El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.
Facturación predecible
El precio por uso es visible antes de llamar.
Preguntas frecuentes
¿Cuál es la diferencia entre s1, s2-pro y s2.1-pro?
s1 está orientado a voz expresiva y narrativa. s2.1-pro es el modelo recomendado para producción con 83 idiomas y control de expresión; s2-pro sigue disponible como opción de la generación anterior.
¿Qué formato de audio devuelve Fish Audio?
MP3 es el formato predeterminado y también se puede elegir WAV. La respuesta incluye metadatos precisos de formato, tipo MIME y tamaño en bytes.
¿Puedo guiar la voz con una muestra de referencia?
Puedes intentar usar un voice_id de RunAPI devuelto en solicitudes posteriores de texto a voz, pero no se garantiza su disponibilidad. Para una sola solicitud, envía audio en base64 y su transcripción exacta mediante references.
¿Aloja RunAPI el audio generado?
Sí. RunAPI valida y almacena el resultado antes de devolver una URL de audio gestionada.
¿Tengo que hacer polling hasta que termine?
No. El endpoint es síncrono y devuelve el resultado de audio completo cuando la solicitud se completa correctamente.
¿Cómo llamo a este modelo?
Instala el model skill y sigue sus notas de setup con tu clave RunAPI.
¿Las generaciones fallidas cuestan dinero?
Las generaciones fallidas no se cobran
¿Puedo llamarlo desde mi aplicación?
Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.