Uma API key
Use as mesmas credenciais entre modelos e provedores.
It looks like you may prefer a different language. Switch anytime.
Use a API do Fish Audio via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
curl -X POST https://runapi.ai/api/v1/fish_audio/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "s1",
"text": "Transforme esta breve narração de documentário em uma fala expressiva e natural, mantendo um ritmo consistente."
}'
import { FishAudioClient } from "@runapi.ai/fish-audio";
const client = new FishAudioClient();
const result = await client.textToSpeech.run({
model: "s1",
text: "Transforme esta breve narração de documentário em uma fala expressiva e natural, mantendo um ritmo consistente.",
});
require "runapi/fish_audio"
client = RunApi::FishAudio::Client.new
result = client.text_to_speech.run(
model: "s1",
text: "Transforme esta breve narração de documentário em uma fala expressiva e natural, mantendo um ritmo consistente."
)
npx skills add runapi-ai/fish-audio -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Fish Audio converte texto em fala por um endpoint síncrono do RunAPI. Escolha s1 para áudio expressivo ou s2.1-pro como modelo recomendado para produção com 83 idiomas e controle de expressão em linguagem natural. O s2-pro continua disponível para fluxos da geração anterior.
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| text_to_speech | — | — | $0.02 / 1K UTF-8 bytes |
Preços exibidos para s1. Outras variantes mantêm seus próprios preços por endpoint.
Endpoints compartilhados para esta linha de modelos, como ações de extensão, aprimoramento ou conversão.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
Fish Audio oferece modelos de text-to-speech para diálogos expressivos e fluxos confiáveis de produção de voz. O RunAPI valida cada resultado e retorna uma URL de MP3 gerenciada com os metadados do áudio.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
s1 é voltado a falas expressivas. O s2.1-pro é recomendado para produção, com 83 idiomas e controle de expressão; o s2-pro segue disponível como geração anterior.
MP3 é o formato padrão e WAV pode ser selecionado. A resposta do RunAPI inclui formato, tipo MIME e tamanho em bytes corretos.
Você pode tentar usar um voice_id retornado pelo RunAPI em solicitações posteriores de texto para voz, mas a disponibilidade não é garantida. Para uma única solicitação, envie o áudio em base64 e a transcrição exata por references.
Sim. O RunAPI valida e armazena o resultado antes de retornar uma URL de áudio gerenciada.
Não. O endpoint é síncrono e retorna o áudio concluído na resposta bem-sucedida.
Instale o model skill e siga as notas de setup com sua chave RunAPI.