Fish Audio · Áudio & Música

OpenClaw x Fish Audio

Fish Audio oferece modelos de text-to-speech para diálogos expressivos e fluxos confiáveis de produção de voz. O RunAPI valida cada resultado e retorna uma URL de MP3 gerenciada com os metadados do áudio.

3 variants a partir de $0.02 / 1K bytes UTF-8 Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use s1 quando ele corresponder à tarefa: Fala multilíngue expressiva para áudio conversacional e narrativo.

You have access to RunAPI task tools for Fish Audio.

Available Fish Audio models:
- s1: Fala multilíngue expressiva para áudio conversacional e narrativo
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2-pro: Fala natural da geração anterior para fluxos de produção já estabelecidos
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text
- s2.1-pro: TTS recomendado para produção com 83 idiomas e controle de expressão em linguagem natural
  endpoints: /api/v1/fish_audio/text_to_speech
  request fields: model, text

Use the model ID and endpoint that match the user's request.
Example prompt: Transforme esta breve narração de documentário em uma fala expressiva e natural, mantendo um ritmo consistente.
/api/v1/fish_audio/text_to_speech: Submit the request and verify the synchronous output. Envie POST para /api/v1/fish_audio/text_to_speech. Verifique se a resposta síncrona corresponde à referência da API do endpoint.

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
s1
/api/v1/fish_audio/text_to_speech
$0.02 / 1K bytes UTF-8 Detalhes do modelo
s2-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1K bytes UTF-8 Detalhes do modelo
s2.1-pro
/api/v1/fish_audio/text_to_speech
$0.02 / 1K bytes UTF-8 Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.

Operações adicionais

Essas operações não usam um ID de modelo.

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.

  3. Verifique o resultado

    Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.

O que criar com OpenClaw + Fish Audio

  • Locução e narração

    Transforme roteiros em áudio falado para vídeos, cursos e demos de produto com modelos que geram fala.

  • Música e trilhas sonoras

    Crie faixas de fundo e jingles a partir de uma descrição de gênero, clima e andamento com modelos que geram música.

  • Transcrição e processamento de áudio

    Transcreva gravações ou limpe e transforme áudios existentes com modelos que aceitam áudio como entrada.

Por que usar Fish Audio pelo RunAPI + OpenClaw

  • 3 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Respostas diretas

    Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.

Perguntas sobre OpenClaw + Fish Audio

Qual é a diferença entre s1, s2-pro e s2.1-pro?

s1 é voltado a falas expressivas. O s2.1-pro é recomendado para produção, com 83 idiomas e controle de expressão; o s2-pro segue disponível como geração anterior.

Qual formato de áudio o Fish Audio retorna?

MP3 é o formato padrão e WAV pode ser selecionado. A resposta do RunAPI inclui formato, tipo MIME e tamanho em bytes corretos.

Posso guiar a voz com uma amostra de referência?

Você pode tentar usar um voice_id retornado pelo RunAPI em solicitações posteriores de texto para voz, mas a disponibilidade não é garantida. Para uma única solicitação, envie o áudio em base64 e a transcrição exata por references.

O áudio gerado fica hospedado no RunAPI?

Sim. O RunAPI valida e armazena o resultado antes de retornar uma URL de áudio gerenciada.

Preciso fazer polling até a conclusão?

Não. O endpoint é síncrono e retorna o áudio concluído na resposta bem-sucedida.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.

Comece a usar Fish Audio com OpenClaw

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco