Fish Audio · Audio & Music

Hermes Agent x Fish Audio

Fish Audio oferece modelos de text-to-speech para diálogos expressivos e fluxos confiáveis de produção de voz. O RunAPI valida cada resultado e retorna uma URL de MP3 gerenciada com os metadados do áudio.

Versões e endpoints públicos

ID do modeloVersãoEndpointsPreço inicialCatálogo
s1Expressive multilingual speech for conversational and narrative audio
/api/v1/fish_audio/text_to_speech
$0.020Detalhes do modelo
s2-proNatural, consistent speech for production voice workflows
/api/v1/fish_audio/text_to_speech
$0.020Detalhes do modelo
s2.1-proTTS recomendado para produção com 83 idiomas e controle de expressão em linguagem natural
/api/v1/fish_audio/text_to_speech
$0.020Detalhes do modelo

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.

Verificar

Selecione <model-id> para gerar os comandos de verificação.

Operações adicionais

Essas operações não usam um ID de modelo.

  • /api/v1/fish_audio/list_voices
  • /api/v1/fish_audio/create_voice
  • /api/v1/fish_audio/get_voice

Como funciona

  1. 1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. 2. Configure o RunAPI

    Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.

  3. 3. Verifique o resultado

    Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.

Perguntas frequentes

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.