Versões e endpoints públicos
| ID do modelo | Endpoints | Preço inicial | Catálogo |
|---|---|---|---|
s1
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1K bytes UTF-8 | Detalhes do modelo |
s2-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1K bytes UTF-8 | Detalhes do modelo |
s2.1-pro
|
/api/v1/fish_audio/text_to_speech
|
$0.02 / 1K bytes UTF-8 | Detalhes do modelo |
Verificar
Consulte até que a Task alcance um estado final
Selecione <model-id> para gerar os comandos de verificação.
Configuração
Endpoint do guia: <endpoint>
Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Operações adicionais
Essas operações não usam um ID de modelo.
/api/v1/fish_audio/list_voices/api/v1/fish_audio/create_voice/api/v1/fish_audio/get_voice
Comece em 3 passos
-
Escolha um ID de modelo
Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.
-
Configure o RunAPI
Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.
-
Verifique o resultado
Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.
O que criar com OpenClaw + Fish Audio
-
Locução e narração
Transforme roteiros em áudio falado para vídeos, cursos e demos de produto com modelos que geram fala.
-
Música e trilhas sonoras
Crie faixas de fundo e jingles a partir de uma descrição de gênero, clima e andamento com modelos que geram música.
-
Transcrição e processamento de áudio
Transcreva gravações ou limpe e transforme áudios existentes com modelos que aceitam áudio como entrada.
Por que usar Fish Audio pelo RunAPI + OpenClaw
-
3 variantes, uma chave de API
Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.
-
Preços de uso claros
Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.
-
Respostas diretas
Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.
Perguntas sobre OpenClaw + Fish Audio
Qual é a diferença entre s1, s2-pro e s2.1-pro?
s1 é voltado a falas expressivas. O s2.1-pro é recomendado para produção, com 83 idiomas e controle de expressão; o s2-pro segue disponível como geração anterior.
Qual formato de áudio o Fish Audio retorna?
MP3 é o formato padrão e WAV pode ser selecionado. A resposta do RunAPI inclui formato, tipo MIME e tamanho em bytes corretos.
Posso guiar a voz com uma amostra de referência?
Você pode tentar usar um voice_id retornado pelo RunAPI em solicitações posteriores de texto para voz, mas a disponibilidade não é garantida. Para uma única solicitação, envie o áudio em base64 e a transcrição exata por references.
O áudio gerado fica hospedado no RunAPI?
Sim. O RunAPI valida e armazena o resultado antes de retornar uma URL de áudio gerenciada.
Preciso fazer polling até a conclusão?
Não. O endpoint é síncrono e retorna o áudio concluído na resposta bem-sucedida.
Qual ID de modelo devo usar?
Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.
Este guia configura um modelo de chat?
Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.