OpenAI · Audio & Music

Hermes Agent x OpenAI Transcription

OpenAI Transcription oferece modelos de reconhecimento de voz para atas de reunião, legendas, mídias pesquisáveis e transcrições multilíngues. As duas variantes usam o formato de requisição de transcrição de áudio compatível com OpenAI.

Versões e endpoints públicos

ID do modeloVersãoEndpointsPreço inicialCatálogo
gpt-transcribeReconhecimento de voz multilíngue com dicas de palavras-chave e idiomas
/v1/audio/transcriptions
$0.020Detalhes do modelo
whisper-1Transcrição de áudio flexível com legendas e marcações de tempo
/v1/audio/transcriptions
$0.020Detalhes do modelo

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.

Verificar

Selecione <model-id> para gerar os comandos de verificação.

Como funciona

  1. 1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. 2. Configure o RunAPI

    Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.

  3. 3. Verifique o resultado

    Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.

Perguntas frequentes

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.