OpenAI · Audio & Music

Hermes Agent x OpenAI Transcription

OpenAI Transcription oferece modelos de reconhecimento de voz para atas de reunião, legendas, mídias pesquisáveis e transcrições multilíngues. As duas variantes usam o formato de requisição de transcrição de áudio compatível com OpenAI.

2 variants a partir de $0.020 Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use gpt-transcribe quando ele corresponder à tarefa: Reconhecimento de voz multilíngue com dicas de palavras-chave e idiomas.

You have access to RunAPI task tools for OpenAI Transcription.

Available OpenAI Transcription models:
- gpt-transcribe: Reconhecimento de voz multilíngue com dicas de palavras-chave e idiomas
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format
- whisper-1: Transcrição de áudio flexível com legendas e marcações de tempo
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format

Use the model ID and endpoint that match the user's request.
Example prompt: Transcreva esta gravação de entrevista em JSON, preserve o idioma falado e destaque os termos de produto fornecidos.
/v1/audio/transcriptions: Submit the request and verify the synchronous output. Envie POST para /v1/audio/transcriptions. Verifique se a resposta síncrona corresponde à referência da API do endpoint.

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
gpt-transcribe
/v1/audio/transcriptions
$0.020 Detalhes do modelo
whisper-1
/v1/audio/transcriptions
$0.020 Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.

  3. Verifique o resultado

    Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.

O que criar com Hermes Agent + OpenAI Transcription

  • Vídeos de demonstração de produtos

    Gere animações de produtos de 5 a 10 segundos a partir de descrições textuais, ideais para e-commerce e anúncios sociais.

  • Conteúdo com avatares de IA

    Crie vídeos com avatares e sincronização labial para treinamentos, suporte ao cliente e marketing.

  • Produção de vídeos em lote

    Enfileire centenas de gerações de vídeo e receba os resultados por webhook.

Por que usar OpenAI Transcription pelo RunAPI + Hermes Agent

  • 2 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Fluxos de tarefas automáticos

    Envie tarefas, consulte seu status e reúna resultados assíncronos em um fluxo uniforme, sem escrever código de consulta manual.

Perguntas sobre Hermes Agent + OpenAI Transcription

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.

Comece a usar OpenAI Transcription com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco