OpenAI · Audio & Music

Hermes Agent x OpenAI Transcription

OpenAI Transcription biedt spraak-naar-tekstmodellen voor vergaderverslagen, ondertiteling, doorzoekbare media en meertalige transcripties. Beide varianten gebruiken de OpenAI-compatibele verzoekstructuur voor audiotranscriptie.

2 variants vanaf $0.020 Commercieel toegestaan

Prerequisite: npx runapi mcp install

Prompt

Promptmodellen

Gebruik gpt-transcribe wanneer het bij de taak past: Meertalige spraak-naar-tekst met trefwoord- en taalhints.

You have access to RunAPI task tools for OpenAI Transcription.

Available OpenAI Transcription models:
- gpt-transcribe: Meertalige spraak-naar-tekst met trefwoord- en taalhints
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format
- whisper-1: Flexibele audiotranscriptie met ondertiteling en tijdstempels
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format

Use the model ID and endpoint that match the user's request.
Example prompt: Transcribeer deze interviewopname als JSON, behoud de gesproken taal en markeer de opgegeven producttermen.
/v1/audio/transcriptions: Submit the request and verify the synchronous output. Stuur POST naar /v1/audio/transcriptions. Controleer of het synchrone antwoord overeenkomt met de API-referentie van het endpoint.

Openbare versies en endpoints

Model-ID Endpoints Vanafprijs Catalogus
gpt-transcribe
/v1/audio/transcriptions
$0.020 Modeldetails
whisper-1
/v1/audio/transcriptions
$0.020 Modeldetails

Verifiëren

Poll totdat de Task een eindstatus bereikt

Selecteer <model-id> om verificatieopdrachten te genereren.

Configuratie

Handleiding-endpoint: <endpoint>

Selecteer <model-id> om een aanvraag te genereren met het openbare invoercontract van het endpoint.
Zo werkt het

Start in 3 stappen

  1. Kies een model-ID

    Selecteer een openbare model-ID uit de catalogus en bekijk het endpoint en de actuele vanafprijs.

  2. Configureer RunAPI

    Stel RUNAPI_API_KEY in voordat je de endpointaanvraag verzendt.

  3. Verifieer het resultaat

    Poll bij asynchrone endpoints hetzelfde endpoint totdat de Task een eindstatus bereikt.

Wat je kunt bouwen met Hermes Agent + OpenAI Transcription

  • Productdemovideo's

    Genereer productanimaties van 5 tot 10 seconden op basis van tekstbeschrijvingen, ideaal voor e-commerce en social advertenties.

  • AI-avatarcontent

    Maak video's met pratende avatars en lipsynchronisatie voor training, klantenservice en marketing.

  • Videoproductie in batches

    Zet honderden videogeneraties in de wachtrij en ontvang resultaten via webhook.

Waarom OpenAI Transcription gebruiken via RunAPI + Hermes Agent

  • 2 varianten, één API-sleutel

    Gebruik één RunAPI-verbinding om beschikbare modelvarianten te kiezen zonder je integratie aan te passen.

  • Duidelijke gebruiksprijzen

    Bekijk de actuele catalogusprijzen voordat je een aanvraag verstuurt, zonder abonnement of minimale besteding.

  • Automatische taakworkflows

    Dien asynchrone taken in, volg ze en verzamel resultaten met één consistente workflow, zonder handmatige pollingcode.

Vragen over Hermes Agent + OpenAI Transcription

Welke model-ID moet ik gebruiken?

Kies een openbare model-ID uit de versietabel. Elke ID biedt de endpoints die in de betreffende rij staan.

Configureert deze handleiding een chatmodel?

Nee. Deze modellijn gebruikt de hier getoonde endpointworkflow en wordt niet als chatmodel voor de agent gepresenteerd.

Aan de slag met OpenAI Transcription en Hermes Agent

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op