OpenAI · Audio & Music

Hermes Agent x OpenAI Transcription

OpenAI Transcription offre modelli di riconoscimento vocale per verbali di riunioni, sottotitoli, contenuti multimediali ricercabili e trascrizioni multilingue. Entrambe le varianti usano il formato di richiesta per la trascrizione audio compatibile con OpenAI.

Versioni ed endpoint pubblici

ID modelloVersioneEndpointPrezzo inizialeCatalogo
gpt-transcribeRiconoscimento vocale multilingue con indicazioni su parole chiave e lingue
/v1/audio/transcriptions
$0.020Dettagli modello
whisper-1Trascrizione audio flessibile con sottotitoli e timestamp
/v1/audio/transcriptions
$0.020Dettagli modello

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.

Verifica

Seleziona <model-id> per generare i comandi di verifica.

Come funziona

  1. 1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. 2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. 3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Domande frequenti

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.