OpenAI

OpenAI Transcription gpt transcribe

Audio & Music

Riconoscimento vocale multilingue con indicazioni su parole chiave e lingue

Stato del modello Dati insufficienti
curl -X POST https://runapi.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-transcribe",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
https://runapi.ai 1 endpoint

2 versioni disponibili

Playground

Prova OpenAI Transcription gpt transcribe

Scegli un modello e genera in pochi secondi.

Stimato: $0.02 / minute

Accedi per generare con RunAPI.

Accedi per generare

Accedi per iniziare a generare con i modelli linguistici disponibili.

Specifiche

Dettagli tecnici

Provider OpenAI
ID modello gpt-transcribe
Modalità Audio & Music
Tipi di attività Synchronous
Endpoint API /v1/audio/transcriptions
Unità di fatturazione minute
Parametri di input file, keywords, language, languages, model, prompt, response_format, stream, temperature
Stato del catalogo Operativo
COME FUNZIONA

Usa questo modello in 3 passaggi

  1. Crea la tua chiave

    Registrati gratuitamente e crea una chiave API per gpt-transcribe dalla dashboard.

  2. Invia una richiesta

    Invia una richiesta POST a /v1/audio/transcriptions con l’identificatore del modello gpt-transcribe e i tuoi parametri.

  3. Ottieni i risultati

    Leggi direttamente dall’endpoint la risposta completata di gpt-transcribe.

Cosa offre questo modello

Parametri flessibili

Configura 8 parametri documentati, tra cui file, keywords, language, languages, prompt.

Copertura endpoint

Espone 1 endpoint pubblici: speech_to_text.

Fatturazione a consumo

Misurata in base a minute, senza requisito di abbonamento.

OpenAI Transcription gpt transcribe Prezzi

Endpoint
Risoluzione
Durata
Prezzo
speech_to_text
Non disponibile
minute
$0.02 / minute
RIFERIMENTO API

Specifiche dell'endpoint

Endpoint
POST /v1/audio/transcriptions
ID modello
gpt-transcribe
Tipi di attività
speech_to_text
Durata massima
Non disponibile
Risoluzioni
Non disponibile
Proporzioni
Non disponibile
Formato di output
Non disponibile
Tempo medio di generazione
Non disponibile

Parametri della richiesta

file

Obbligatorio string

Audio file upload, up to 25 MB.

prompt

Facoltativo string

Optional text that guides transcription style and vocabulary.

stream

Facoltativo boolean

Whether to request a streamed response when supported.

keywords

Facoltativo array

Terms that should receive additional recognition guidance.

language

Facoltativo string

Audio language as an ISO-639-1 code.

languages

Facoltativo array

Candidate audio languages as ISO-639-1 codes.

temperature

Facoltativo number

Sampling temperature from 0 to 1.

response_format

Facoltativo string

Response body format. (json, text)

CASI D'USO

Colonna sonora per podcast e video

Genera musica di sottofondo royalty-free in linea con il mood dell'episodio, senza costi di licenza.

Audio per game

Genera paesaggi sonori ambientali adattivi ed effetti per livelli generati proceduralmente.

Voiceover e SFX per adv

Genera voiceover e effetti sonori personalizzati per spot dei clienti senza uno studio di registrazione.

FAQ

Domande frequenti su OpenAI Transcription gpt transcribe

Come seleziono gpt-transcribe?

Passa l'ID del modello mostrato nel quickstart.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci