Audio & Music · OpenAI

OpenAI Transcription API

OpenAI-compatibele API-toegang voor audiotranscriptie en spraak-naar-tekst met Whisper-1 en GPT Transcribe.

Operationeel · 2 variants · vanaf $0.020
runapi.ai
curl -X POST https://runapi.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "whisper-1",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";

const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
    model: "whisper-1",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/openai_transcription"

client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
    model: "whisper-1",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/openai-transcription -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/openai-transcription v1
OVERVIEW

OpenAI Transcription zet geuploade audiobestanden via een synchroon multipart-eindpunt om in tekst. Whisper-1 ondersteunt ondertiteling en tijdstempels, terwijl GPT Transcribe trefwoord- en taalhints ondersteunt voor meertalige audio.

  • Meerdere varianten voor verschillende snelheid-/kwaliteitsniveaus
  • Modelskill bevat docs, schema's en setupnotities
  • Werkt met appgerichte codeerworkflows
  • Mislukte generaties worden niet in rekening gebracht
VARIANTS

Vergelijk alle API-varianten

Variant Billing Pricing
gpt-transcribe minute $0.020 Bekijken →
whisper-1 minute $0.020 Bekijken →
SKILLS

Installeer de OpenAI Transcription skill voor appontwikkeling

Laad modeldocs, schema's, prijsnotities en setupstappen in je codeworkspace.

# Install the model skill for app development workflows
npx skills add runapi-ai/openai-transcription -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the OpenAI Transcription skill for this app:

1. Add runapi-ai/openai-transcription with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
HOE HET WERKT

Van modelskill naar eerste resultaat in vier stappen

01

Kies het model

Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.

02

Configureren

Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.

03

Bouwen

Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.

04

Ontvangen

Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.

CONTEXT

Wat is de OpenAI Transcription API?

OpenAI Transcription biedt spraak-naar-tekstmodellen voor vergaderverslagen, ondertiteling, doorzoekbare media en meertalige transcripties. Beide varianten gebruiken de OpenAI-compatibele verzoekstructuur voor audiotranscriptie.

Provider
OpenAI
Modality
Audio & Music
WAAROM RUNAPI

Waarom de OpenAI Transcription API via RunAPI gebruiken

Eén auth, elke provider

Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.

Uniforme prijzen & billing

Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.

Skill met schema's

Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.

FAQ

Veelgestelde vragen

Wat is het verschil tussen Whisper-1 en GPT Transcribe?

Whisper-1 ondersteunt JSON, platte tekst, ondertiteling, uitgebreide JSON en uitvoer met tijdstempels. GPT Transcribe richt zich op JSON of platte tekst en accepteert trefwoord- en meertalige hints.

Welke audiobestanden kan ik transcriberen?

Het eindpunt accepteert uploads in FLAC, MP3, MP4, MPEG, MPGA, M4A, OGG, WAV en WebM tot 25 MB.

Kan de API ondertiteling en tijdstempels per woord maken?

Whisper-1 kan SRT- of VTT-ondertiteling en tijdstempels op woord- of segmentniveau retourneren via uitgebreide JSON. Deze uitvoermodi zijn niet beschikbaar met GPT Transcribe.

Ondersteunt GPT Transcribe meertalige opnamen?

Ja. U kunt één taalhint of een lijst met waarschijnlijke talen opgeven, plus trefwoordhints voor namen en vaktermen.

Is audiotranscriptie synchroon?

Ja. Een geslaagd verzoek retourneert het voltooide transcript direct, zonder een apart eindpunt voor statuspolling.

Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

Is er een gratis tier?

Nieuwe accounts krijgen de eerste calls gratis op elk model. Daarna betaal je per call.

Streamen jullie resultaten?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Hoe worden mislukkingen gefactureerd?

Mislukte generations worden niet in rekening gebracht.

Worden outputs gecachet?

Gegenereerde outputs worden opgeslagen en zijn op te vragen via task-ID. Inputs worden niet gecachet.

Mag ik het commercieel gebruiken?

Ja — commercieel gebruik is inbegrepen voor elke variant, tenzij een modellicentie het expliciet beperkt. Dat staat aangegeven op de variantpagina.

Hoe zit het met rate limits?

Rate limits per key schalen mee met je usage tier. Zie de prijzenpagina voor de actuele limieten.

Waar kan ik problemen melden?

Open een issue in de publieke GitHub-repo of mail support.

VERGELIJKBARE MODELLEN

Als je de OpenAI Transcription API goed vindt, probeer deze dan eens

NU BEGINNEN

Begin met bouwen met de OpenAI Transcription API.