OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription oferuje modele zamiany mowy na tekst do notatek ze spotkań, napisów, przeszukiwalnych multimediów i wielojęzycznych transkrypcji. Oba warianty korzystają ze zgodnej z OpenAI struktury żądania transkrypcji audio.

Publiczne wersje i endpointy

ID modeluWersjaEndpointyCena początkowaKatalog
gpt-transcribeWielojęzyczna zamiana mowy na tekst z podpowiedziami słów i języków
/v1/audio/transcriptions
$0.020Szczegóły modelu
whisper-1Elastyczna transkrypcja audio z napisami i znacznikami czasu
/v1/audio/transcriptions
$0.020Szczegóły modelu

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.

Weryfikacja

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Jak to działa

  1. 1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. 2. Skonfiguruj RunAPI

    Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.

  3. 3. Zweryfikuj wynik

    Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.

Częste pytania

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.