OpenAI · Audio & Music
OpenClaw x OpenAI Transcription
OpenAI Transcription oferuje modele zamiany mowy na tekst do notatek ze spotkań, napisów, przeszukiwalnych multimediów i wielojęzycznych transkrypcji. Oba warianty korzystają ze zgodnej z OpenAI struktury żądania transkrypcji audio.
Publiczne wersje i endpointy
| ID modelu | Wersja | Endpointy | Cena początkowa | Katalog |
|---|---|---|---|---|
gpt-transcribe | Wielojęzyczna zamiana mowy na tekst z podpowiedziami słów i języków | /v1/audio/transcriptions | $0.020 | Szczegóły modelu |
whisper-1 | Elastyczna transkrypcja audio z napisami i znacznikami czasu | /v1/audio/transcriptions | $0.020 | Szczegóły modelu |
Konfiguracja
Endpoint przewodnika: <endpoint>
Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.Weryfikacja
Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.Jak to działa
- 1. Wybierz ID modelu
Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.
- 2. Skonfiguruj RunAPI
Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.
- 3. Zweryfikuj wynik
Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.
Częste pytania
Którego ID modelu użyć?
Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.
Czy ten przewodnik konfiguruje model czatu?
Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.