OpenAI

OpenAI Transcription whisper 1

Audio & Music

Elastyczna transkrypcja audio z napisami i znacznikami czasu

Kondycja modelu Niewystarczające dane
curl -X POST https://runapi.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "whisper-1",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
https://runapi.ai 1 endpoint

2 dostępnych wariantów

Playground

Wypróbuj OpenAI Transcription whisper 1

Wybierz dowolny model i generuj w kilka sekund.

Szacunkowo: $0.02 / minute

Zaloguj się, aby generować przez RunAPI.

Zaloguj się, aby generować

Zaloguj się, aby rozpocząć generowanie z dostępnymi modelami językowymi.

Specyfikacja

Szczegóły techniczne

Dostawca OpenAI
ID modelu whisper-1
Modalność Audio & Music
Typy zadań Synchronous
Endpoint API /v1/audio/transcriptions
Jednostka rozliczeniowa minute
Parametry wejściowe file, language, model, prompt, response_format, stream, temperature, timestamp_granularities
Status katalogu Operacyjny
JAK TO DZIAŁA

Użyj tego modelu w 3 krokach

  1. Uzyskaj klucz

    Zarejestruj się bezpłatnie i utwórz klucz API dla whisper-1 w panelu.

  2. Wyślij żądanie

    Wyślij żądanie POST do /v1/audio/transcriptions z identyfikatorem modelu whisper-1 i parametrami.

  3. Pobierz wyniki

    Odczytaj bezpośrednio z endpointu ukończoną odpowiedź whisper-1.

Co oferuje ten model

Elastyczne parametry

Skonfiguruj 7 udokumentowanych parametrów, w tym file, language, prompt, response_format, stream.

Pokrycie endpointów

Udostępnia 1 publiczny(-e) endpoint(-y): speech_to_text.

Rozliczenia według użycia

Rozliczane według minute bez wymogu subskrypcji.

OpenAI Transcription whisper 1 Cennik

Endpoint
Rozdzielczość
Czas trwania
Cena
speech_to_text
Niedostępne
minute
$0.02 / minute
ODNIESIENIE API

Specyfikacja endpointu

Endpoint
POST /v1/audio/transcriptions
ID modelu
whisper-1
Typy zadań
speech_to_text
Maksymalny czas trwania
Niedostępne
Rozdzielczości
Niedostępne
Proporcje obrazu
Niedostępne
Format wyjściowy
Niedostępne
Średni czas generowania
Niedostępne

Parametry żądania

file

Wymagane string

Audio file upload, up to 25 MB.

prompt

Opcjonalne string

Optional text that guides transcription style and vocabulary.

stream

Opcjonalne boolean

Whether to request a streamed response when supported.

language

Opcjonalne string

Audio language as an ISO-639-1 code.

temperature

Opcjonalne number

Sampling temperature from 0 to 1.

response_format

Opcjonalne string

Response body format. (json, text, srt, verbose_json, vtt)

timestamp_granularities

Opcjonalne array

Timestamp detail included with verbose JSON responses.

PRZYPADKI UŻYCIA

Muzyka do podcastów i wideo

Generuj muzykę w tle bez tantiem, dopasowaną do nastroju odcinka i bez opłat licencyjnych.

Audio do gier

Generuj adaptacyjne ambientowe pejzaże dźwiękowe i efekty do proceduralnie generowanych poziomów.

Lektor i SFX do reklam

Generuj niestandardowe lektorskie nagrania i efekty dźwiękowe do spotów klienta bez studia nagrań.

FAQ

Najczęściej zadawane pytania o OpenAI Transcription whisper 1

Jak wybrać whisper-1?

Przekaż identyfikator modelu wyświetlony w quickstarcie.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się