Elastyczne parametry
Skonfiguruj 7 udokumentowanych parametrów, w tym file, language, prompt, response_format, stream.
Elastyczna transkrypcja audio z napisami i znacznikami czasu
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-1",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'whisper-1',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model whisper-1 \
--endpoint speech_to_text \
--wait
2 dostępnych wariantów
Wybierz dowolny model i generuj w kilka sekund.
| Dostawca | OpenAI |
| ID modelu | whisper-1 |
| Modalność | Audio & Music |
| Typy zadań | Synchronous |
| Endpoint API | /v1/audio/transcriptions |
| Jednostka rozliczeniowa | minute |
| Parametry wejściowe | file, language, model, prompt, response_format, stream, temperature, timestamp_granularities |
| Status katalogu | Operacyjny |
Zarejestruj się bezpłatnie i utwórz klucz API dla whisper-1 w panelu.
Wyślij żądanie POST do /v1/audio/transcriptions z identyfikatorem modelu whisper-1 i parametrami.
Odczytaj bezpośrednio z endpointu ukończoną odpowiedź whisper-1.
Skonfiguruj 7 udokumentowanych parametrów, w tym file, language, prompt, response_format, stream.
Udostępnia 1 publiczny(-e) endpoint(-y): speech_to_text.
Rozliczane według minute bez wymogu subskrypcji.
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
languageAudio language as an ISO-639-1 code.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text, srt, verbose_json, vtt)
timestamp_granularitiesTimestamp detail included with verbose JSON responses.
Generuj muzykę w tle bez tantiem, dopasowaną do nastroju odcinka i bez opłat licencyjnych.
Generuj adaptacyjne ambientowe pejzaże dźwiękowe i efekty do proceduralnie generowanych poziomów.
Generuj niestandardowe lektorskie nagrania i efekty dźwiękowe do spotów klienta bez studia nagrań.
Przekaż identyfikator modelu wyświetlony w quickstarcie.
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.
Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.
Skontaktuj się