Paramètres flexibles
Configurez 7 paramètres documentés, dont file, language, prompt, response_format, stream.
Transcription audio flexible avec sous-titres et horodatages
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-1",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'whisper-1',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model whisper-1 \
--endpoint speech_to_text \
--wait
2 versions disponibles
Choisissez un modèle et générez en quelques secondes.
| Fournisseur | OpenAI |
| ID du modèle | whisper-1 |
| Modalité | Audio & Music |
| Types de tâche | Synchronous |
| Endpoint API | /v1/audio/transcriptions |
| Unité de facturation | minute |
| Paramètres d'entrée | file, language, model, prompt, response_format, stream, temperature, timestamp_granularities |
| État du catalogue | Opérationnel |
Inscrivez-vous gratuitement et créez une clé API pour whisper-1 depuis le tableau de bord.
Envoyez une requête POST à /v1/audio/transcriptions avec l’identifiant du modèle whisper-1 et vos paramètres.
Lisez directement la réponse whisper-1 terminée depuis l’endpoint.
Configurez 7 paramètres documentés, dont file, language, prompt, response_format, stream.
Expose 1 endpoint(s) public(s) : speech_to_text.
Mesuré par minute, sans abonnement requis.
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
languageAudio language as an ISO-639-1 code.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text, srt, verbose_json, vtt)
timestamp_granularitiesTimestamp detail included with verbose JSON responses.
Créez des pistes et assets audio.
Construisez des pipelines voix et audio.
Exposez des outils audio dans votre environnement de développement.
Passez l'ID de modèle affiché dans le quickstart.
Oui. Les tarifs sont mesurés par appel ou par unité.
Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.
Nous contacter