Paramètres flexibles
Configurez 8 paramètres documentés, dont file, keywords, language, languages, prompt.
Reconnaissance vocale multilingue avec indications de mots-clés et de langues
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-transcribe",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gpt-transcribe',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gpt-transcribe \
--endpoint speech_to_text \
--wait
2 versions disponibles
Choisissez un modèle et générez en quelques secondes.
| Fournisseur | OpenAI |
| ID du modèle | gpt-transcribe |
| Modalité | Audio & Music |
| Types de tâche | Synchronous |
| Endpoint API | /v1/audio/transcriptions |
| Unité de facturation | minute |
| Paramètres d'entrée | file, keywords, language, languages, model, prompt, response_format, stream, temperature |
| État du catalogue | Opérationnel |
Inscrivez-vous gratuitement et créez une clé API pour gpt-transcribe depuis le tableau de bord.
Envoyez une requête POST à /v1/audio/transcriptions avec l’identifiant du modèle gpt-transcribe et vos paramètres.
Lisez directement la réponse gpt-transcribe terminée depuis l’endpoint.
Configurez 8 paramètres documentés, dont file, keywords, language, languages, prompt.
Expose 1 endpoint(s) public(s) : speech_to_text.
Mesuré par minute, sans abonnement requis.
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
keywordsTerms that should receive additional recognition guidance.
languageAudio language as an ISO-639-1 code.
languagesCandidate audio languages as ISO-639-1 codes.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text)
Créez des pistes et assets audio.
Construisez des pipelines voix et audio.
Exposez des outils audio dans votre environnement de développement.
Passez l'ID de modèle affiché dans le quickstart.
Oui. Les tarifs sont mesurés par appel ou par unité.
Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.
Nous contacter