Parámetros flexibles
Configura 7 parámetros documentados, incluidos file, language, prompt, response_format, stream.
Transcripción de audio flexible con subtítulos y marcas de tiempo
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-1",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'whisper-1',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "whisper-1",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"whisper-1","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model whisper-1 \
--endpoint speech_to_text \
--wait
2 versiones disponibles
Elige cualquier modelo y genera en segundos.
| Proveedor | OpenAI |
| ID del modelo | whisper-1 |
| Modalidad | Audio & Music |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/audio/transcriptions |
| Unidad de facturación | minute |
| Parámetros de entrada | file, language, model, prompt, response_format, stream, temperature, timestamp_granularities |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para whisper-1 desde el panel de control.
Envía una solicitud POST a /v1/audio/transcriptions con el identificador del modelo whisper-1 y tus parámetros.
Lee directamente la respuesta completada de whisper-1 desde el endpoint.
Configura 7 parámetros documentados, incluidos file, language, prompt, response_format, stream.
Expone 1 endpoint(s) público(s): speech_to_text.
Medido por minute sin requisito de suscripción.
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
languageAudio language as an ISO-639-1 code.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text, srt, verbose_json, vtt)
timestamp_granularitiesTimestamp detail included with verbose JSON responses.
Crea pistas y assets de audio.
Construye pipelines de voz y audio.
Expón herramientas de audio a tu entorno de desarrollo.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros