Parámetros flexibles
Configura 8 parámetros documentados, incluidos file, keywords, language, languages, prompt.
Conversión de voz a texto multilingüe con indicaciones de palabras clave e idioma
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-transcribe",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gpt-transcribe',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gpt-transcribe \
--endpoint speech_to_text \
--wait
2 versiones disponibles
Elige cualquier modelo y genera en segundos.
| Proveedor | OpenAI |
| ID del modelo | gpt-transcribe |
| Modalidad | Audio & Music |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/audio/transcriptions |
| Unidad de facturación | minute |
| Parámetros de entrada | file, keywords, language, languages, model, prompt, response_format, stream, temperature |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para gpt-transcribe desde el panel de control.
Envía una solicitud POST a /v1/audio/transcriptions con el identificador del modelo gpt-transcribe y tus parámetros.
Lee directamente la respuesta completada de gpt-transcribe desde el endpoint.
Configura 8 parámetros documentados, incluidos file, keywords, language, languages, prompt.
Expone 1 endpoint(s) público(s): speech_to_text.
Medido por minute sin requisito de suscripción.
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
keywordsTerms that should receive additional recognition guidance.
languageAudio language as an ISO-639-1 code.
languagesCandidate audio languages as ISO-639-1 codes.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text)
Crea pistas y assets de audio.
Construye pipelines de voz y audio.
Expón herramientas de audio a tu entorno de desarrollo.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros