OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription ofrece modelos de conversión de voz a texto para actas de reuniones, subtítulos, contenido multimedia indexable y transcripciones multilingües. Ambas variantes usan el formato de solicitud de transcripción de audio compatible con OpenAI.

Versiones y endpoints públicos

ID del modeloVersiónEndpointsPrecio inicialCatálogo
gpt-transcribeConversión de voz a texto multilingüe con indicaciones de palabras clave e idioma
/v1/audio/transcriptions
$0.020Detalle del modelo
whisper-1Transcripción de audio flexible con subtítulos y marcas de tiempo
/v1/audio/transcriptions
$0.020Detalle del modelo

Configuración

Endpoint de la guía: <endpoint>

Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.

Verificar

Selecciona <model-id> para generar los comandos de verificación.

Cómo funciona

  1. 1. Elige un ID de modelo

    Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.

  2. 2. Configura RunAPI

    Define RUNAPI_API_KEY antes de enviar la solicitud al endpoint.

  3. 3. Verifica el resultado

    Para endpoints asíncronos, consulta el mismo endpoint hasta que la Task alcance un estado final.

Preguntas frecuentes

¿Qué ID de modelo debo usar?

Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.

¿Esta guía configura un modelo de chat?

No. Esta línea de modelos usa el flujo de endpoint mostrado y no se presenta como modelo de chat del agente.