OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription propose des modèles de reconnaissance vocale pour les comptes rendus de réunion, les sous-titres, les contenus multimédias consultables par recherche et les transcriptions multilingues. Les deux variantes utilisent le format de requête de transcription audio compatible OpenAI.

Versions et endpoints publics

ID du modèleVersionEndpointsPrix de départCatalogue
gpt-transcribeReconnaissance vocale multilingue avec indications de mots-clés et de langues
/v1/audio/transcriptions
$0.020Détail du modèle
whisper-1Transcription audio flexible avec sous-titres et horodatages
/v1/audio/transcriptions
$0.020Détail du modèle

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.

Vérification

Sélectionnez <model-id> pour générer les commandes de vérification.

Fonctionnement

  1. 1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. 2. Configurer RunAPI

    Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.

  3. 3. Vérifier le résultat

    Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.

FAQ

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.