OpenAI · Audio & Music
Hermes Agent x OpenAI Transcription
OpenAI Transcription propose des modèles de reconnaissance vocale pour les comptes rendus de réunion, les sous-titres, les contenus multimédias consultables par recherche et les transcriptions multilingues. Les deux variantes utilisent le format de requête de transcription audio compatible OpenAI.
Versions et endpoints publics
| ID du modèle | Version | Endpoints | Prix de départ | Catalogue |
|---|---|---|---|---|
gpt-transcribe | Reconnaissance vocale multilingue avec indications de mots-clés et de langues | /v1/audio/transcriptions | $0.020 | Détail du modèle |
whisper-1 | Transcription audio flexible avec sous-titres et horodatages | /v1/audio/transcriptions | $0.020 | Détail du modèle |
Configuration
Endpoint du guide: <endpoint>
Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.Vérification
Sélectionnez <model-id> pour générer les commandes de vérification.Fonctionnement
- 1. Choisir un ID de modèle
Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.
- 2. Configurer RunAPI
Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.
- 3. Vérifier le résultat
Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.
FAQ
Quel ID de modèle utiliser ?
Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.
Ce guide configure-t-il un modèle de chat ?
Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.