OpenAI · Audio & Music

Hermes Agent x OpenAI Transcription

OpenAI Transcription 提供語音轉文字模型,適用於會議記錄、字幕、可搜尋媒體及多語言逐字稿。兩個版本都使用 OpenAI 相容的音訊轉錄請求格式。

公開版本與端點

模型 ID版本端點起始價格模型目錄
gpt-transcribe支援關鍵字與語言提示的多語言語音轉文字
/v1/audio/transcriptions
$0.020模型詳情
whisper-1靈活的音訊轉錄,支援字幕與時間戳記輸出
/v1/audio/transcriptions
$0.020模型詳情

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。

驗證

選擇 <model-id> 後產生驗證命令。

使用流程

  1. 1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

常見問題

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。