OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription 提供語音轉文字 model,適合會議記錄、字幕、可搜尋媒體同多語言逐字稿。兩個 variant 都使用 OpenAI 相容嘅音訊轉錄 request 格式。

2 variants $0.020 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 gpt-transcribe:支援關鍵字同語言提示嘅多語言語音轉文字。

You have access to RunAPI task tools for OpenAI Transcription.

Available OpenAI Transcription models:
- gpt-transcribe: 支援關鍵字同語言提示嘅多語言語音轉文字
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format
- whisper-1: 靈活音訊轉錄,支援字幕同時間戳輸出
  endpoints: /v1/audio/transcriptions
  request fields: file, model, response_format

Use the model ID and endpoint that match the user's request.
Example prompt: 將呢段訪問錄音轉錄成 JSON,保留錄音中使用嘅語言,並突顯指定嘅產品術語。
/v1/audio/transcriptions: Submit the request and verify the synchronous output. POST /v1/audio/transcriptions。確認同步回應符合該端點的 API 參考。

公開版本與端點

模型 ID 端點 起始價格 模型目錄
gpt-transcribe
/v1/audio/transcriptions
$0.020 模型詳情
whisper-1
/v1/audio/transcriptions
$0.020 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

使用 OpenClaw + OpenAI Transcription 可以建立甚麼

  • 產品示範影片

    根據文字描述製作 5 至 10 秒的產品動畫,適合電商展示和社交廣告。

  • AI 虛擬人內容

    製作口型同步的虛擬人影片,用於培訓材料、客戶支援和市場推廣。

  • 批量影片製作

    排隊生成數百段影片,並透過 webhook 接收結果。

為甚麼透過 RunAPI + OpenClaw 使用 OpenAI Transcription

  • 2 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 自動化工作流程

    透過一致的工作流程提交工作、查詢狀態並收集非同步結果,無需編寫手動輪詢程式碼。

OpenClaw + OpenAI Transcription 常見問題

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。

透過 OpenClaw 開始使用 OpenAI Transcription

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們