OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription 面向会议纪要、视频字幕、音频检索与多语言转录场景。两个变体均使用 OpenAI 兼容的音频转文字请求格式。

公开版本与端点

模型 ID版本端点起步价格模型目录
gpt-transcribe支持关键词和语言提示的多语言语音转文字模型
/v1/audio/transcriptions
$0.020模型详情
whisper-1支持字幕与时间戳输出的灵活音频转文字模型
/v1/audio/transcriptions
$0.020模型详情

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。

验证

选择 <model-id> 后生成验证命令。

使用流程

  1. 1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 2. 配置 RunAPI

    调用端点前设置 RUNAPI_API_KEY。

  3. 3. 验证结果

    对于异步端点,轮询同一端点,直到 Task 进入终态。

常见问题

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。