OpenAI · Audio & Music

OpenClaw x OpenAI Transcription

OpenAI Transcription은 회의록, 자막, 검색 가능한 미디어, 다국어 전사를 위한 음성 인식 모델을 제공합니다. 두 모델 모두 OpenAI 호환 오디오 전사 요청 형식을 사용합니다.

공개 버전 및 엔드포인트

모델 ID버전엔드포인트시작 가격모델 카탈로그
gpt-transcribe키워드 및 언어 힌트를 지원하는 다국어 음성 텍스트 변환
/v1/audio/transcriptions
$0.020모델 상세
whisper-1자막과 타임스탬프 출력을 지원하는 유연한 오디오 전사
/v1/audio/transcriptions
$0.020모델 상세

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.

검증

<model-id>를 선택하면 검증 명령을 생성합니다.

사용 절차

  1. 1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. 2. RunAPI 설정

    엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.

  3. 3. 결과 검증

    비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.

자주 묻는 질문

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.