OpenAI

OpenAI Transcription gpt transcribe

Audio & Music

キーワードと言語ヒントを使える多言語の音声テキスト変換

モデルの状態 データ不足
curl -X POST https://runapi.ai/v1/audio/transcriptions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-transcribe",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
https://runapi.ai 1 endpoint

2 個のバージョンを利用可能

プレイグラウンド

OpenAI Transcription gpt transcribe を試す

モデルを選んで、数秒で生成できます。

概算: $0.02 / minute

RunAPI で生成するにはサインインしてください。

ログインして生成

ログインして、利用可能な言語モデルで生成を開始してください。

仕様

仕様

プロバイダー OpenAI
モデル ID gpt-transcribe
モダリティ Audio & Music
タスク種別 Synchronous
API エンドポイント /v1/audio/transcriptions
請求単位 minute
入力パラメータ file, keywords, language, languages, model, prompt, response_format, stream, temperature
カタログ状態 稼働中
使い方

このモデルを3ステップで使う

  1. キーを取得

    無料で登録し、ダッシュボードから gpt-transcribe 用の API キーを作成します。

  2. リクエストを送信

    /v1/audio/transcriptions に gpt-transcribe のモデル ID とパラメータを指定して POST リクエストを送信します。

  3. 結果を取得

    エンドポイントから完了した gpt-transcribe のレスポンスを直接読み取ります。

このモデルが提供する機能

柔軟なパラメータ

file, keywords, language, languages, prompt を含む 8 個のドキュメント済みパラメータを設定できます。

Endpoint カバレッジ

1 個の公開 endpoint を提供しています: speech_to_text。

従量課金

minute に基づいて計量課金されます。サブスクリプション不要。

OpenAI Transcription gpt transcribe 料金

エンドポイント
解像度
期間
料金
speech_to_text
利用できません
minute
$0.02 / minute
API リファレンス

エンドポイント仕様

エンドポイント
POST /v1/audio/transcriptions
モデル ID
gpt-transcribe
タスクタイプ
speech_to_text
最大時間
利用できません
解像度
利用できません
アスペクト比
利用できません
出力形式
利用できません
平均生成時間
利用できません

リクエストパラメータ

file

必須 string

Audio file upload, up to 25 MB.

prompt

任意 string

Optional text that guides transcription style and vocabulary.

stream

任意 boolean

Whether to request a streamed response when supported.

keywords

任意 array

Terms that should receive additional recognition guidance.

language

任意 string

Audio language as an ISO-639-1 code.

languages

任意 array

Candidate audio languages as ISO-639-1 codes.

temperature

任意 number

Sampling temperature from 0 to 1.

response_format

任意 string

Response body format. (json, text)

ユースケース

音楽生成

楽曲や音声アセットを作成します。

音声ワークフロー

音声合成やオーディオ処理の pipeline を構築します。

ツール連携

開発環境にオーディオツールを提供します。

FAQ

OpenAI Transcription gpt transcribe に関するよくある質問

gpt-transcribe はどう選択しますか?

quickstart に表示されるモデル ID を渡してください。

料金は従量課金ですか?

はい。呼び出しまたは単位ごとの従量課金です。

チームで構築していますか?

エンタープライズ導入、連携、技術的なご相談をお手伝いします。

お問い合わせ