灵活的参数配置
可配置文档中列出的 8 个参数,包括 file, keywords, language, languages, prompt。
curl -X POST https://runapi.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-transcribe",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OpenaiTranscriptionClient } from "@runapi.ai/openai-transcription";
const client = new OpenaiTranscriptionClient();
const result = await client.speechToText.run({
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
import os
import requests
response = requests.post(
"https://runapi.ai/v1/audio/transcriptions",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/v1/audio/transcriptions");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gpt-transcribe',
'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.speechToText().run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"});
task.waitForResult();
require "runapi/openai_transcription"
client = RunApi::OpenaiTranscription::Client.new
result = client.speech_to_text.run(
model: "gpt-transcribe",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.speechToText.Run({"model":"gpt-transcribe","audio_url":"https://cdn.runapi.ai/public/samples/voice.mp3"})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gpt-transcribe \
--endpoint speech_to_text \
--wait
2 个版本可用
选择任意模型,几秒内开始生成。
| 提供商 | OpenAI |
| 模型 ID | gpt-transcribe |
| 模态 | Audio & Music |
| 任务类型 | Synchronous |
| API 端点 | /v1/audio/transcriptions |
| 计费单位 | minute |
| 输入参数 | file, keywords, language, languages, model, prompt, response_format, stream, temperature |
| 目录状态 | 运行中 |
免费注册后,在控制台创建用于 gpt-transcribe 的 API 密钥。
向 /v1/audio/transcriptions 发送 POST 请求,并传入 gpt-transcribe 模型 ID 和参数。
直接从端点读取已完成的 gpt-transcribe 响应。
可配置文档中列出的 8 个参数,包括 file, keywords, language, languages, prompt。
提供 1 个公开 endpoint:speech_to_text。
按 minute 计量,无需订阅。
fileAudio file upload, up to 25 MB.
promptOptional text that guides transcription style and vocabulary.
streamWhether to request a streamed response when supported.
keywordsTerms that should receive additional recognition guidance.
languageAudio language as an ISO-639-1 code.
languagesCandidate audio languages as ISO-639-1 codes.
temperatureSampling temperature from 0 to 1.
response_formatResponse body format. (json, text)
生成与节目氛围匹配的免版税背景音乐,无需授权费用。
为程序化生成的关卡生成自适应环境音效和配乐。
无需录音棚即可为客户广告生成定制配音和音效。
传入 quickstart 中显示的模型 ID。
Key 级限流随使用层级伸缩。当前限制见定价页。
可以——变体只是参数,改 model 字段即可。
模型支持流式时,RunAPI 端到端流式。
在公共 GitHub 仓库提 issue 或邮件联系 support。