하나의 API key
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
It looks like you may prefer a different language. Switch anytime.
RunAPI를 통해 모델 스킬, 통합 인증, 종량제 요금으로 Gemini Omni API를 사용하세요.
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"audio_id": "achernar",
"name": "Acher Narrator",
"voice_description": "침착한 나레이터가 말하는 동안 재사용 가능한 캐릭터가 빗속을 걷는 1080p 네온 도시 추적 영상을 만들어 주세요.",
"example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";
const client = new GeminiOmniClient();
const result = await client.createAudio.run({
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "침착한 나레이터가 말하는 동안 재사용 가능한 캐릭터가 빗속을 걷는 1080p 네온 도시 추적 영상을 만들어 주세요.",
example_dialogue: "Hello, I am achernar",
});
<?php
require __DIR__ . "/vendor/autoload.php";
use RunApi\GeminiOmni\GeminiOmniClient;
$client = new GeminiOmniClient();
$result = $client->createAudio->run([
'audio_id' => 'achernar',
'name' => 'Acher Narrator',
'voice_description' => '침착한 나레이터가 말하는 동안 재사용 가능한 캐릭터가 빗속을 걷는 1080p 네온 도시 추적 영상을 만들어 주세요.',
'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"
client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "침착한 나레이터가 말하는 동안 재사용 가능한 캐릭터가 빗속을 걷는 1080p 네온 도시 추적 영상을 만들어 주세요.",
example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Gemini Omni는 재사용 가능한 음성 리소스, 재사용 가능한 캐릭터 리소스, 그리고 프롬프트, 참조 이미지, 오디오 ID, 캐릭터 ID, 소스 비디오 클립을 결합할 수 있는 멀티모달 비디오를 생성합니다.
| endpoint | 해상도 | 길이 | 가격 | |
|---|---|---|---|---|
| create_audio | — | — | Free / track |
gemini-omni-audio 기준 요금입니다. 다른 변형은 각자의 endpoint 요금이 적용됩니다.
출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.
모든 지원 모델에 RunAPI key를 사용합니다.
기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.
task ID로 조회하거나 생성 완료 시 callback을 처리합니다.
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.
호출 전에 사용량 기반 가격을 확인할 수 있습니다.
재사용 가능한 오디오 리소스, 재사용 가능한 캐릭터 리소스, 그리고 프롬프트와 이미지, 오디오, 캐릭터, 소스 비디오 참조를 결합한 멀티모달 비디오를 만들 수 있습니다.
여러 비디오에서 동일한 시각적 정체성이 필요할 때 캐릭터 리소스를 만드세요. 반환된 캐릭터 ID를 해당 피사체를 재사용해야 하는 비디오 요청에 전달하면 됩니다.
오디오 리소스는 사전 설정된 음성 선택을 캡처하며, 일관된 음성 선택으로 나레이션이나 대화가 필요한 비디오 요청에서 참조할 수 있습니다.
비디오 가격은 요청 모드, 지속 시간, 해상도, 소스 미디어가 실제 청구되는 클립 길이를 변경하는지 여부에 따라 달라집니다.
네. Gemini Omni 비디오는 문서화된 참조 한도 내에서 참조 이미지, 오디오 ID, 캐릭터 ID, 소스 비디오와 프롬프트 텍스트를 결합할 수 있습니다.
model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.