Jedno uwierzytelnienie, wszyscy providerzy
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
It looks like you may prefer a different language. Switch anytime.
Korzystaj z API OmniHuman przez RunAPI z model skillem, wspólnym uwierzytelnianiem i cennikiem pay-as-you-go.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman generuje wideo gadającej głowy z obrazu źródłowego i audio sterującego. Endpointy pomocnicze mogą identyfikować obszary ludzi i zwracać maski obiektu, które można przekazać do żądania audio-to-video.
| Endpoint | Rozdzielczość | Czas trwania | Cena | |
|---|---|---|---|---|
| audio_to_video | 720p, 1080p | — | $0.32 / second |
Ceny podane dla omnihuman-1.5. Pozostałe warianty mają własne cenniki endpointów.
Wybierz model i wariant pasujące do typu wyjścia, progu jakości i celu opóźnienia.
Ustaw klucz RunAPI i zainstaluj model skill w workspace kodu.
Użyj instrukcji skilla, aby dodać funkcję modelu w swojej aplikacji.
Odpytuj po task ID, streamuj gdy wspierane albo obsłuż callback webhook.
OmniHuman należy do katalogu Bytedance w RunAPI i udostępnia generowanie audio-to-video oraz pomocnicze human-identification i subject-detection przez ujednolicone powierzchnie API, SDK, CLI, Bruno i dokumentacji.
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
Rozliczanie za wywołanie w USD, fakturowane co miesiąc. Nieudane generacje nie są naliczane.
Typowane schematy i notatki setupu są spakowane w model skill, więc implementacja startuje od właściwego kontraktu.
Audio-to-video wymaga URL obrazu źródłowego i URL audio źródłowego. Opcjonalne URL-e masek, wskazówki promptu, rozdzielczość, tryb szybki, seed i URL callback mogą doprecyzować zadanie.
Human Identification analizuje jeden obraz źródłowy i zwraca wyniki obrazowe identyfikujące obszary ludzi do przeglądu lub wstępnego przetwarzania.
Subject Detection analizuje jeden obraz źródłowy i zwraca wyniki masek, których można użyć jako `mask_urls` w żądaniu OmniHuman audio-to-video.
Przekaż URL-e masek, gdy potrzebujesz silniejszej izolacji obiektu albo gdy wcześniejsze zadanie subject-detection utworzyło maski dla tego samego obrazu źródłowego.
OmniHuman audio-to-video obsługuje wyjście 720p i 1080p; 1080p jest domyślne, gdy żądanie nie określa rozdzielczości.
Wybierz najtańszy wariant, który spełnia Twoje wymagania jakościowe. Większość zespołów zaczyna od szybkiego wariantu, a do produkcji przechodzi na pro.