It looks like you may prefer a different language. Switch anytime.

Utility Bytedance

OmniHuman API

Korzystaj z API OmniHuman przez RunAPI z model skillem, wspólnym uwierzytelnianiem i cennikiem pay-as-you-go.

runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
OVERVIEW

O OmniHuman

OmniHuman generuje wideo gadającej głowy z obrazu źródłowego i audio sterującego. Endpointy pomocnicze mogą identyfikować obszary ludzi i zwracać maski obiektu, które można przekazać do żądania audio-to-video.

Dostawca
Bytedance
Modalność
Utility

Porównaj wszystkie warianty API

Wariant Rozliczenia Cennik
omnihuman-1.5 second $0.320 Zobacz →
omnihuman-1.5-human-identification call $0.0000 Zobacz →
omnihuman-1.5-subject-detection call $0.0000 Zobacz →
PRICING

Cennik OmniHuman

Endpoint Rozdzielczość Czas trwania Cena
audio_to_video 720p, 1080p $0.32 / second

Ceny podane dla omnihuman-1.5. Pozostałe warianty mają własne cenniki endpointów.

Integracja agentów

Uruchamiaj OmniHuman z agenta

JAK TO DZIAŁA

Zacznij korzystać z OmniHuman

  1. Wybierz model

    Wybierz model i wariant pasujące do typu wyjścia, progu jakości i celu opóźnienia.

  2. Konfiguracja

    Ustaw klucz RunAPI i zainstaluj model skill w workspace kodu.

  3. Implementacja

    Użyj instrukcji skilla, aby dodać funkcję modelu w swojej aplikacji.

  4. Odbiór

    Odpytuj po task ID, streamuj gdy wspierane albo obsłuż callback webhook.

CONTEXT

Czym jest API OmniHuman?

OmniHuman należy do katalogu Bytedance w RunAPI i udostępnia generowanie audio-to-video oraz pomocnicze human-identification i subject-detection przez ujednolicone powierzchnie API, SDK, CLI, Bruno i dokumentacji.

Dostawca
Bytedance
Zobacz wszystko →
Modalność
Utility
Przeglądaj modele →

Dlaczego używać API OmniHuman przez RunAPI

Jedno uwierzytelnienie, wszyscy providerzy

Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.

Ujednolicony cennik i rozliczenia

Rozliczanie za wywołanie w USD, fakturowane co miesiąc. Nieudane generacje nie są naliczane.

Skill ze schematami

Typowane schematy i notatki setupu są spakowane w model skill, więc implementacja startuje od właściwego kontraktu.

Pytania o OmniHuman

Jakich danych wejściowych wymaga OmniHuman audio-to-video?

Audio-to-video wymaga URL obrazu źródłowego i URL audio źródłowego. Opcjonalne URL-e masek, wskazówki promptu, rozdzielczość, tryb szybki, seed i URL callback mogą doprecyzować zadanie.

Co zwraca Human Identification?

Human Identification analizuje jeden obraz źródłowy i zwraca wyniki obrazowe identyfikujące obszary ludzi do przeglądu lub wstępnego przetwarzania.

Co zwraca Subject Detection?

Subject Detection analizuje jeden obraz źródłowy i zwraca wyniki masek, których można użyć jako `mask_urls` w żądaniu OmniHuman audio-to-video.

Kiedy przekazywać `mask_urls`?

Przekaż URL-e masek, gdy potrzebujesz silniejszej izolacji obiektu albo gdy wcześniejsze zadanie subject-detection utworzyło maski dla tego samego obrazu źródłowego.

Jakie rozdzielczości wyjściowe są obsługiwane?

OmniHuman audio-to-video obsługuje wyjście 720p i 1080p; 1080p jest domyślne, gdy żądanie nie określa rozdzielczości.

Od jakiego wariantu powinienem zacząć?

Wybierz najtańszy wariant, który spełnia Twoje wymagania jakościowe. Większość zespołów zaczyna od szybkiego wariantu, a do produkcji przechodzi na pro.

PODOBNE MODELE

Jeśli podoba Ci się API OmniHuman, wypróbuj też te

Zacznij budować z API OmniHuman.