It looks like you may prefer a different language. Switch anytime.

Utility Bytedance

OmniHuman API

Nutze die OmniHuman API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.

runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
ÜBERBLICK

Über OmniHuman

OmniHuman erzeugt Talking-Head-Video aus einem Quellbild und steuerndem Audio. Hilfsendpunkte können Personenbereiche erkennen und Subjektmasken zurückgeben, die an den audio-to-video-Request übergeben werden können.

Anbieter
Bytedance
Modalität
Utility

Varianten

Variante Abrechnung Preise
omnihuman-1.5 second $0.320 Ansehen →
omnihuman-1.5-human-identification call $0.0000 Ansehen →
omnihuman-1.5-subject-detection call $0.0000 Ansehen →
PREISE

OmniHuman-Preise

Endpoint Auflösung Dauer Preis
audio_to_video 720p, 1080p $0.32 / second

Preise für omnihuman-1.5 angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.

Agent-Integration

OmniHuman mit einem Agenten ausführen

SO FUNKTIONIERT ES

Mit OmniHuman starten

  1. Modell wählen

    Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

  2. Einmal authentifizieren

    Nutze deinen RunAPI Key für jedes unterstützte Modell.

  3. Skill installieren

    Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

  4. Ergebnis empfangen

    Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo OmniHuman passt

OmniHuman gehört zum Bytedance-Katalog auf RunAPI und stellt Audio-to-Video-Generierung sowie Human-Identification- und Subject-Detection-Helfer über einheitliche API-, SDK-, CLI-, Bruno- und Dokumentationsoberflächen bereit.

Anbieter
Bytedance
Alle ansehen →
Modalität
Utility
Modelle durchsuchen →

Warum OmniHuman über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

OmniHuman-Fragen

Welche Eingaben benötigt OmniHuman audio-to-video?

Audio-to-video benötigt eine Quellbild-URL und eine Quellaudio-URL. Optionale Masken-URLs, Prompt-Hinweise, Auflösung, Fast Mode, Seed und Callback-URL können die Aufgabe verfeinern.

Was gibt Human Identification zurück?

Human Identification analysiert ein Quellbild und gibt Bildausgaben zurück, die Personenbereiche zur Prüfung oder Vorverarbeitung markieren.

Was gibt Subject Detection zurück?

Subject Detection analysiert ein Quellbild und gibt Maskenausgaben zurück, die als `mask_urls` in einem OmniHuman audio-to-video-Request verwendet werden können.

Wann sollte ich `mask_urls` übergeben?

Übergib Masken-URLs, wenn du stärkere Subjektisolation willst oder wenn eine vorherige Subject-Detection-Aufgabe Masken für dasselbe Quellbild erzeugt hat.

Welche Ausgabeauflösungen werden unterstützt?

OmniHuman audio-to-video unterstützt 720p und 1080p; 1080p ist der Standard, wenn keine Auflösung angegeben wird.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

ÄHNLICHE MODELLE

Ähnliche Modelle wie OmniHuman

Mit OmniHuman bauen.