Utility · Bytedance

OmniHuman API

OmniHuman API-Zugang für audiogesteuerte Talking-Head-Videos, Personenerkennung und Subjektmasken-Erkennung.

Betriebsbereit · 3 variants · ab $0.0000
runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
ÜBERBLICK

OmniHuman erzeugt Talking-Head-Video aus einem Quellbild und steuerndem Audio. Hilfsendpunkte können Personenbereiche erkennen und Subjektmasken zurückgeben, die an den audio-to-video-Request übergeben werden können.

  • Modellvarianten für verschiedene Qualitäts- und Latenzziele
  • Einheitlicher API Key
  • Model Skill enthält Docs, Schemas und Setup-Hinweise
  • Fehlgeschlagene Generierungen werden nicht berechnet
VARIANTEN

Varianten

Variant Billing Pricing
omnihuman-1.5 second $0.320 Ansehen →
omnihuman-1.5-human-identification call $0.0000 Ansehen →
omnihuman-1.5-subject-detection call $0.0000 Ansehen →
MODELS

Installiere den OmniHuman Skill für App-Entwicklung

Lade Modelldokumentation, Schemas, Preishinweise und Setup-Schritte in deinen Coding-Workspace.

# Install the model skill for app development workflows
npx skills add runapi-ai/omnihuman -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the OmniHuman skill for this app:

1. Add runapi-ai/omnihuman with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
SO FUNKTIONIERT ES

Mit diesem Model Skill bauen

01

Modell wählen

Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

02

Einmal authentifizieren

Nutze deinen RunAPI Key für jedes unterstützte Modell.

03

Skill installieren

Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

04

Ergebnis empfangen

Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo OmniHuman passt

OmniHuman gehört zum Bytedance-Katalog auf RunAPI und stellt Audio-to-Video-Generierung sowie Human-Identification- und Subject-Detection-Helfer über einheitliche API-, SDK-, CLI-, Bruno- und Dokumentationsoberflächen bereit.

Provider
Bytedance
Modality
Utility
WARUM RUNAPI

Warum OmniHuman über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

FAQ

Häufige Fragen

Welche Eingaben benötigt OmniHuman audio-to-video?

Audio-to-video benötigt eine Quellbild-URL und eine Quellaudio-URL. Optionale Masken-URLs, Prompt-Hinweise, Auflösung, Fast Mode, Seed und Callback-URL können die Aufgabe verfeinern.

Was gibt Human Identification zurück?

Human Identification analysiert ein Quellbild und gibt Bildausgaben zurück, die Personenbereiche zur Prüfung oder Vorverarbeitung markieren.

Was gibt Subject Detection zurück?

Subject Detection analysiert ein Quellbild und gibt Maskenausgaben zurück, die als `mask_urls` in einem OmniHuman audio-to-video-Request verwendet werden können.

Wann sollte ich `mask_urls` übergeben?

Übergib Masken-URLs, wenn du stärkere Subjektisolation willst oder wenn eine vorherige Subject-Detection-Aufgabe Masken für dasselbe Quellbild erzeugt hat.

Welche Ausgabeauflösungen werden unterstützt?

OmniHuman audio-to-video unterstützt 720p und 1080p; 1080p ist der Standard, wenn keine Auflösung angegeben wird.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

Kosten fehlgeschlagene Generierungen Geld?

Fehlgeschlagene Generierungen werden nicht berechnet

Kann ich es aus meiner Anwendung aufrufen?

Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.

JETZT STARTEN

Mit OmniHuman bauen.