Ein API Key
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
It looks like you may prefer a different language. Switch anytime.
Nutze die OmniHuman API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman erzeugt Talking-Head-Video aus einem Quellbild und steuerndem Audio. Hilfsendpunkte können Personenbereiche erkennen und Subjektmasken zurückgeben, die an den audio-to-video-Request übergeben werden können.
| Endpoint | Auflösung | Dauer | Preis | |
|---|---|---|---|---|
| audio_to_video | 720p, 1080p | — | $0.32 / second |
Preise für omnihuman-1.5 angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.
Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.
Nutze deinen RunAPI Key für jedes unterstützte Modell.
Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.
Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.
OmniHuman gehört zum Bytedance-Katalog auf RunAPI und stellt Audio-to-Video-Generierung sowie Human-Identification- und Subject-Detection-Helfer über einheitliche API-, SDK-, CLI-, Bruno- und Dokumentationsoberflächen bereit.
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.
Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.
Audio-to-video benötigt eine Quellbild-URL und eine Quellaudio-URL. Optionale Masken-URLs, Prompt-Hinweise, Auflösung, Fast Mode, Seed und Callback-URL können die Aufgabe verfeinern.
Human Identification analysiert ein Quellbild und gibt Bildausgaben zurück, die Personenbereiche zur Prüfung oder Vorverarbeitung markieren.
Subject Detection analysiert ein Quellbild und gibt Maskenausgaben zurück, die als `mask_urls` in einem OmniHuman audio-to-video-Request verwendet werden können.
Übergib Masken-URLs, wenn du stärkere Subjektisolation willst oder wenn eine vorherige Subject-Detection-Aufgabe Masken für dasselbe Quellbild erzeugt hat.
OmniHuman audio-to-video unterstützt 720p und 1080p; 1080p ist der Standard, wenn keine Auflösung angegeben wird.
Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.