OmniHuman API
OmniHuman API-toegang voor audio-gestuurde talking-headvideo, mensidentificatie en detectie van onderwerpmaskers.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman genereert talking-headvideo vanuit een bronafbeelding en sturende audio. Helper-endpoints kunnen menselijke regio's identificeren en onderwerpmaskers teruggeven die aan de audio-to-video-aanvraag kunnen worden meegegeven.
- Meerdere varianten voor verschillende snelheid-/kwaliteitsniveaus
- Modelskill bevat docs, schema's en setupnotities
- Werkt met appgerichte codeerworkflows
- Mislukte generaties worden niet in rekening gebracht
Vergelijk alle API-varianten
| Variant | Billing | Pricing | |
|---|---|---|---|
| omnihuman-1.5 | second | $0.320 | Bekijken → |
| omnihuman-1.5-human-identification | call | $0.0000 | Bekijken → |
| omnihuman-1.5-subject-detection | call | $0.0000 | Bekijken → |
Installeer de OmniHuman skill voor appontwikkeling
Laad modeldocs, schema's, prijsnotities en setupstappen in je codeworkspace.
# Install the model skill for app development workflows
npx skills add runapi-ai/omnihuman -g
Install the OmniHuman skill for this app: 1. Add runapi-ai/omnihuman with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Van modelskill naar eerste resultaat in vier stappen
Kies het model
Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.
Configureren
Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.
Bouwen
Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.
Ontvangen
Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.
Wat is de OmniHuman API?
OmniHuman hoort bij de Bytedance-catalogus op RunAPI en biedt audio-to-video-generatie plus human-identification- en subject-detection-helpers via uniforme API-, SDK-, CLI-, Bruno- en documentatieoppervlakken.
Waarom de OmniHuman API via RunAPI gebruiken
Eén auth, elke provider
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Uniforme prijzen & billing
Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.
Skill met schema's
Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.
Veelgestelde vragen
Welke invoer vereist OmniHuman audio-to-video?
Audio-to-video vereist een bronafbeeldings-URL en een bronaudio-URL. Optionele masker-URL's, prompt-aanwijzingen, resolutie, snelle modus, seed en callback-URL kunnen de taak verfijnen.
Wat geeft Human Identification terug?
Human Identification analyseert één bronafbeelding en geeft afbeeldingsuitvoer terug die menselijke regio's markeert voor controle of voorbewerking.
Wat geeft Subject Detection terug?
Subject Detection analyseert één bronafbeelding en geeft maskeruitvoer terug die als `mask_urls` in een OmniHuman audio-to-video-aanvraag kan worden gebruikt.
Wanneer moet ik `mask_urls` meegeven?
Geef masker-URL's mee wanneer je sterkere onderwerp-isolatie wilt of wanneer een eerdere subject-detection-taak maskers voor dezelfde bronafbeelding heeft geproduceerd.
Welke uitvoerresoluties worden ondersteund?
OmniHuman audio-to-video ondersteunt 720p- en 1080p-uitvoer; 1080p is de standaard wanneer de aanvraag geen resolutie opgeeft.
Met welke variant moet ik beginnen?
Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.
Is er een gratis tier?
Nieuwe accounts krijgen de eerste calls gratis op elk model. Daarna betaal je per call.
Streamen jullie resultaten?
Waar streaming beschikbaar is, streamt RunAPI end-to-end.
Hoe worden mislukkingen gefactureerd?
Mislukte generations worden niet in rekening gebracht.
Worden outputs gecachet?
Gegenereerde outputs worden opgeslagen en zijn op te vragen via task-ID. Inputs worden niet gecachet.
Mag ik het commercieel gebruiken?
Ja — commercieel gebruik is inbegrepen voor elke variant, tenzij een modellicentie het expliciet beperkt. Dat staat aangegeven op de variantpagina.
Hoe zit het met rate limits?
Rate limits per key schalen mee met je usage tier. Zie de prijzenpagina voor de actuele limieten.
Waar kan ik problemen melden?
Open een issue in de publieke GitHub-repo of mail support.