Un’unica autenticazione, tutti i provider
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
It looks like you may prefer a different language. Switch anytime.
Usa l'API OmniHuman tramite RunAPI con model skill, autenticazione unificata e prezzi pay-as-you-go.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman genera video talking-head da un'immagine sorgente e da un audio guida. Gli endpoint helper possono identificare regioni umane e restituire maschere del soggetto da passare alla richiesta audio-to-video.
| Variante | Fatturazione | Prezzo | |
|---|---|---|---|
| omnihuman-1.5 | second | $0.320 | Visualizza → |
| omnihuman-1.5-human-identification | call | $0.0000 | Visualizza → |
| omnihuman-1.5-subject-detection | call | $0.0000 | Visualizza → |
| Endpoint | Risoluzione | Durata | Prezzo | |
|---|---|---|---|---|
| audio_to_video | 720p, 1080p | — | $0.32 / second |
Prezzi mostrati per omnihuman-1.5. Le altre varianti mantengono i propri prezzi per endpoint.
Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.
Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.
Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.
Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.
OmniHuman appartiene al catalogo Bytedance su RunAPI ed espone generazione audio-to-video più helper human-identification e subject-detection tramite superfici unificate API, SDK, CLI, Bruno e documentazione.
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.
Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.
Audio-to-video richiede un URL dell'immagine sorgente e un URL dell'audio sorgente. URL di maschere opzionali, indicazioni del prompt, risoluzione, modalità veloce, seed e URL di callback possono rifinire il task.
Human Identification analizza una singola immagine sorgente e restituisce output immagine che identificano regioni umane per revisione o pre-elaborazione.
Subject Detection analizza una singola immagine sorgente e restituisce output di maschera utilizzabili come `mask_urls` in una richiesta OmniHuman audio-to-video.
Passa URL di maschera quando vuoi un isolamento più forte del soggetto o quando un task subject-detection precedente ha prodotto maschere per la stessa immagine sorgente.
OmniHuman audio-to-video supporta output 720p e 1080p; 1080p è il valore predefinito quando la richiesta non specifica una risoluzione.
Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.