It looks like you may prefer a different language. Switch anytime.

Utility Bytedance

OmniHuman API

Usa l'API OmniHuman tramite RunAPI con model skill, autenticazione unificata e prezzi pay-as-you-go.

runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
OVERVIEW

Informazioni su OmniHuman

OmniHuman genera video talking-head da un'immagine sorgente e da un audio guida. Gli endpoint helper possono identificare regioni umane e restituire maschere del soggetto da passare alla richiesta audio-to-video.

Provider
Bytedance
Modalità
Utility

Confronta tutte le varianti API

Variante Fatturazione Prezzo
omnihuman-1.5 second $0.320 Visualizza →
omnihuman-1.5-human-identification call $0.0000 Visualizza →
omnihuman-1.5-subject-detection call $0.0000 Visualizza →
PRICING

Prezzi OmniHuman

Endpoint Risoluzione Durata Prezzo
audio_to_video 720p, 1080p $0.32 / second

Prezzi mostrati per omnihuman-1.5. Le altre varianti mantengono i propri prezzi per endpoint.

Integrazione agenti

Esegui OmniHuman da un agente

COME FUNZIONA

Inizia con OmniHuman

  1. Scegli il modello

    Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.

  2. Configura

    Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.

  3. Implementa

    Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.

  4. Ricevi

    Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.

CONTEXT

Che cos'è l'API OmniHuman?

OmniHuman appartiene al catalogo Bytedance su RunAPI ed espone generazione audio-to-video più helper human-identification e subject-detection tramite superfici unificate API, SDK, CLI, Bruno e documentazione.

Provider
Bytedance
Vedi tutto →
Modalità
Utility
Sfoglia i modelli →

Perché usare l'API OmniHuman tramite RunAPI

Un’unica autenticazione, tutti i provider

Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.

Prezzi e billing unificati

Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.

Skill con schema

Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.

Domande su OmniHuman

Quali input richiede OmniHuman audio-to-video?

Audio-to-video richiede un URL dell'immagine sorgente e un URL dell'audio sorgente. URL di maschere opzionali, indicazioni del prompt, risoluzione, modalità veloce, seed e URL di callback possono rifinire il task.

Cosa restituisce Human Identification?

Human Identification analizza una singola immagine sorgente e restituisce output immagine che identificano regioni umane per revisione o pre-elaborazione.

Cosa restituisce Subject Detection?

Subject Detection analizza una singola immagine sorgente e restituisce output di maschera utilizzabili come `mask_urls` in una richiesta OmniHuman audio-to-video.

Quando dovrei passare `mask_urls`?

Passa URL di maschera quando vuoi un isolamento più forte del soggetto o quando un task subject-detection precedente ha prodotto maschere per la stessa immagine sorgente.

Quali risoluzioni di output sono supportate?

OmniHuman audio-to-video supporta output 720p e 1080p; 1080p è il valore predefinito quando la richiesta non specifica una risoluzione.

Da quale variante dovrei iniziare?

Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.

MODELLI SIMILI

Se ti piace l'API OmniHuman, prova questi

Inizia a sviluppare con l'API OmniHuman.