Utility · Bytedance

OmniHuman API

Acesso à API OmniHuman para vídeo de cabeça falante guiado por áudio, identificação humana e detecção de máscaras de sujeito.

Operacional · 3 variants · a partir de $0.0000
runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
VISÃO GERAL

OmniHuman gera vídeo de cabeça falante a partir de uma imagem de origem e áudio condutor. Endpoints auxiliares podem identificar regiões humanas e retornar máscaras de sujeito que podem ser passadas na solicitação audio-to-video.

  • Variantes para diferentes metas de qualidade e latência
  • API key unificada
  • O model skill inclui documentação, schemas e notas de setup
  • Gerações com falha não são cobradas
VARIANTES

Variantes

Variant Billing Pricing
omnihuman-1.5 second $0.320 Ver →
omnihuman-1.5-human-identification call $0.0000 Ver →
omnihuman-1.5-subject-detection call $0.0000 Ver →
MODELS

Instale o skill OmniHuman para desenvolver apps

Carregue documentação do modelo, schemas, notas de preço e etapas de setup no seu workspace de código.

# Install the model skill for app development workflows
npx skills add runapi-ai/omnihuman -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the OmniHuman skill for this app:

1. Add runapi-ai/omnihuman with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
COMO FUNCIONA

Como construir com este model skill

01

Escolha o modelo

Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

02

Autentique uma vez

Use sua chave RunAPI para todos os modelos compatíveis.

03

Instale o skill

Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

04

Receba a saída

Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde OmniHuman se encaixa

OmniHuman pertence ao catálogo Bytedance na RunAPI e expõe geração audio-to-video mais auxiliares human-identification e subject-detection por superfícies unificadas de API, SDK, CLI, Bruno e documentação.

Provider
Bytedance
Modality
Utility
POR QUE RUNAPI

Por que usar OmniHuman pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

FAQ

Perguntas frequentes

Quais entradas o OmniHuman audio-to-video exige?

Audio-to-video exige uma URL de imagem de origem e uma URL de áudio de origem. URLs de máscara opcionais, orientação de prompt, resolução, modo rápido, seed e URL de callback podem refinar a tarefa.

O que Human Identification retorna?

Human Identification analisa uma imagem de origem e retorna saídas de imagem que identificam regiões humanas para revisão ou pré-processamento.

O que Subject Detection retorna?

Subject Detection analisa uma imagem de origem e retorna saídas de máscara que podem ser usadas como `mask_urls` em uma solicitação OmniHuman audio-to-video.

Quando devo passar `mask_urls`?

Passe URLs de máscara quando quiser um isolamento de sujeito mais forte ou quando uma tarefa anterior de subject-detection produziu máscaras para a mesma imagem de origem.

Quais resoluções de saída são compatíveis?

OmniHuman audio-to-video aceita saída em 720p e 1080p; 1080p é o padrão quando a solicitação não especifica resolução.

Como chamo este modelo?

Instale o model skill e siga as notas de setup com sua chave RunAPI.

Gerações com falha custam dinheiro?

Gerações com falha não são cobradas

Posso chamar a partir da minha aplicação?

Sim. Instale o model skill no workspace de código e use durante a implementação da funcionalidade.

COMEÇAR

Comece a construir com OmniHuman.