It looks like you may prefer a different language. Switch anytime.

Utility Bytedance

OmniHuman API

Use a API do OmniHuman via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.

runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
VISÃO GERAL

Sobre OmniHuman

OmniHuman gera vídeo de cabeça falante a partir de uma imagem de origem e áudio condutor. Endpoints auxiliares podem identificar regiões humanas e retornar máscaras de sujeito que podem ser passadas na solicitação audio-to-video.

Provedor
Bytedance
Modalidade
Utility

Variantes

Variante Cobrança Preços
omnihuman-1.5 second $0.320 Ver →
omnihuman-1.5-human-identification call $0.0000 Ver →
omnihuman-1.5-subject-detection call $0.0000 Ver →
PREÇOS

Preços de OmniHuman

Endpoint Resolução Duração Preço
audio_to_video 720p, 1080p $0.32 / second

Preços exibidos para omnihuman-1.5. Outras variantes mantêm seus próprios preços por endpoint.

Integração com agentes

Execute OmniHuman a partir de um agente

COMO FUNCIONA

Comece com OmniHuman

  1. Escolha o modelo

    Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

  2. Autentique uma vez

    Use sua chave RunAPI para todos os modelos compatíveis.

  3. Instale o skill

    Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

  4. Receba a saída

    Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde OmniHuman se encaixa

OmniHuman pertence ao catálogo Bytedance na RunAPI e expõe geração audio-to-video mais auxiliares human-identification e subject-detection por superfícies unificadas de API, SDK, CLI, Bruno e documentação.

Provedor
Bytedance
Ver tudo →
Modalidade
Utility
Explorar modelos →

Por que usar OmniHuman pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

Perguntas sobre OmniHuman

Quais entradas o OmniHuman audio-to-video exige?

Audio-to-video exige uma URL de imagem de origem e uma URL de áudio de origem. URLs de máscara opcionais, orientação de prompt, resolução, modo rápido, seed e URL de callback podem refinar a tarefa.

O que Human Identification retorna?

Human Identification analisa uma imagem de origem e retorna saídas de imagem que identificam regiões humanas para revisão ou pré-processamento.

O que Subject Detection retorna?

Subject Detection analisa uma imagem de origem e retorna saídas de máscara que podem ser usadas como `mask_urls` em uma solicitação OmniHuman audio-to-video.

Quando devo passar `mask_urls`?

Passe URLs de máscara quando quiser um isolamento de sujeito mais forte ou quando uma tarefa anterior de subject-detection produziu máscaras para a mesma imagem de origem.

Quais resoluções de saída são compatíveis?

OmniHuman audio-to-video aceita saída em 720p e 1080p; 1080p é o padrão quando a solicitação não especifica resolução.

Como chamo este modelo?

Instale o model skill e siga as notas de setup com sua chave RunAPI.

MODELOS SIMILARES

Modelos similares a OmniHuman

Comece a construir com OmniHuman.