Uma API key
Use as mesmas credenciais entre modelos e provedores.
It looks like you may prefer a different language. Switch anytime.
Use a API do OmniHuman via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman gera vídeo de cabeça falante a partir de uma imagem de origem e áudio condutor. Endpoints auxiliares podem identificar regiões humanas e retornar máscaras de sujeito que podem ser passadas na solicitação audio-to-video.
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| audio_to_video | 720p, 1080p | — | $0.32 / second |
Preços exibidos para omnihuman-1.5. Outras variantes mantêm seus próprios preços por endpoint.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
OmniHuman pertence ao catálogo Bytedance na RunAPI e expõe geração audio-to-video mais auxiliares human-identification e subject-detection por superfícies unificadas de API, SDK, CLI, Bruno e documentação.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
Audio-to-video exige uma URL de imagem de origem e uma URL de áudio de origem. URLs de máscara opcionais, orientação de prompt, resolução, modo rápido, seed e URL de callback podem refinar a tarefa.
Human Identification analisa uma imagem de origem e retorna saídas de imagem que identificam regiões humanas para revisão ou pré-processamento.
Subject Detection analisa uma imagem de origem e retorna saídas de máscara que podem ser usadas como `mask_urls` em uma solicitação OmniHuman audio-to-video.
Passe URLs de máscara quando quiser um isolamento de sujeito mais forte ou quando uma tarefa anterior de subject-detection produziu máscaras para a mesma imagem de origem.
OmniHuman audio-to-video aceita saída em 720p e 1080p; 1080p é o padrão quando a solicitação não especifica resolução.
Instale o model skill e siga as notas de setup com sua chave RunAPI.