It looks like you may prefer a different language. Switch anytime.

Utility Bytedance

OmniHuman API

Accede a la API de OmniHuman a través de RunAPI con una habilidad de modelo, autenticación unificada y precios de pago por uso.

runapi.ai
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "omnihuman-1.5-subject-detection",
  "image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";

const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"

client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
    model: "omnihuman-1.5-subject-detection",
    image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/omnihuman v1
RESUMEN

Acerca de OmniHuman

OmniHuman genera vídeo de cabeza parlante a partir de una imagen fuente y audio de conducción. Los endpoints auxiliares pueden identificar regiones humanas y devolver máscaras de sujeto que se pueden pasar a la solicitud audio-to-video.

Proveedor
Bytedance
Modalidad
Utility

Variantes

Variante Facturación Precios
omnihuman-1.5 second $0.320 Ver →
omnihuman-1.5-human-identification call $0.0000 Ver →
omnihuman-1.5-subject-detection call $0.0000 Ver →
PRECIOS

Precios de OmniHuman

Endpoint Resolución Duración Precio
audio_to_video 720p, 1080p $0.32 / second

Precios mostrados para omnihuman-1.5. Otras variantes mantienen sus propios precios por endpoint.

Integración de agentes

Ejecuta OmniHuman desde un agente

CÓMO FUNCIONA

Empieza con OmniHuman

  1. Elige el modelo

    Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

  2. Autentica una vez

    Usa tu clave RunAPI para todos los modelos compatibles.

  3. Instala el skill

    Añade el model skill a tu workspace de código antes de implementar la función.

  4. Recibe la salida

    Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja OmniHuman

OmniHuman pertenece al catálogo de Bytedance en RunAPI y expone generación audio-to-video más auxiliares de human-identification y subject-detection mediante superficies unificadas de API, SDK, CLI, Bruno y documentación.

Proveedor
Bytedance
Ver todo →
Modalidad
Utility
Explorar modelos →

Por qué usar OmniHuman mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

Preguntas sobre OmniHuman

¿Qué entradas requiere OmniHuman audio-to-video?

Audio-to-video requiere una URL de imagen fuente y una URL de audio fuente. Las URL de máscara, las indicaciones de prompt, la resolución, el modo rápido, seed y la URL de callback pueden refinar la tarea.

¿Qué devuelve Human Identification?

Human Identification analiza una imagen fuente y devuelve salidas de imagen que identifican regiones humanas para revisión o preprocesamiento.

¿Qué devuelve Subject Detection?

Subject Detection analiza una imagen fuente y devuelve salidas de máscara que se pueden usar como `mask_urls` en una solicitud OmniHuman audio-to-video.

¿Cuándo debería pasar `mask_urls`?

Pasa URL de máscara cuando quieras un aislamiento de sujeto más fuerte o cuando una tarea previa de subject-detection haya producido máscaras para la misma imagen fuente.

¿Qué resoluciones de salida admite?

OmniHuman audio-to-video admite salida 720p y 1080p; 1080p es el valor predeterminado cuando la solicitud no especifica resolución.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

MODELOS SIMILARES

Modelos similares a OmniHuman

Empieza a construir con OmniHuman.