Una API key
Usa las mismas credenciales entre modelos y proveedores.
It looks like you may prefer a different language. Switch anytime.
Accede a la API de OmniHuman a través de RunAPI con una habilidad de modelo, autenticación unificada y precios de pago por uso.
curl -X POST https://runapi.ai/api/v1/omnihuman/audio_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "omnihuman-1.5-subject-detection",
"image_url": "https://cdn.runapi.ai/public/samples/portrait.jpg",
"audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { OmnihumanClient } from "@runapi.ai/omnihuman";
const client = new OmnihumanClient();
const result = await client.audioToVideo.run({
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
require "runapi/omnihuman"
client = RunApi::Omnihuman::Client.new
result = client.audio_to_video.run(
model: "omnihuman-1.5-subject-detection",
image_url: "https://cdn.runapi.ai/public/samples/portrait.jpg",
audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/omnihuman -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
OmniHuman genera vídeo de cabeza parlante a partir de una imagen fuente y audio de conducción. Los endpoints auxiliares pueden identificar regiones humanas y devolver máscaras de sujeto que se pueden pasar a la solicitud audio-to-video.
| Endpoint | Resolución | Duración | Precio | |
|---|---|---|---|---|
| audio_to_video | 720p, 1080p | — | $0.32 / second |
Precios mostrados para omnihuman-1.5. Otras variantes mantienen sus propios precios por endpoint.
Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.
Usa tu clave RunAPI para todos los modelos compatibles.
Añade el model skill a tu workspace de código antes de implementar la función.
Consulta por task ID o procesa el callback cuando termine la generación.
OmniHuman pertenece al catálogo de Bytedance en RunAPI y expone generación audio-to-video más auxiliares de human-identification y subject-detection mediante superficies unificadas de API, SDK, CLI, Bruno y documentación.
Usa las mismas credenciales entre modelos y proveedores.
El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.
El precio por uso es visible antes de llamar.
Audio-to-video requiere una URL de imagen fuente y una URL de audio fuente. Las URL de máscara, las indicaciones de prompt, la resolución, el modo rápido, seed y la URL de callback pueden refinar la tarea.
Human Identification analiza una imagen fuente y devuelve salidas de imagen que identifican regiones humanas para revisión o preprocesamiento.
Subject Detection analiza una imagen fuente y devuelve salidas de máscara que se pueden usar como `mask_urls` en una solicitud OmniHuman audio-to-video.
Pasa URL de máscara cuando quieras un aislamiento de sujeto más fuerte o cuando una tarea previa de subject-detection haya producido máscaras para la misma imagen fuente.
OmniHuman audio-to-video admite salida 720p y 1080p; 1080p es el valor predeterminado cuando la solicitud no especifica resolución.
Instala el model skill y sigue sus notas de setup con tu clave RunAPI.