It looks like you may prefer a different language. Switch anytime.

Bytedance · Utility

Hermes Agent x OmniHuman

OmniHuman は RunAPI の Bytedance カタログに属し、audio-to-video 生成に加えて human-identification と subject-detection のヘルパーを、API、SDK、CLI、Bruno、ドキュメントの統一されたサーフェスで提供します。

3 variants から $0.0000 商用利用対応

Prerequisite: npx runapi mcp install

Prompt

プロンプトモデル

タスクに合う場合は omnihuman-1.5 を使用してください: ポートレートと駆動音声から音声駆動のトーキングヘッド動画を生成。

You have access to RunAPI task tools for OmniHuman.

Available OmniHuman models:
- omnihuman-1.5: ポートレートと駆動音声から音声駆動のトーキングヘッド動画を生成
  endpoints: /api/v1/omnihuman/audio_to_video
  request fields: model, source_image_url, source_audio_url, prompt
- omnihuman-1.5-human-identification: ソース画像内の人物領域を識別するヘルパータスク
  endpoints: /api/v1/omnihuman/human_identification
  request fields: model, source_image_url
- omnihuman-1.5-subject-detection: OmniHuman 生成向けの被写体マスクを返すヘルパータスク
  endpoints: /api/v1/omnihuman/subject_detection
  request fields: model, source_image_url

Use the model ID and endpoint that match the user's request.
Example prompt: このポートレートとナレーション音声から 720p のトーキングヘッド動画を生成し、被写体マスクで話者を分離してください。
/api/v1/omnihuman/audio_to_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/omnihuman/audio_to_video を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/omnihuman/audio_to_video/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/omnihuman/human_identification: Submit the task, poll for its status, then verify the completed output. POST /api/v1/omnihuman/human_identification を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/omnihuman/human_identification/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。
/api/v1/omnihuman/subject_detection: Submit the task, poll for its status, then verify the completed output. POST /api/v1/omnihuman/subject_detection を実行し、返された Task ID を保存します。
ステータスが completed または failed になるまで GET /api/v1/omnihuman/subject_detection/<task-id> を実行します。
completed レスポンスに API リファレンス記載のエンドポイント固有出力が含まれることを確認します。

公開バージョンとエンドポイント

モデル ID エンドポイント 開始価格 モデルカタログ
omnihuman-1.5
/api/v1/omnihuman/audio_to_video
$0.320 モデル詳細
omnihuman-1.5-human-identification
/api/v1/omnihuman/human_identification
$0.0000 モデル詳細
omnihuman-1.5-subject-detection
/api/v1/omnihuman/subject_detection
$0.0000 モデル詳細

検証

Task が終端状態になるまでポーリングします

<model-id> を選択すると検証コマンドが生成されます。

設定

ガイドエンドポイント: <endpoint>

<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
利用手順

3ステップで始める

  1. モデル ID を選択

    公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。

  2. RunAPI を設定

    エンドポイントを呼び出す前に RUNAPI_API_KEY を設定します。

  3. 結果を検証

    非同期エンドポイントでは、Task が終端状態になるまで同じエンドポイントをポーリングします。

Hermes Agent + OmniHuman で作れるもの

  • 商品デモ動画

    テキストの説明から 5〜10 秒の商品アニメーションを生成します。EC 掲載やソーシャル広告に適しています。

  • AI アバターコンテンツ

    研修資料、カスタマーサポート、マーケティング向けにリップシンクしたアバター動画を作成します。

  • 動画の一括制作

    数百件の動画生成をキューに入れ、webhook で結果を受け取れます。

OmniHuman を RunAPI + Hermes Agent で使う理由

  • 3 個のバリアントを 1 つの API キーで

    RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。

  • わかりやすい利用料金

    リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。

  • タスクの自動ワークフロー

    手動のポーリングコードを書かずに、統一されたタスクフローで非同期の結果を送信、確認、取得できます。

Hermes Agent + OmniHuman に関するよくある質問

どのモデル ID を使うべきですか?

バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。

このガイドはチャットモデルを設定しますか?

いいえ。この Model Line はここに示すエンドポイント手順を使用し、Agent のチャットモデルとしては扱いません。

Hermes AgentでOmniHumanを使い始める

チームで構築していますか?

エンタープライズ導入、連携、技術的なご相談をお手伝いします。

お問い合わせ