映像と音声を同時生成、リップシンク再発生なし。制作サイクルが体感で短縮される
MiniMax H3がLuma Agentsで利用可能に
原題: MiniMax H3 Available Now | Luma
重要度の根拠: 新規ビデオ生成モデルの段階的GA で、ユーザーサブセットに影響。ワークフロー簡素化は実装価値があるが、エンタープライズ利用には時間差あり。
要約
Luma LabsがMiniMax H3をLuma Agentsで提供開始した。テキスト・画像・動画・音声参照を一度に入力すると、映像と音声を同時生成する統合ワークフローが実現する。従来は映像生成→音声選定→ミックスという3段階の処理が必要だったが、H3は一度の処理で完結し、リップシンクズレの再発生を防ぐ。8月5日時点でセルフサーブ(非エンタープライズ)ユーザーのみ利用可能。
要点
- テキスト・画像・動画・音声をまとめて入力、映像と音声を一度に生成
- 従来の3段階(映像生成→音声探索→ミックス)から1パスに短縮
- リップシンクズレの再作業が不要になり、制作サイクル高速化
- セルフサーブ非エンタープライズ向けから先行展開、エンタープライズは段階的
本文の日本語訳(全文)を見る
MiniMax H3がLuma Agentsで利用可能になりました。
あなたが映像の見た目、モーション、音を指定します。MiniMax H3はLuma Agentsで本日より利用開始でき、セルフサーブアカウントで利用可能です。プロンプト、キーフレーム、参照クリップ、音声メモを持ち込んでください。H3は映像と一致した音声を一度の生成で作成します。別途、音声を探したり、後でミックスする段階は必要ありません。
1度の生成で済む、3度ではなく
ほとんどのビデオワークフローは今なお、作業を分割しています。まず映像を生成し、次に音声を探し、最後にミックスします。すべてのやり取りは、リップシンクのズレが生じる可能性があり、ズレを修正する唯一の方法は最初からやり直すことです。
H3はそのギャップを埋めます。テキスト、画像、ビデオ、音声参照が一緒に入力されます。ダイアログ、効果音、環境音は、すでに画面に映っているものとタイミングが合わせられた状態で出力されます。
より広い創作の幅。Lumaとの1つの継続的なワークフロー。
MiniMax H3はセルフサーブ、非エンタープライズアカウント向けに今すぐ利用可能です。8月5日時点で、これが唯一のアクセスポイントです。さらに展開が進む場合は、ここでお知らせします。今日試してみてください。簡潔なブリーフと参照音声から始めて、すでに音声を持つシーンに戻ってきてください。
出典: https://lumalabs.ai/news/minimax-h3-now-available-in-luma-agents
媒体: Luma Labs
※本記事は Anthropic / OpenAI / Google / Meta / Mistral / DeepSeek / Sakana 等各社の公開情報を基に AI (OpenAI GPT-4o-mini) が日本語で要約・分類した二次的著作物です。著作権法第32条の引用要件に基づき出典 URL を必ず併記しています。要約は AI 生成のため誤訳・誤解釈を含む可能性があります。詳細・正確な情報は必ず出典元の原文をご確認ください。