Gen-3 Alpha、動画生成の新時代が始まる!
Runway Gen-3 Alpha: 次世代AI動画生成の発表
原題: Runway Research | Runway Gen-3 Alpha: Next-Generation AI Video Generation
重要度の根拠: 新機能が多くのユーザーに影響を与えるため
要約
Runwayは、Gen-3 Alphaを発表しました。これは、新しいインフラ上でトレーニングされた次世代の基盤モデルで、動画と画像を同時に学習しています。Gen-2に対する大幅な改善があり、特に忠実性や一貫性、動きの表現力が向上しています。新しいツール群を通じて、テキストから動画、画像から動画、テキストから画像への生成が可能になり、ストーリーテリングの新しい機会を提供します。さらに、安全性を高めるためのビジュアルモデレーションシステムも導入されています。
要点
- Gen-3 Alphaは次世代AIモデル
- 動画と画像を同時に学習
- 新しい生成ツール群を提供
- 安全性向上のための新システム導入
- ストーリーテリングの機会を拡大
開発者向け技術解説(API・実装詳細・破壊的変更)を見る
Gen-3 Alphaは、Runwayが開発した次世代AI動画生成モデルで、動画と画像を同時に学習することにより、高度な表現力を実現しています。具体的には、テキストから動画、画像から動画、テキストから画像への生成ツールをサポートし、Motion BrushやAdvanced Camera Controlsといった従来の機能も強化されています。新たに導入されたビジュアルモデレーションシステムは、C2PAの出所基準に対応し、生成物の安全性を向上させます。また、詳細なキャプションによるトレーニングにより、シーン内の要素の正確なキーフレーミングが可能になっています。
本文の日本語訳(全文)を見る
Gen-3 Alphaは、Runwayが新しいインフラ上でトレーニングした次世代の基盤モデルであり、マルチモーダルなトレーニングを大規模に実施しています。これは、Gen-2に比べて忠実性、一貫性、動きにおいて大きな改善を示しており、一般的な世界モデルを構築するための一歩です。
動画と画像を共同でトレーニングしたGen-3 Alphaは、Runwayのテキストから動画、画像から動画、テキストから画像へのツールを支え、Motion BrushやAdvanced Camera Controls、Director Modeといった既存のコントロールモードのほか、構造、スタイル、動きに対するより詳細なコントロールを提供する新しいツールの公開も予定しています。
Gen-3 Alphaは、改善された社内のビジュアルモデレーションシステムやC2PAの出所基準を含む新たな安全対策とともに公開されます。
Gen-3 Alphaは、非常に詳細で時間的に密なキャプションでトレーニングされており、想像力豊かな遷移やシーンの要素の正確なキーフレーミングを可能にしています。
Gen-3 Alphaは、幅広いアクション、ジェスチャー、感情を持つ表現力豊かな人間キャラクターを生成する能力に優れており、新たなストーリーテリングの機会を解き放ちます。
Gen-3モデルのファミリーの一部として、私たちはエンターテインメントやメディアの主要な組織と連携し、Gen-3のカスタムバージョンを作成しています。
Gen-3モデルのカスタマイズは、スタイルをよりコントロールされた一貫したキャラクターを可能にし、特定のアートや物語の要件をターゲットにするなど、さまざまな機能を持っています。
カスタムモデルやファインチューニングに興味がある企業は、以下のボタンからフォームに記入してお問い合わせください。
出典: https://runway.com/research/introducing-gen-3-alpha
媒体: Runway
※本記事は Anthropic / OpenAI / Google / Meta / Mistral / DeepSeek / Sakana 等各社の公開情報を基に AI (OpenAI GPT-4o-mini) が日本語で要約・分類した二次的著作物です。著作権法第32条の引用要件に基づき出典 URL を必ず併記しています。要約は AI 生成のため誤訳・誤解釈を含む可能性があります。詳細・正確な情報は必ず出典元の原文をご確認ください。