アリババが発表した動画生成AI「Wan 2.5-Preview」は、1080pの高解像度動画を短時間で生成可能です。
この技術の進化は、映像制作の効率を大幅に改善し、個人や企業が手軽にコンテンツを作成できる新たな時代を迎えることを示唆しています。
マルチモーダル処理や強化学習の導入により、品質も向上しており、今後の活用が期待されます。
記事の概要
アリババは9月24日に、無料の動画生成AIモデル「Wan」の最新プレビュー版「Wan 2.5-Preview」を発表しました。
この新しいモデルは、1080p HDレベルの解像度で約10秒の動画を生成することができます。
公式サイトで試用可能で、テキストや画像、音声、映像などを統合的に処理するマルチモーダル性能を備えています。
具体的には、ギターを弾いたり、口の動きに合わせて歌を歌ったりする動画を生成することができます。
また、人間のフィードバックを活用した強化学習により、品質と表現が向上しています。
さらに、画像編集機能も強化され、多様な画風への変更や文字のレンダリング、色彩の変更が可能になり、利用の幅が広がっています。
現在、APIが関係各社に提供されており、さまざまなAIプラットフォームを通じて利用可能です。
記事のポイント
- 高解像度の動画生成: 新しい「Wan 2.5-Preview」は1080p HDレベルの解像度で動画を生成できるため、視覚的なクオリティが向上しています。
- マルチモーダル性能: テキスト、画像、音声、映像を統合的に処理できる機能により、より多様なコンテンツ制作が可能になりました。
- 強化学習の導入: 人間のフィードバックを活用することで、より好ましい品質と表現を実現しており、ユーザー体験が向上しています。
詳しい記事の内容はこちらから(引用元)
アリババは9月24日、動画生成AIモデル「Wan」最新プレビュー版「Wan 2.5-Preview」を発表した。1080…
https://ascii.jp/elem/000/004/321/4321870/