グーグルのVLOGGERは、写真から高品質な動画を生成するAIツールです。
人物の表情や身体の動きを正確に再現し、音声に基づいてアニメーション化も可能です。
オンラインコミュニケーションや教育など、新しいユースケースを実現する可能性があります。
一方で、ディープフェイクの新境地を開拓してしまう懸念もありますが、研究チームは社会的影響についても考慮しています。
最先端のアバター生成を目指しているVLOGGERは、自然な会話をサポートするためのツールです。
記事の概要
Googleの研究者らが開発した「VLOGGER」は、1枚の人物画像から高品質の動画を生成することができるAIツールです。
顔の表情や身体の動きを正確に再現でき、これまでの人物画像に話をさせるソフトウェアを上回る品質を実現しています。
VLOGGERは、動画を音声サンプルに基づいてアニメーション化することも可能で、制御可能な肖像として動画をアニメーション化することができます。
この技術はヘルプデスクのアバターやオンラインコミュニケーション、教育、バーチャルアシスタントの強化など、さまざまなユースケースに活用できる可能性があります。
一方で、VLOGGERはディープフェイクの新たな可能性をもたらす一方、社会的な影響も懸念されています。
VLOGGERは、拡散という技術を用いて高解像度の動画フレームを生成し、最先端のアバターの不正確さを克服することを目指しています。
マルチモダリティーの統合や拡散技術の進化など、最新のトレンドを取り入れたVLOGGERは、AI技術の進化とともにますます高度な表現力を持つことが期待されています。
記事のポイント
- 「VLOGGER」は、1枚の人物画像から高品質の動画を作成することができる。
- 生成される動画は、顔の表情や身体の動きを瞬きに至るまで正確に表現することができる。
- VLOGGERは、音声サンプルに基づいてアニメーション化された動画を生成できるため、擬人化された会話エージェントや共感を育む動画など、様々なユースケースに活用できる可能性がある。
詳しい記事の内容はこちらから(引用元)
グーグルは、1枚の人物画像を基に、その人物が話をする動画を生成できる「VLOGGER」を発表した。同社の研究チームが明ら…
https://japan.zdnet.com/article/35217036/