Google DeepMindが発表した「Gemini Robotics」は、視覚と言語を結びつけた高度なAIモデルで、ロボットの性能を大幅に向上させています。
この技術は、家庭や産業でのロボット活用を進化させ、特に繊細な作業や安全な動作が可能になることで、社会におけるロボットの役割を変える可能性があります。
記事の概要
米Googleの研究部門、Google DeepMindは2025年3月12日にロボット向けの新しいAIモデル「Gemini Robotics」を発表しました。
このモデルは、視覚と言語を行動に変換するVLAモデルと、高度な空間認識を実現する「Gemini Robotics-ER」の2つで構成されています。
Gemini Roboticsは「一般性」「双方向性」「器用さ」の3つの性能指標で、既存のAIよりも大幅に向上したとされています。
実際のデモでは、ロボットアームが折り紙を折ったり、ミニゲームでバスケットボールをシュートする様子が公開されました。
また、Gemini Robotics-ERは、オブジェクトの検出や安全な動作を理解する能力を強化しており、コーヒーマグの持ち方を直感的に理解できるとされています。
さらに、DeepMindは米スタートアップのApptronikと提携し、次世代ヒューマノイドロボットの開発を進めているとのことです。
記事のポイント
- 汎用性の向上: Gemini Roboticsは、真の汎用ロボットに近づく性能の向上を実現しました。
- 空間認識力の強化: Gemini Robotics-ERは、高度な空間認識能力を持ち、直感的な操作が可能です。
- スタートアップとの提携: Google DeepMindは、米スタートアップと提携し、次世代ヒューマノイドロボットの開発を進めています。
詳しい記事の内容はこちらから(引用元)
米Google(グーグル)の研究部門であるGoogle DeepMindは2025年3月12日、ロボット向けAI(人工…
https://xtech.nikkei.com/atcl/nxt/news/24/02279/