Google DeepMind、全身制御と高度な器用さを実現したGemini Robotics 2を公開
Google DeepMindは、次世代ロボット向けの知能レイヤーであるGemini Robotics 2を発表しました。このモデルはGeminiのマルチモーダル理解能力を現実世界の行動へと統合したもので、人型ロボットにおける「歩行・しゃがむ・伸ばす」といった全身の動作と、指先を用いた細かな操作を高度に連携させます。複数のロボットがチームとして協力し、分担して作業を完結させる能力も備えています。
従来のロボット制御の多くは、狭い範囲の反復作業に対して事前プログラミングやテレオペレーション(遠隔操作)を行う手法が主流であり、予測不可能な環境への適応能力が欠如していました。Gemini Robotics 2では、全身を統合したインテリジェントな制御を実現することで、学習したスキルを異なるロボットの機体に移植することが困難だったという長年の課題を解決し、汎用的なタスクへの適応性を高めています。
実証実験では、散らかった部屋の片付けといった非定型なタスクにおいて、物体の認識から最適な移動経路の算出、器用な操作までの工程を推論を通じて実行できることが示されました。一方で、現実世界の多様な物理制約下における推論の安定性や、機体ごとのハードウェア特性に起因する挙動の差異については、実装環境に応じた検証が必要となります。
Related tools
この記事に関連するおすすめツール
比較検討しやすい導入候補を優先して表示しています。一部リンクは広告・アフィリエイトを含む場合があります。
出典: DeepMind Blog
要点を短く整理して掲載しています。詳細は出典を確認してください。