Google DeepMind、全身制御とマルチモーダル推論を統合したGemini Robotics 2を公開
Google DeepMindは、ロボットの全身制御と高度な推論を可能にする次世代知能レイヤー「Gemini Robotics 2」を発表しました。従来のロボット制御が、事前定義された限定的なタスクやテレオペレーションに依存していたのに対し、本モデルはマルチモーダルな理解力をベースに、足元から指先までを統合的に制御する点が特徴です。これにより、障害物の多い部屋での清掃作業のように、歩行・屈伸・物体操作を組み合わせた動的なタスクへの適応を実現しています。
技術的には、個別の動作プログラムではなくGeminiの推論エンジンを直接アクションへ結びつけるアプローチを強化しました。ヒューマノイドが複数のロボットと連携して作業を分担するチームワーク機能も備えており、単一の機体では困難な広範囲の作業を高速化できます。また、異なるロボット筐体間での学習スキル転用という長年の課題に対しても、汎用的な知能層としての解決策を提示しています。
以前の制御システムでは環境の変化に対する適応力が低く、プログラミングされていない不測の事態には対応できませんでしたが、新世代では推論に基づいたリアルタイムな行動修正が可能です。ただし、現実世界での物理的な行動はモデルの推論精度に依存するため、多様なハードウェア構成における具体的な応答性能や、学習データの転送効率については個別の検証が必要となります。
Related tools
この記事に関連するおすすめツール
比較検討しやすい導入候補を優先して表示しています。一部リンクは広告・アフィリエイトを含む場合があります。
出典: DeepMind Blog
要点を短く整理して掲載しています。詳細は出典を確認してください。