Alphabet(GOOGL-US)傘下のGoogle DeepMindは今週、次世代ロボット人工知能モデル「Gemini Robotics 2」を正式にリリースした。この画期的な進展により、人間型ロボットが頭からつま先まで全身の動きを協調させることが可能となり、このテック大手が人工知能の能力を物理世界へ拡張する競争において、決定的な一歩を踏み出したことを意味している。

Gemini Robotics 2の最大の技術的特徴は、人間型ロボットの制御範囲を従来の上半身に限定されていたものから、全身制御へと拡大したことにある。これは、ロボットが複雑な推論タスクを実行する一方で、歩行、しゃがみ込み、物体の精密な操作といった高難度の動作を同時に実行できることを意味する。

最近の報道陣向けデモでは、このモデルがApptronik社のApollo人間型ロボットを制御し、障害物を自主的に避け、部屋を横切り、水差しを正確に拾って低い棚に設置するという一連のタスクを成功裏に完了した。このプロセスは非常に高い自律的協調性を示している。

同時に、Google DeepMindはGemini Robotics ER 2とOn-Device 2という2つの関連モデルも公開した。これらは個別に動作することができるほか、協調して動作することも可能で、ロボットが多段階のタスクを計画し、複数のロボットが共同で作業を実行することを支援することを目的としており、ロボットAIのソフトウェアエコシステムをさらに強化している。

今回の発表は、実体人工知能分野におけるグーグルの強力な実力を示しているが、同社は技術の現状に対して冷静な見方を維持している。Google DeepMindのロボット部門副社長であるCarolina Parada氏は、同社の長期的な目標はAIを物理世界に導入し、汎用的で効率的なロボット知能層を構築することであると強調している。

しかし、ロボット部門の責任者であるKanishka Rao氏は、真の意味でのロボットの柔軟性を追求することは依然として長期的な課題であると認めている。

現在、ロボットの動作プロセスは依然としてやや遅く、意図的である。なぜなら、ロボットは人間が直感的に完了できる判断を行う前に、処理と思考のために停止しなければならないからである。これは、人間型ロボットの商業化の進展に対して、より慎重な視点を提供している。

今回のモデル発表は、グーグルがロボット分野での戦略を継続的に深化させていることの証左であるだけでなく、10年以上にわたる同社のロボットに対する野望を再燃させている。2025年に初代Gemini Roboticsを発表して以来、グーグルは言語と視覚情報をロボットの動作に変換する開発方向性を再確立した。

過去を振り返ると、グーグルのロボット分野における展開は順風満帆ではなかった。2010年代初頭の集中買収、その後の事業縮小、さらには2023年にEveryday Robots部門を閉鎖した経緯がある。しかし、今回の頻繁かつ高強度の技術発表は、グーグルがこの分野への投資を再び強化していることを示している。

人工知能の戦線が拡大する中、グーグルはロボット分野で激しい外部競争に直面している。OpenAIは現在、視覚、言語、動作を統合する汎用基礎モデルの開発を積極的に進めている。一方、NVIDIAは強力なソフトウェアツールチェーンを提供することで、AI駆動ロボットの開発者を支援している。

技術競争と市場の期待が交錯する中、グーグルはGemini Roboticsシリーズモデルを通じて、将来の人間型ロボット産業において技術的優位を確立しようとしている。

FACT BOX ・ 要点整理

  • 出典:PR Times
  • 分類:新製品
  • 関連組織:Alphabet / Google DeepMind / Apptronik
  • 製品・サービス:Gemini Robotics 2 / Gemini Robotics ER 2