Googleは2026年7月30日、人型ロボットをより高度に制御し、幅広い複雑なタスクを完了できるようになる次世代の物理AIモデル
One brain. For any robot. 🤖
— Google DeepMind (@GoogleDeepMind) July 30, 2026
We’re launching Gemini Robotics 2: our next-generation physical AI bringing full body intelligence to humanoids, advanced dexterity, multi-robot teamwork and more. pic.twitter. com/ 1rFw3NUytb
Gemini Robotics 2は、ロボットがあらゆる動作を論理的に推論し、幅広いタスクに対応できるようにする。たとえば、人型ロボットが歩いて、しゃがんで、体を伸ばしたり、物を操作したりして、散らかった部屋を片付けることができる。他のロボットと連携して作業をより迅速に完了させることも可能。こうした高度なインテリジェンスはデバイス上でローカルに動作し、数時間で全く新しいロボットボディにもシームレスに適応できる。
今回発表されたのは以下の3つのモデル。
- Gemini Robotics 2
- 視覚と言語入力を運動制御に変換し、ロボットの動作を可能にする、最先端の視覚・
言語・ 動作 (Vision-Language-Action:VLA) モデル。足から指先まで全身を制御できるヒューマノイドロボットの制御も、2腕ロボットの制御も可能。また、両手とグリッパーにおける高度な操作性も実現している。 - Gemini Robotics ER 2
- 最も高性能な具現化推論
(Embodied Reasoning:ER) モデル。ロボットが人間とコミュニケーションを取り、物理世界を理解し、数分かかる複数ステップのタスクを計画することを可能にする、エージェントとして機能する視覚・ 言語モデル (VLM) でもある。ロボットがチームとして連携して作業する機能も装備される。 - Gemini Robotics On-Device 2
- ロボットデバイス上でローカルに動作するように最適化された、最も効率的なVLAモデル。わずか数時間分のデータで、全く別の新しいロボットの形態にも迅速に適応できるという。
今回初めて、AIモデルで人型ロボット全体を制御できるようになり、意図をインテリジェントな全身制御へと変換することが可能となった。たとえば、Apptronik社の人型ロボット
Gemini Robotics 2 moves physical AI beyond tabletop tasks, enabling intelligent whole-body control for humanoids.
— Google DeepMind (@GoogleDeepMind) July 30, 2026
Watch @Apptronik's Apollo 2 process a single prompt to reach, bend, and pick up a watering can ↓ pic.twitter. com/ nBm3IEoI7i
Gemini Robotics ER 2はGoogle AI Studioで利用可能になっており、Gemini Enterprise Agent Platformではプライベートプレビュー版が提供されている。
また、Gemini Robotics 2とGemini Robotics On-Device 2は早期アクセスパートナー向けに提供が始まっている。
これらのモデルをハードウェアに導入する方法については、開発者向けブログを参照。