Google、ロボットの知能を向上させるGemini Robotics ER 2を発表

Google は、Gemini Robotics ER 2 を発表しました。これは、ロボットに高度な知能を提供し、物理的な世界での応用を促進するための全く新しいモデルです。このモデルは、リアルタイムの空間推論、マルチステップタスク計画、およびマルチロボット協力能力を備えており、ロボットが現実の環境で人間をより効果的に支援できるようにします。

Gemini Robotics ER 2 の機能と特徴

Gemini Robotics ER 2 は、ロボットの「高度な脳」として説明されており、迅速に思考し、マルチステップタスクを計画し、他のロボットと協力することができます。このモデルは、ビデオストリームを通じてロボットの進捗を追跡し、エラーが発生した際にはリアルタイムで修正を行うことができます。Google は、この技術がロボットの現実世界における安全性と実用性を向上させることを目的としていると述べています。

“Gemini Robotics ER 2 は大きなアップグレードを代表しており、継続的なビデオストリームを通じて進捗を追跡し、問題が発生した際には調整を行い、ロボットが正確にタスクを完了できるようにします。”

Google

マルチロボット協力とタスク管理

このモデルのもう一つの重要な特徴は、マルチロボット協力をサポートしていることであり、異なるタイプのロボットが共有空間で協力して、単一のロボットでは完了できない複雑なタスクを実行できるようになります。Google は、この機能が作業効率を大幅に向上させ、ロボットの応用範囲を拡大することを強調しています。

“Gemini Robotics ER 2 は、ロボットが共有された意味理解の下で協力し、より複雑なタスクを完了できるようにします。”

Google

ロボットの安全性と知能能力の向上

Gemini Robotics ER 2 は、安全性の面でも顕著な進展を遂げており、推論タスクを実行する際に物理的制約に従い、人間の存在を効果的に検出することができます。Google は、このモデルが人間が近づいていることを検出した際に自動的にロボットの操作を停止し、エリアが空になった後に再び作業を続けることができると述べています。

“Gemini Robotics ER 2 は、私たちの最も安全なモデルであり、タスクを実行する際に安全指示に効果的に従うことができます。”

Google

Gemini Robotics ER 2 は、現在 Gemini API、Google AI Studio、および Gemini Enterprise Agent Platform を通じて開発者に公開されており、開発者は自分の物理 AI エージェントを構築し始めることができます。

資料出典:Google 公式発表

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle