6.0
关注
AI SCORE
模型发布2026-08-01 02:25
Gemini Robotics 2:机器人领域的通用视觉语言模型
The Decoder#Google Deepmind#机器人#VLM
Editor brief · 编辑速览
Google Deepmind 发布 Gemini Robotics 2,支持控制从桌面机械臂到人形机器人等多种形态。
Google Deepmind 推出了 Gemini Robotics 2,该公司将其称为目前最先进的视觉-语言-动作(VLA)模型。VLA 模型结合了图像识别、语言处理和动作控制,帮助机器人在物理环境中操作。Deepmind 表示,该模型可以控制从桌面机械臂到全身人形机器人的各种系统。
该公司将 Gemini Robotics 2 描述为新一代自适应机器人的"智能层"。根据 Deepmind 的说法,它可以管理全身运动、执行精细运动任务,并协调多个机器人。开发者可以通过等待列表申请早期访问权限。
Google Deepmind 还推出了 Gemini Robotics ER 2,这是一个为"具身推理"设计的模型。该术语指的是理解物理世界并根据该信息决定采取哪些行动。ER 2 作为机器人的更高级控制系统,取代了 4 月发布的 Gemini Robotics ER 1.6。新模型可在 Google AI Studio 中使用。
没有炒作的 AI 新闻——由人类策划
订阅 THE DECODER 获得无广告阅读、每周 AI 通讯、我们独家的"AI Radar"前沿报告(每年六次)、完整的存档访问权限和评论区访问权限。