谷歌DeepMind发布Gemini Robotics 2,赋能各类机器人

摘要
谷歌DeepMind推出Gemini Robotics 2,这是其最先进的视觉-语言-动作模型,可控制从桌面机械臂到人形机器人的各种形态。同时发布的Gemini Robotics ER 2为机器人任务提供更高层次的推理能力。
背景解释
该模型旨在让机器人更好地理解并执行复杂指令,推动机器人技术在工业、服务等领域的应用。对于普通科技读者,这意味着机器人将更智能、更灵活,未来可能在更多场景中协助人类工作。
原文译文
以下为抓取到的原文内容译文,已统一为站内阅读格式。
Google Deepmind 发布 Gemini Robotics 2,为从桌面机械臂到人形机器人的各种形态机器人提供动力
Google Deepmind 推出了 Gemini Robotics 2,并称其是目前最先进的视觉-语言-动作(VLA)模型。VLA 模型结合了图像识别、语言处理和动作控制,帮助机器人在物理环境中运行。Deepmind 表示,该模型可以控制从桌面机械臂到全身人形机器人的各种系统。
该公司将 Gemini Robotics 2 描述为新一代自适应机器人的“智能层”。据 Deepmind 称,它可以管理全身运动、执行精细动作任务,并协调多个机器人。开发者可以通过候补名单申请早期访问。
Google Deepmind 还推出了Gemini Robotics ER 2,这是一个专为“具身推理”设计的模型。该术语指的是理解物理世界并根据这些信息决定采取哪些行动。ER 2 作为机器人的高级控制系统,取代了4 月发布的 Gemini Robotics ER 1.6。新模型已在Google AI Studio中提供。广告 DEC_D_Incontent-1 广告
无炒作的人工智能新闻——由人类策划
订阅 THE DECODER,享受无广告阅读、每周人工智能通讯、每年六次的独家“AI 雷达”前沿报告、完整档案访问以及评论区的访问权限。
来源地区
Europe
热度分
76
分类
全球快讯
语言
en
