全球大模型进展新闻浏览站
中文头版English
输入关键词,快速查找已抓取新闻。

今日版 / 2026年8月12日星期三

limbo logolimbo

数据更新时间

7月31日 18:25

启用来源

17

抓取状态

真实抓取

全球快讯The Decoder

谷歌DeepMind发布Gemini Robotics 2,赋能各类机器人

摘要

谷歌DeepMind推出Gemini Robotics 2,这是其最先进的视觉-语言-动作模型,可控制从桌面机械臂到人形机器人的各种形态。同时发布的Gemini Robotics ER 2为机器人任务提供更高层次的推理能力。

背景解释

该模型旨在让机器人更好地理解并执行复杂指令,推动机器人技术在工业、服务等领域的应用。对于普通科技读者,这意味着机器人将更智能、更灵活,未来可能在更多场景中协助人类工作。

原文译文

以下为抓取到的原文内容译文,已统一为站内阅读格式。

阅读原文

Google Deepmind 发布 Gemini Robotics 2,为从桌面机械臂到人形机器人的各种形态机器人提供动力

Google Deepmind 推出了 Gemini Robotics 2,并称其是目前最先进的视觉-语言-动作(VLA)模型。VLA 模型结合了图像识别、语言处理和动作控制,帮助机器人在物理环境中运行。Deepmind 表示,该模型可以控制从桌面机械臂到全身人形机器人的各种系统。

该公司将 Gemini Robotics 2 描述为新一代自适应机器人的“智能层”。据 Deepmind 称,它可以管理全身运动、执行精细动作任务,并协调多个机器人。开发者可以通过候补名单申请早期访问。

Google Deepmind 还推出了Gemini Robotics ER 2,这是一个专为“具身推理”设计的模型。该术语指的是理解物理世界并根据这些信息决定采取哪些行动。ER 2 作为机器人的高级控制系统,取代了4 月发布的 Gemini Robotics ER 1.6。新模型已在Google AI Studio中提供。广告 DEC_D_Incontent-1 广告

无炒作的人工智能新闻——由人类策划

订阅 THE DECODER,享受无广告阅读、每周人工智能通讯、每年六次的独家“AI 雷达”前沿报告、完整档案访问以及评论区的访问权限。

来源地区

Europe

热度分

76

分类

全球快讯

语言

en