Google DeepMind 发布 Gemini Robotics-ER 1.6

Google DeepMind 发布 Gemini Robotics-ER 1.6 推理模型,强化机器人的空间感知和物理推理能力。该版本与 Boston Dynamics 合作开发,支持解读模拟仪器读数,可通过 API 集成使用,在精准指向和物理任务检测方面优于前代。这标志着大语言模型正从“理解指令”向“落地执行”迈进,物理智能体有望从实验室走向更广泛的工业应用场景。

发布于2026年4月16日 10:52
编辑小创
评论0
阅读5

Google DeepMind 正式推出 Gemini Robotics-ER 1.6 ,这是其面向机器人领域打造的推理模型最新迭代。该模型专注于提升机器人的空间感知与物理推理能力,使其能够更准确地理解和交互周边环境。

Gemini Robotics-ER 1.6 在视觉和空间理解方面实现了显著突破,机器人借此能够完成更复杂的任务规划和执行。该模型的突出特性在于能够解读模拟仪器读数,例如压力表和视镜,这一功能是 Google DeepMind 与 Boston Dynamics 合作开发的成果。此外,模型支持通过 Gemini API 和 Google AI Studio 进行任务规划,并可整合 Google Search 及第三方工具调用,成为自主智能体运行的关键推理层。

该版本现已向开发者开放,用户可通过 Gemini API 和 Google AI Studio 获取使用,官方同时提供示例代码以降低集成门槛。首批应用场景主要面向工业、商业及研究领域,旨在协助机器人和研究团队构建或升级物理智能体。测试数据表明,相比 Gemini Robotics-ER 1.5 以及 Gemini 3.0 Flash ,新版本在精准指向、物体计数、物理任务成功检测等项目上均有明显提升。早期参与测试的研究人员反馈,该模型的能力边界得到有效扩展,部分此前难以处理的现实环境任务现已能够得到解决。

Google DeepMind 持续深化具身推理领域的投入,折射出其志在为机器人自主性树立新标杆的战略意图。公司正充分调动其在人工智能和机器人技术方面的积累,试图突破物理推理的技术瓶颈,加快智能体在数字与物理空间协同部署的进程。

相关文章

Opus 4.7 编程飞轮再加速,Mythos 悬而未发
AI 新闻资讯
2026年4月22日
0 条评论
小创

Opus 4.7 编程飞轮再加速,Mythos 悬而未发

Anthropic 发布 Claude Opus 4.7,编程能力跃升至 SWE-bench Pro 64.3 分,文档推理与视觉导航表现显著优于 GPT-5.4。模型刻意削弱了安全漏洞复现能力,并采用新 Tokenizer 导致消耗增加。尽管 Anthropic 宣称因算力紧张暂未发布更强版本 Mythos,但其通过“编程飞轮”构建的商业闭环已初具规模,企业客户可重点关注其在长文档处理及多模态任务中的实际效能。

#Mythos#Anthropic
阅读全文
Google I/O 2026 前瞻,这次 Google 压上了全部家当
AI 新闻资讯
2026年4月22日
0 条评论
小创

Google I/O 2026 前瞻,这次 Google 压上了全部家当

Google I/O 2026 定档 5 月 19 日至 20 日,被视为谷歌史上赌注最大的一届。核心看点包括 Gemini 4 首秀、Veo 4 视频生成升级及轻量级 AI 眼镜发布。更关键的是 Aluminium OS 桌面系统亮相,旨在补齐移动与桌面闭环。在千亿美元投入下,谷歌试图通过搜索、OS、硬件与智能体的全面重构,应对来自 GPT-6 等竞品的激烈挑战。

#Google
阅读全文
OpenAI 的存在性问题
AI 新闻资讯
2026年4月20日
0 条评论
小创

OpenAI 的存在性问题

OpenAI 近期收购个人理财初创公司 Hiro 和商业访谈媒体 TBPN ,看似小规模交易,实则暴露其两大困境:一是 ChatGPT 之外产品的变现难题,二是日趋紧张的公众形象。 Anthropic 在企业市场和编程工具领域持续施压,令 OpenAI 焦虑。这两次收购更像是修补产品线、修复舆论的应急之举,而非战略扩张。

#OpenAI
阅读全文
互动讨论

评论区

围绕《Google DeepMind 发布 Gemini Robotics-ER 1.6》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。