关键模型发布已确认
Google 发布 Gemini Robotics ER 2
Google DeepMind 发布 Gemini Robotics ER 2,一款面向机器人的 embodied reasoning 模型。官方资料确认其支持文本、图像、视频和音频输入、文本输出,强化连续视频理解、任务编排、工具调用和多机器人协作。
GOGoogle DeepMind已核验来源
想引用重要AI新闻?随时能找到。
事件详情
Google DeepMind 于 2026 年 7 月 30 日发布 Gemini Robotics ER 2。该模型作为机器人的高层推理中枢,基于 Gemini 3.5 Flash,支持最高 128K 上下文和文本、图像、视频、音频输入;它能进行空间与时间推理、连续视频进度跟踪、工具编排和多机器人协作,并通过 Gemini API 与 Google AI Studio 向开发者开放。
影响评估
Gemini Robotics ER 2 把 Gemini 的多模态推理推进到实体智能场景,新增连续视频自纠错、工具编排和多机器人协作能力,并通过 API 向开发者开放。
技术影响5/5
能力、架构、训练方法或研究路线的推动程度
市场影响3/5
产品采用、商业模式和行业竞争格局的变化
生态影响4/5
对开发者、开源社区、平台和上下游的带动
政策与社会4/5
监管、安全、劳动方式和公众认知层面的影响
影响范围3/5
事件影响从局部团队扩展到全球行业的广度
持续性4/5
影响是否会沉淀为长期能力、惯例或结构性变化