关键模型发布已确认

Google 发布 Gemini Robotics ER 2

Google DeepMind 发布 Gemini Robotics ER 2,一款面向机器人的 embodied reasoning 模型。官方资料确认其支持文本、图像、视频和音频输入、文本输出,强化连续视频理解、任务编排、工具调用和多机器人协作。

GOGoogle DeepMind已核验来源

想引用重要AI新闻?随时能找到。

事件详情

Google DeepMind 于 2026 年 7 月 30 日发布 Gemini Robotics ER 2。该模型作为机器人的高层推理中枢,基于 Gemini 3.5 Flash,支持最高 128K 上下文和文本、图像、视频、音频输入;它能进行空间与时间推理、连续视频进度跟踪、工具编排和多机器人协作,并通过 Gemini API 与 Google AI Studio 向开发者开放。

影响评估

Gemini Robotics ER 2 把 Gemini 的多模态推理推进到实体智能场景,新增连续视频自纠错、工具编排和多机器人协作能力,并通过 API 向开发者开放。

技术影响5/5

能力、架构、训练方法或研究路线的推动程度

市场影响3/5

产品采用、商业模式和行业竞争格局的变化

生态影响4/5

对开发者、开源社区、平台和上下游的带动

政策与社会4/5

监管、安全、劳动方式和公众认知层面的影响

影响范围3/5

事件影响从局部团队扩展到全球行业的广度

持续性4/5

影响是否会沉淀为长期能力、惯例或结构性变化