重大研究发布已确认

DeepMind 公布视觉语言模型 Flamingo

DeepMind 公布 800 亿参数视觉语言模型 Flamingo,可通过少量示例处理图像、视频和文本任务。

GOGoogle DeepMind已核验来源

想引用重要AI新闻?随时能找到。

事件详情

DeepMind 于 2022 年 4 月 28 日公布 Flamingo。该模型接收交错的图像、视频和文本提示并输出文本,通过连接预训练视觉模型与语言模型完成多模态少样本学习。官方介绍的最终模型规模为 800 亿参数,但未开放权重或公共调用入口。

影响评估

Flamingo 展示了单一视觉语言模型以少量示例处理多类图像和视频任务的能力,成为后续通用多模态模型的重要技术节点。

技术影响5/5

能力、架构、训练方法或研究路线的推动程度

市场影响2/5

产品采用、商业模式和行业竞争格局的变化

生态影响4/5

对开发者、开源社区、平台和上下游的带动

政策与社会3/5

监管、安全、劳动方式和公众认知层面的影响

影响范围5/5

事件影响从局部团队扩展到全球行业的广度

持续性5/5

影响是否会沉淀为长期能力、惯例或结构性变化