研究发布
DeepMind 公布视觉语言模型 Flamingo
DeepMind 公布 800 亿参数视觉语言模型 Flamingo,可通过少量示例处理图像、视频和文本任务。
MODEL
Flamingo 是 DeepMind 提出的视觉语言模型,可接收交错的图像、视频和文本提示并生成文本。最终模型基于 Chinchilla 语言模型构建,规模为 800 亿参数。
按时间倒序整理已验证的发布与公司动态。
研究发布
DeepMind 公布 800 亿参数视觉语言模型 Flamingo,可通过少量示例处理图像、视频和文本任务。