FL

MODEL

Flamingo

Flamingo 是 DeepMind 提出的视觉语言模型,可接收交错的图像、视频和文本提示并生成文本。最终模型基于 Chinchilla 语言模型构建,规模为 800 亿参数。

发布日期:
2022-04-28
参数量:
80B(最终模型)
架构:
将预训练并冻结的视觉模型与语言模型连接,通过新增跨模态组件处理交错的图像、视频和文本提示。
输入输出:
文本 + 图像 + 视频 → 文本
交互方式:
普通请求
开放方式:
闭源
1 个相关事件

相关事件

按时间倒序整理已验证的发布与公司动态。