HU

MODEL

HunyuanVideo

HunyuanVideo 是腾讯发布的超过 130 亿参数文本生成视频基础模型。模型采用双流转单流扩散 Transformer、因果 3D VAE 和多模态大语言模型文本编码器。

发布日期:
2024-12-03
参数量:
超过 13B
架构:
使用双流转单流的扩散 Transformer、因果 3D VAE 和多模态大语言模型文本编码器,在压缩潜空间生成视频。
输入输出:
文本 → 视频
交互方式:
普通请求
开放方式:
部分开源
1 个相关事件

相关事件

按时间倒序整理已验证的发布与公司动态。