MI

MODEL

MiniMax H3

MiniMax 发布的通用全模态生成模型。官方称其可统一理解文本、图像、视频和声音上下文,并生成带原生双声道的音视频,最高支持 15 秒、2K 分辨率。

发布日期:
2026-07-31
参数量:
未公开
架构:
H3-Omni Transformer;采用 H3-VAE 等组件。
输入输出:
文本 + 图像 + 音频 + 视频 → 音频 + 视频
开放方式:
部分开源
1 个相关事件

相关事件

按时间倒序整理已验证的发布与公司动态。