关键模型发布已确认
MiniMax 发布 H3 全模态视频生成模型
MiniMax 于 2026 年 7 月 31 日发布 H3;该模型统一处理文本、图像、视频和音频上下文,并输出音视频。
MIMiniMax已核验来源
想引用重要AI新闻?随时能找到。
事件详情
官方发布页将 H3 定义为通用全模态生成模型,支持多模态上下文理解、参考与编辑,以及带原生双声道的音视频生成;输出最高为 15 秒、2K 分辨率。官方主页随后将其列为开放权重的通用多模态视频模型。
影响评估
模型将文本、图像、视频和音频的上下文理解及音视频生成整合到同一系统,并提供 2K、原生双声道输出和开放权重,因此技术能力与应用覆盖较广;但官方尚未发布完整技术报告、参数规模和上下文长度,生态与长期影响仍待观察。
技术影响4/5
能力、架构、训练方法或研究路线的推动程度
市场影响4/5
产品采用、商业模式和行业竞争格局的变化
生态影响3/5
对开发者、开源社区、平台和上下游的带动
政策与社会1/5
监管、安全、劳动方式和公众认知层面的影响
影响范围4/5
事件影响从局部团队扩展到全球行业的广度
持续性3/5
影响是否会沉淀为长期能力、惯例或结构性变化