MI

MODEL

MiniMax H3

MiniMax 发布的通用音视频生成模型。它接受文本、图像、视频和音频上下文,生成带原生双声道音频的视频;公开的 H3-Base 提供 FL2VA 与 Ref2VA 两类检查点。

发布日期:
2026-07-31
参数量:
33B(H3-Omni-Transformer)
架构:
由 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 组成;H3-Base 使用 H3-Omni-Transformer、视觉 VAE、音频 VAE 和基于 Qwen3-VL-32B 的编码器。
输入输出:
文本 + 图像 + 音频 + 视频 → 音频 + 视频
开放方式:
部分开源
组织:
MiniMax
1 个相关事件

官方入口

ChatCode PlanAgent 工具API
中国大陆——
全球——

相关事件

按时间倒序整理已验证的发布与公司动态。