QW

MODEL

Qwen3-Omni

Qwen 团队发布的原生端到端全模态模型,理解文本、图像、音频和视频,并以文本或自然语音实时流式响应;采用 MoE Thinker–Talker 设计。

发布日期:
2025-09-22
参数量:
30B-A3B
架构:
MoE Thinker–Talker 原生全模态架构
输入输出:
文本 + 图像 + 音频 + 视频 → 文本 + 音频
交互方式:
实时交互
开放方式:
开源
组织:
Alibaba Cloud
1 个相关事件

相关事件

按时间倒序整理已验证的发布与公司动态。

模型发布

ALAlibaba Cloud关键开源多模态

Qwen 开源 Qwen3-Omni

Qwen 发布开放权重的原生端到端全模态模型,支持实时文本和自然语音输出。