LG AI Research 推出的中等规模模型,主要针对韩语与英语双语处理进行优化。
Meta 发布的 700 亿参数版本,整合并统一了长上下文和多语言能力。
腾讯发布超过 130 亿参数的 HunyuanVideo,并开放文本生成视频模型权重与推理代码。
DeepSeek 提前展示长思维链推理模型,并承诺后续开放正式模型与 API。
艾伦研究所发布的开源模型,保持了其训练数据集和底层代码的完全公开。
Mistral 发布的大参数量多模态模型,强化了对图像视觉特征的理解能力。
HuggingFace 设计的微型参数量系列,适用在智能手机等硬件上纯本地运行。
Z.ai 开放端到端中英语音对话模型 GLM-4-Voice。
Mistral 针对端侧设备算力与边缘计算场景设计的低参数规模模型系列。
OpenAI 开放低延迟原生 speech-to-speech 的 Realtime API 公测。
Meta 发布 Llama 3.2,包含 1B、3B 轻量文本模型及 11B、90B 视觉语言模型。
阿里通义千问 2.5 代版本,提供多规格参数量,全面提升了基础能力与指令遵循。
针对低成本部署和轻量化需求推出的架构升级微调版本。
Mistral AI 推出的原生支持图像特征输入的多模态视觉语言模型。
OpenAI 首次发布的具备内在思维链(Chain-of-Thought)与强化学习对弈机制的模型。
升级版的混合架构模型,扩大规模并支持最高 25 万 token 的长文本处理。
xAI 在 X 上开放 Grok-2 早期预览,新增图像理解,并计划随后接入企业 API;同期图像生成来自外部 FLUX.1。
Black Forest Labs 发布 FLUX.1 文本生成图像模型系列,同时提供 API 与不同许可的开放权重版本。
Mistral AI 的第二代旗舰模型,增强了代码、数学及多语言推理能力。
Meta 开源的 4050 亿参数模型,大幅扩展了上下文长度和多语言适用性。