字节跳动 Seed 团队宣布 Doubao Realtime Voice Model 正式上线,并在豆包 App 提供。
DeepSeek 把 V3、联网搜索、深度思考和文件处理装进免费移动端,为 R1 的大众传播准备入口。
Mistral 推出的第三代轻量级基座,进一步优化了低硬件资源下的性能。
DeepSeek-V3 以 MoE 架构和较低训练成本进入开放权重旗舰模型竞争。
在 2.0 Flash 架构上引入显性思维推理机制的衍生模型,注重逻辑推演。
TII 迭代推出的新一代基础模型家族,涵盖多个较小的参数规模量级。
微软第四代小参数模型,大量采用合成数据进行训练以强化基础推理能力。
谷歌第二代轻量级基座,提升了模型响应速度并优化了多任务并发处理能力。
OpenAI 将 Sora 从研究预览推进为面向 ChatGPT Plus 与 Pro 用户的独立视频生成产品。
xAI 在 X 平台上线自研图像模型 Aurora,以自回归混合专家架构处理交错的文本和图像数据。
LG AI Research 推出的中等规模模型,主要针对韩语与英语双语处理进行优化。
Meta 发布的 700 亿参数版本,整合并统一了长上下文和多语言能力。
o1 系列的高级版本,投入更多计算资源增加系统“思考”时长,以提高推理准确度。
亚马逊 AWS 全新发布的多模态基础模型系列矩阵。
腾讯发布超过 130 亿参数的 HunyuanVideo,并开放文本生成视频模型权重与推理代码。
Upstage 发布的 220 亿参数模型,针对文档内容解析与长文本任务进行了优化。
DeepSeek 提前展示长思维链推理模型,并承诺后续开放正式模型与 API。
艾伦研究所发布的开源模型,保持了其训练数据集和底层代码的完全公开。
Mistral 发布的大参数量多模态模型,强化了对图像视觉特征的理解能力。
HuggingFace 设计的微型参数量系列,适用在智能手机等硬件上纯本地运行。