OpenAI 发布基于 GPT-4o 的新一代 speech-to-text 模型。
英伟达开源的具备高吞吐特性的 MoE 模型,主要优化大规模数据处理效率。
Cohere 针对企业自动化工作流和深度 API 集成调用的需求开发的新一代模型。
谷歌全系换代的 Gemma 系列,首次在轻量开源梯队加入原生多模态支持。
Mistral Small 的小版本迭代,主要修复已知缺陷并优化部分细节功能。
Manus 以“把想法变成行动”的通用 Agent 形态亮相,可在云端虚拟机中持续执行研究、分析与制作任务。
阿里云开源的中等规模模型,重点使用强化学习提升其逻辑计算与推断能力。
OpenAI 在 GPT-4 基础上改进的版本,提升了知识储备、泛化表现与安全性。
Inception Labs 推出的尝试全新技术架构与网络底层设计的基础模型。
阿里 Wan 团队开放 Wan2.1 的推理代码与模型权重,覆盖文生视频、图生视频和多种视频任务。
Anthropic 的升级版本,支持在常规输出和长链路深度思考模式间平滑切换。
xAI 开始推出 Grok-3 Beta,并上线 Think 与 DeepSearch;首发限 Grok 产品,API 仍待后续开放。
Deepgram 发布面向实时与批量转写的 Nova-3,并强化噪声、重叠语音和词级时间戳。
Perplexity 针对自有 AI 搜索与精准问答场景微调内部核心模型。
OpenAI 于 2025 年 1 月 31 日公开发布 o3-mini,并在 ChatGPT 与 API 中提供。
Hugging Face 发起开放复现 R1 的社区项目,补齐 DeepSeek 未公开的训练数据与完整训练管线。
DeepSeek 超过 ChatGPT 登上美国 App Store 免费榜首;同日 Nvidia 市值减少约 5930 亿美元。
阿里云 Qwen 团队发布 Qwen2.5-VL 视觉语言模型系列,提供 3B、7B 和 72B 型号,并公开基础模型与指令微调模型。
OpenAI 推出可操作独立浏览器的 Operator,让用户把网页任务交给智能体执行。
DeepSeek-R1 公开推理模型权重与训练方法,强化学习路线受到广泛关注。