Arcee AI 采用模型融合(Model Merging)技术构建的 4000 亿级大型混合专家拼接开源模型。
阿里内部提供的高级闭源推理版本,具备更强的深度推演与复杂逻辑博弈能力。
Moonshot AI 发布 Kimi K2.5:基于 Kimi K2 持续预训练的原生多模态智能体模型,支持视觉理解、编码与 Agent Swarm。
Google 在 Gemini 中加入由教育机构内容支持的完整 SAT 模拟考试与即时反馈。
针对印度本土复杂碎片化语言生态特点特化训练的 20 亿参数小规模基础模型。
Anthropic 把 Claude Code 的执行范式扩展到非编程工作,让 Claude 在授权文件夹中规划任务并制作专业交付物。
Upstage 应用深度扩展(Depth Up-Scaling)技术将其模型扩展至千亿级参数规模的开源尝试。
国家网信办就《人工智能拟人化互动服务管理暂行办法(征求意见稿)》公开征求意见。
节日活动中,Codex 额度被重置,并在 1 月 1 日前临时提升为通常额度的两倍。
第四代 GLM 架构周期的最终开源优化版,作为向第五代架构转型的末期整合发布。
酱油文化创始人黄浩南在访谈中称,团队已扩张到约 1000 人,并提出 2026 年进军国漫、出海、IP 生态和游戏。
Codex 重写用量跟踪与计费底层系统时,因回填成本较高而在切换过程中重置额度。
谷歌第三代架构的轻量版模型,主要优化首字节响应时间及高并发环境下的多任务吞吐量。
负责人就服务中断致歉,并确认已重置所有用户的用量额度。
小米以 MIT 许可证开源面向代码与 Agent 的高效 MoE 基座,采用混合注意力与多层 MTP 架构。
艾伦研究所发布的第二代轻量化原生多模态视觉小模型。
GPT-5 系列后续更新,进一步优化了生成文本的多样性并继续降低大规模调用的综合成本。
Devstral 2 的轻量级替代方案,参数规模适合个人开发者在消费级硬件上部署的编程辅助模型。
Mistral AI 针对大规模旧代码库重构分析、长上下文解析与底层调试问题进行优化的专门模型。
为最快缓解故障,团队重置所有 Codex 用户额度,并说明将在十分钟内传播完成。