开放范围更新
GPT-6 Astra 在 Codex 向 Plus、Pro、Business、Enterprise 用户全面开放
OpenAI 确认 GPT-6 Astra 已在 Codex 和 ChatGPT Work 完成向 Plus、Pro、Business、Enterprise 用户的全面开放。
开放范围更新
OpenAI 确认 GPT-6 Astra 已在 Codex 和 ChatGPT Work 完成向 Plus、Pro、Business、Enterprise 用户的全面开放。
研究进展披露
OpenAI 发布《研究加速:OpenAI 内部视角》报告,披露其已实现此前设定的“自动化研究实习生”目标,并公开编码智能体在内部研究中的使用数据、实验速度与任务复杂度变化,同时披露了研究基础设施遭智能体入侵、Astra 模型安全限制及强化学习训练暂停等安全事件。
模型发布
OpenAI 发布 GPT-6 Astra;官方 API 模型目录将其列为默认模型,随后完成 Codex 与 ChatGPT Work 对主要付费套餐的 rollout。
产品发布
Hugging Face 于 2026 年 9 月 1 日发布 @huggingface/kernels,一个用于从 Hub 加载和运行优化 WebGPU 内核的 JavaScript 库,并同步推出包含 207 个内核的初始集合及浏览器内基准测试工具 Fleet。
模型发布
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,面向公众在多个平台上线,主打长周期智能体编码、深度推理与多步科学研究。
开源发布
DeepSeek 在官方 Hugging Face 组织公开 DeepSeek-V4-Flash-Vision-Exp 权重,V4 系列首次提供实验性多模态模型的本地下载与推理实现。
产品更新
OpenAI 的 Tibo 确认今天已经为所有 Codex 与 ChatGPT Work 付费用户按下重置按钮;团队同时修复压缩、内存、目标、自动化、子代理、计算机历史、滚动摘要与 MCP 等额外消耗问题,称不同使用方式下有效额度可提高约 10%–50%。
开源发布
产品更新
Tibo 表示,所有 ChatGPT Work 与 Codex 用户均已获得新的使用额度,确认本轮额度重置已经完成。
模型发布
智谱发布并开放 GLM-5.3-Flash 权重,确认此前在 OpenCode 与 OpenRouter 匿名测试的 Ox Alpha 就是该模型。官方同表的 8 项编程与智能体基准中,它相对 DeepSeek-V4-Vision-Exp 取得 6 胜 2 负,整体略占优势。
性能披露
OpenAI 公布 Jalapeño 在三款开放模型上的首批 InferenceX 结果:峰值性能功耗比提高 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。
开源发布
Qwen 发布 Qwen3.8-27B 紧凑型开源模型,提供视觉理解、可调思考深度和长周期 Agent 能力。
模型发布
产品预览
OpenAI 向部分 API 客户开放 GPT-5.6 Sol Ultrafast 有限预览,由 Cerebras 提供算力,最高生成 750 个输出 token/秒。
开源发布
QwenCloud 列出 Qwen3.8-2.4T-A95B,作为 Qwen3.8 旗舰系列的开放版本。
模型发布
Google DeepMind 发布 Gemini 3.7 Flash。官方模型卡称其基于 Gemini 3.6 Flash 进行算法改进,支持文本、图像、音频和视频输入、文本输出及最高 1M token 上下文;Gemini API 文档将其列为 Gemini 3 系列稳定版。
模型发布
DeepSeek 官方文档确认 deepseek-v4-pro 已切换到 DeepSeek-V4-Pro-0813,调用名称不变,并列出 1M 上下文、384K 最大输出和 Responses API 支持。
模型发布
模型发布
LG AI Research 公开 K-EXAONE 2.0-750B-A37B 模型权重及技术报告。
模型发布
Meta 于 2026 年 8 月 5 日发布面向编程任务的 Muse Spark 1.2,并同步推出 Muse Code beta。