开源发布
EVENT ARCHIVE
事件
产品更新
OpenAI 重置所有 ChatGPT Work 与 Codex 用户额度
Tibo 表示,所有 ChatGPT Work 与 Codex 用户均已获得新的使用额度,确认本轮额度重置已经完成。
性能披露
OpenAI 公布 Jalapeño 首批推理跑分与多代路线图
OpenAI 公布 Jalapeño 在三款开放模型上的首批 InferenceX 结果:峰值性能功耗比提高 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。
产品更新
产品更新
OpenAI 为 Plus 账户恢复 Codex 与 ChatGPT Work 五小时用量限制
2026 年 8 月 25 日,Plus 用户的 Codex 与 ChatGPT Work 用量页面重新显示五小时窗口;8 月 28 日仍有用户报告该限制生效。
基础设施合作
NVIDIA 宣布 SpaceXAI 将采用 Vera CPU 扩展 Grok 基础设施
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU,并以 Vera Rubin 扩展 Grok 的 AI 基础设施;双方还计划把优化后的 Vera Rubin NVL72 用于首代 Starmind AI 卫星。
营销事件
营销事件
Codex 达到 20M 后向付费用户发放可存重置
Codex 达到 2000 万活跃用户后,Tibo 确认面向 ChatGPT Work 与 Codex 全体付费用户的可存重置已经到账。
价格调整
OpenAI 下调 GPT-5.6 Sol API 价格
OpenAI 将 GPT-5.6 Sol 标准短上下文 API 价格降至每百万输入 token 4 美元、输出 token 20 美元,分别下降 20% 和 33%;促销价格至少持续至 2026 年 11 月 21 日。
模型预览
OpenRouter 上线匿名推理模型 Ox Alpha,GLM 归属线索升温
OpenRouter 于 8 月 20 日上线匿名模型 Ox Alpha 免费预览,支持约 104.9 万 token 上下文以及文本、图像和视频输入,面向编程与长程智能体任务。独立技术指纹和业内消息将其与 GLM-5.x、尤其 GLM-5.3-Flash 联系起来,但 OpenRouter 与 Z.ai 尚未公开确认研发方或真实型号。
产品发布
Mistral 发布 Agentic Search
Mistral 发布 Agentic Search,通过多步检索循环让模型搜索、打开、导航、读取并核验复杂文档,现已通过 Search Toolkit 与 Libraries 提供。
开源发布
Qwen 发布 Qwen3.8-27B 开源模型
Qwen 发布 Qwen3.8-27B 紧凑型开源模型,提供视觉理解、可调思考深度和长周期 Agent 能力。
模型发布
政策与安全
Anthropic 宣布未来 Claude 模型采用文本水印
Anthropic 宣布未来 Claude 模型将在生成文本中加入不可见水印,以满足欧盟《人工智能法案》的内容标识要求;该机制不增加 token 或价格,也不携带用户身份信息。
产品预览
OpenAI 预览 Cerebras 驱动的 GPT-5.6 Sol Ultrafast
OpenAI 向部分 API 客户开放 GPT-5.6 Sol Ultrafast 有限预览,由 Cerebras 提供算力,最高生成 750 个输出 token/秒。
开源发布
Qwen 发布 Qwen3.8-2.4T-A95B 开放版本
QwenCloud 列出 Qwen3.8-2.4T-A95B,作为 Qwen3.8 旗舰系列的开放版本。
模型发布
Google 发布 Gemini 3.7 Flash
Google DeepMind 发布 Gemini 3.7 Flash。官方模型卡称其基于 Gemini 3.6 Flash 进行算法改进,支持文本、图像、音频和视频输入、文本输出及最高 1M token 上下文;Gemini API 文档将其列为 Gemini 3 系列稳定版。
营销事件
模型发布
DeepSeek 将 deepseek-v4-pro API 更新至 DeepSeek-V4-Pro-0813
DeepSeek 官方文档确认 deepseek-v4-pro 已切换到 DeepSeek-V4-Pro-0813,调用名称不变,并列出 1M 上下文、384K 最大输出和 Responses API 支持。
模型发布