开源发布
Qwen 发布 Qwen3.8-27B 开源模型
Qwen 发布 Qwen3.8-27B 紧凑型开源模型,提供视觉理解、可调思考深度和长周期 Agent 能力。
EVENT ARCHIVE
开源发布
Qwen 发布 Qwen3.8-27B 紧凑型开源模型,提供视觉理解、可调思考深度和长周期 Agent 能力。
模型发布
开源发布
QwenCloud 列出 Qwen3.8-2.4T-A95B,作为 Qwen3.8 旗舰系列的开放版本。
模型发布
Google DeepMind 发布 Gemini 3.7 Flash。官方模型卡称其基于 Gemini 3.6 Flash 进行算法改进,支持文本、图像、音频和视频输入、文本输出及最高 1M token 上下文;Gemini API 文档将其列为 Gemini 3 系列稳定版。
营销事件
模型发布
DeepSeek 官方文档确认 deepseek-v4-pro 已切换到 DeepSeek-V4-Pro-0813,调用名称不变,并列出 1M 上下文、384K 最大输出和 Responses API 支持。
模型发布
营销事件
产品更新
OpenAI 向部分 ChatGPT Plus/Pro 用户灰度展示 Codex 额度耗尽后的付费重置入口;公开用户报告显示 Plus 约 8 美元、Pro 5x/20x 约 40/80 美元,但资格、价格和展示形式按账户变化,官方尚未发布统一的 Reset 价格表。
模型发布
营销事件
Tibo 称 GPT-5.6 Sol 几乎可在任何 harness 中使用,包括 Claude Code(原帖称 CC harness);同时表示自己不会离开,并确认已为 ChatGPT Work 与 Codex 全体付费用户重置用量额度。
模型发布
LG AI Research 公开 K-EXAONE 2.0-750B-A37B 模型权重及技术报告。
模型发布
Meta 于 2026 年 8 月 5 日发布面向编程任务的 Muse Spark 1.2,并同步推出 Muse Code beta。
开源发布
营销事件
Tibo 确认已重置 Codex 与 ChatGPT Work 的用量额度,以庆祝一周的效率提升,并让用户在周末运行大量 Luna 线程。
模型更新
DeepSeek 发布 V4 Flash 0731 正式版 API,重新后训练显著增强智能体能力,并原生适配 Responses API 与 Codex。
模型发布
字节跳动正式发布 Seedance 2.5。模型可单次生成最长 30 秒的音视频,并支持最多 30 张图片、10 段视频和 10 段音频作为参考。
模型发布
价格调整
OpenAI 将 GPT-5.6 Luna 的 API 输入和输出价格分别降至每百万 tokens 0.20 美元和 1.20 美元。
模型发布
Google DeepMind 发布 Gemini Robotics ER 2,一款面向机器人的 embodied reasoning 模型。官方资料确认其支持文本、图像、视频和音频输入、文本输出,强化连续视频理解、任务编排、工具调用和多机器人协作。