模型发布
Hugging Face 博客发布 NeoMME:高效多模态原生多语言编码器
Hugging Face 博客宣布推出 NeoMME,一个包含 260M 和 800M 参数的多模态、多语言双向编码器模型家族。NeoMME 在单个双向 Transformer 编码器中同时处理多语言文本和原始图像块,取代分别预训练的图像与文本编码器。所有模型检查点及首日 Hugging Face Transformers 实现均以 Apache 2.0 许可证发布。
SEARCH
模型发布
Hugging Face 博客宣布推出 NeoMME,一个包含 260M 和 800M 参数的多模态、多语言双向编码器模型家族。NeoMME 在单个双向 Transformer 编码器中同时处理多语言文本和原始图像块,取代分别预训练的图像与文本编码器。所有模型检查点及首日 Hugging Face Transformers 实现均以 Apache 2.0 许可证发布。
模型发布
OpenAI 发布 GPT-6 Astra;官方 API 模型目录将其列为默认模型,随后完成 Codex 与 ChatGPT Work 对主要付费套餐的 rollout。
开源工具发布
Hugging Face 发布博客文章《Give Your Coding Agents a Memory You Own》,介绍面向编程智能体的持久记忆层 funes。funes 基于用户机器上已有的会话构建,可在本地运行,并通过一条命令融入智能体的日常工作流程,支持 Claude Code、Codex、pi 和 Hermes 等编程智能体。项目代码托管于 github.com/huggingface/funes。
产品发布
IBM 与 Confluent 宣布 IBM Granite Time Series 模型已在 Confluent Cloud 上以 Early Access 形式上线,可在 Apache Flink 中通过 SQL 函数直接调用,用于流式预测与异常检测;Confluent Platform 将随后跟进。
模型发布
Google 推出面向漏洞发现与自动修补的 Gemini 3.8 Flash Cyber,通过 Fairwind Program 向受信任防御者提供优先访问。
模型发布
Google 发布 Gemini 3.8 Flash,面向长程软件工程、自治智能体与复杂企业工作流,支持最高 1M token 上下文。
产品发布
Anthropic 于 2026 年 9 月 1 日宣布推出 Enterprise Frontier Safeguards(EFS),将零数据保留(ZDR)的隐私特性与前沿的滥用检测安全防护相结合。EFS 将监控数据存储在客户控制的云基础设施中,而非 Anthropic 系统上,并将于今年秋季晚些时候开始分阶段向客户推出。
产品发布
Hugging Face 于 2026 年 9 月 1 日发布 @huggingface/kernels,一个用于从 Hub 加载和运行优化 WebGPU 内核的 JavaScript 库,并同步推出包含 207 个内核的初始集合及浏览器内基准测试工具 Fleet。
技术发布
Ai2 在 Hugging Face 博客发布 BenchMIRT,一种在单个提示词层面审计 LLM 基准测试的新方法,帮助研究者分离信号并识别真正驱动基准得分的因素。
模型发布
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,面向公众在多个平台上线,主打长周期智能体编码、深度推理与多步科学研究。
开源发布
DeepSeek 在官方 Hugging Face 组织公开 DeepSeek-V4-Flash-Vision-Exp 权重,V4 系列首次提供实验性多模态模型的本地下载与推理实现。
产品更新
OpenAI 的 Tibo 确认今天已经为所有 Codex 与 ChatGPT Work 付费用户按下重置按钮;团队同时修复压缩、内存、目标、自动化、子代理、计算机历史、滚动摘要与 MCP 等额外消耗问题,称不同使用方式下有效额度可提高约 10%–50%。
排行榜更新
Hugging Face 宣布印度英语以 Voice Arena Monsoon 之名加入开放 ASR 排行榜主榜,并作为默认列集而非可选开关,因此会影响每个模型的头条平均 WER。博客还提到 Monsoon 是 Voice Arena 面向全球南方的更广泛数据集计划的一部分,并提及公共与私有印地语出现在多语言标签页中。
开源发布
产品更新
Tibo 表示,所有 ChatGPT Work 与 Codex 用户均已获得新的使用额度,确认本轮额度重置已经完成。
模型发布
智谱发布并开放 GLM-5.3-Flash 权重,确认此前在 OpenCode 与 OpenRouter 匿名测试的 Ox Alpha 就是该模型。官方同表的 8 项编程与智能体基准中,它相对 DeepSeek-V4-Vision-Exp 取得 6 胜 2 负,整体略占优势。
性能披露
OpenAI 公布 Jalapeño 在三款开放模型上的首批 InferenceX 结果:峰值性能功耗比提高 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。
产品更新
产品更新
2026 年 8 月 25 日,Plus 用户的 Codex 与 ChatGPT Work 用量页面重新显示五小时窗口;8 月 28 日仍有用户报告该限制生效。
基础设施合作
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU,并以 Vera Rubin 扩展 Grok 的 AI 基础设施;双方还计划把优化后的 Vera Rubin NVL72 用于首代 Starmind AI 卫星。