模型发布
Hugging Face 博客发布 NeoMME:高效多模态原生多语言编码器
Hugging Face 博客宣布推出 NeoMME,一个包含 260M 和 800M 参数的多模态、多语言双向编码器模型家族。NeoMME 在单个双向 Transformer 编码器中同时处理多语言文本和原始图像块,取代分别预训练的图像与文本编码器。所有模型检查点及首日 Hugging Face Transformers 实现均以 Apache 2.0 许可证发布。
按时间倒序整理已验证的发布与公司动态。
模型发布
Hugging Face 博客宣布推出 NeoMME,一个包含 260M 和 800M 参数的多模态、多语言双向编码器模型家族。NeoMME 在单个双向 Transformer 编码器中同时处理多语言文本和原始图像块,取代分别预训练的图像与文本编码器。所有模型检查点及首日 Hugging Face Transformers 实现均以 Apache 2.0 许可证发布。
开源工具发布
Hugging Face 发布博客文章《Give Your Coding Agents a Memory You Own》,介绍面向编程智能体的持久记忆层 funes。funes 基于用户机器上已有的会话构建,可在本地运行,并通过一条命令融入智能体的日常工作流程,支持 Claude Code、Codex、pi 和 Hermes 等编程智能体。项目代码托管于 github.com/huggingface/funes。
产品发布
IBM 与 Confluent 宣布 IBM Granite Time Series 模型已在 Confluent Cloud 上以 Early Access 形式上线,可在 Apache Flink 中通过 SQL 函数直接调用,用于流式预测与异常检测;Confluent Platform 将随后跟进。
产品发布
Hugging Face 于 2026 年 9 月 1 日发布 @huggingface/kernels,一个用于从 Hub 加载和运行优化 WebGPU 内核的 JavaScript 库,并同步推出包含 207 个内核的初始集合及浏览器内基准测试工具 Fleet。
技术发布
Ai2 在 Hugging Face 博客发布 BenchMIRT,一种在单个提示词层面审计 LLM 基准测试的新方法,帮助研究者分离信号并识别真正驱动基准得分的因素。
排行榜更新
Hugging Face 宣布印度英语以 Voice Arena Monsoon 之名加入开放 ASR 排行榜主榜,并作为默认列集而非可选开关,因此会影响每个模型的头条平均 WER。博客还提到 Monsoon 是 Voice Arena 面向全球南方的更广泛数据集计划的一部分,并提及公共与私有印地语出现在多语言标签页中。
开源项目
Hugging Face 发起开放复现 R1 的社区项目,补齐 DeepSeek 未公开的训练数据与完整训练管线。
开源发布
开源发布
开源发布