关键模型发布已确认

xAI 开始推出 Grok-3 Beta

xAI 开始推出 Grok-3 Beta,并上线 Think 与 DeepSearch;首发限 Grok 产品,API 仍待后续开放。

XAxAI已核验来源

想引用重要AI新闻?随时能找到。

事件详情

2025 年 2 月 17 日,xAI 通过直播开始推出 Grok-3 系列;2 月 19 日发布的技术说明将其定义为仍在训练的早期预览。Grok-3 使用 Colossus 集群训练,xAI 称训练算力约为前代的 10 倍。标准模型支持 100 万 token 上下文,并报告图像理解 MMMU 73.2%、视频理解 EgoSchema 74.5% 等厂商测试结果。 首发同时包括使用测试时计算的 Grok-3 (Think) 与 Grok-3 mini (Think),以及结合互联网检索和代码工具的 DeepSearch。xAI 还称,代号 `chocolate` 的早期版本曾以 1402 Elo 登顶 Chatbot Arena;这些成绩是发布方给出的首发快照。TechCrunch 的当日报道确认产品已开始向用户推出,同时指出部分模型和功能仍处于 beta,企业 API 要等后续数周。

影响评估

Grok-3 将测试时推理、长上下文和检索代理一起带入 xAI 的主力产品,扩大了 xAI 在消费级和付费市场的竞争力。发布方给出的基准和 Chatbot Arena 快照显示模型进入当时的前沿梯队;不过,模型仍在训练,架构与参数未公开,API 也没有随产品首发。

技术影响4/5

能力、架构、训练方法或研究路线的推动程度

市场影响4/5

产品采用、商业模式和行业竞争格局的变化

生态影响4/5

对开发者、开源社区、平台和上下游的带动

政策与社会2/5

监管、安全、劳动方式和公众认知层面的影响

影响范围4/5

事件影响从局部团队扩展到全球行业的广度

持续性4/5

影响是否会沉淀为长期能力、惯例或结构性变化