B+v1.5 · 2026-09
Artificial Analysis Coding Agent Index
- 评测日期:
- 2026-09-22
- 评测方:
- Artificial Analysis · Codex harness · max effort
前代 GPT-5.6 Luna 为 43 分;此设置下单任务成本约降低 约 60%。仅代表 2026-09-22 首日评测。
核验原页 · Artificial Analysis专业测评 · 信源可信度 90
结果
41
综合指数(越高越好)
MODEL
OpenAI 于 2026 年 9 月 22 日发布的高效率模型,面向聚焦型和高吞吐量任务,支持文本与图像输入、文本输出及工具调用。首日风评(并非长期项目实测):Artificial Analysis 在 Codex harness、max 档测得 Coding Agent Index 41 分,低于 GPT-5.6 Luna 的 43 分;其 Intelligence Index 平均任务成本从约 0.18 美元降到 0.07 美元,GDPval-AA v2.1 约下降 75 Elo。价格和并行任务价值受到肯定,纯性能升级尚未得到证明;高难编码和完整知识工作交付仍宜复核。
官方入口 | Chat | Code Plan | Agent 工具 | API |
|---|---|---|---|---|
| 全球 |
按版本保存的第三方结果快照;分数只在对应方法、模型配置和快照日期内解释,并直接链接官方结果。
前代 GPT-5.6 Luna 为 43 分;此设置下单任务成本约降低 约 60%。仅代表 2026-09-22 首日评测。
核验原页 · Artificial Analysis专业测评 · 信源可信度 90
结果
41
综合指数(越高越好)
按时间倒序整理已验证的发布与公司动态。
model_release
OpenAI 于 2026 年 9 月 22 日发布 GPT-6 Luna,并在 API、ChatGPT Work、Codex 和指定桌面应用方案中提供;公告时普通 ChatGPT 的 Chat 对话入口尚未开放。