B+v1.5 · 2026-09
Artificial Analysis Coding Agent Index
- 评测日期:
- 2026-09-22
- 评测方:
- Artificial Analysis · Codex harness · max effort
前代 GPT-5.6 Sol 为 55 分;此设置下单任务成本约降低 约 50%。仅代表 2026-09-22 首日评测。
核验原页 · Artificial Analysis专业测评 · 信源可信度 90
结果
57
综合指数(越高越好)
MODEL
OpenAI 于 2026 年 9 月 22 日发布的闭源推理模型,面向复杂编程与智能体工作流,支持文本与图像输入、文本输出及工具调用。首日风评(并非长期项目实测):Artificial Analysis 在 Codex harness、max 档测得 Coding Agent Index 57 分,较 GPT-5.6 Sol 的 55 分小幅上升,平均任务成本约减半;GDPval-AA v2.1 约下降 100 Elo,部分成品更短且遗漏评分要求。总体是性价比明显提升、编码小幅进步,综合知识工作尚未证明全面升级。
官方入口 | Chat | Code Plan | Agent 工具 | API |
|---|---|---|---|---|
| 全球 |
按版本保存的第三方结果快照;分数只在对应方法、模型配置和快照日期内解释,并直接链接官方结果。
前代 GPT-5.6 Sol 为 55 分;此设置下单任务成本约降低 约 50%。仅代表 2026-09-22 首日评测。
核验原页 · Artificial Analysis专业测评 · 信源可信度 90
结果
57
综合指数(越高越好)
按时间倒序整理已验证的发布与公司动态。
模型发布
OpenAI 于 2026 年 9 月 22 日发布 GPT-6 Sol,并在 API、Codex 和 ChatGPT Work 中开放;公告时普通 ChatGPT 的 Chat 对话入口尚未开放。