【Opus 5以微弱优势登顶智能榜,单任务成本比Fable 5低26%】7月25日消息,第三方评测机构 Artificial Analysis 公布 Claude Opus 5 成绩。它在综合 9 项测试的智能指数中得 61 分,窄幅领先 Fable 5 的 60 分。GPT-5.6 Sol 得 59 分,Kimi K3 得 57 分。 Opus 5 每项任务平均成本为 2.03 美元,比 Fable 5 的 2.75 美元低 26%。它在 GDPval-AA v2 和 AA-Briefcase 两项知识工作评测中登顶,搭配 Claude Code 后也并列拿下编程 Agent 指数第一。Terminal-Bench v2.1 得分为 89%,大致追平 GPT-5.6 Sol。 模型提供 5 档推理强度。从 low 到 max,输出 Token 相差约 8 倍,GDPval-AA v2 成绩相差 407 Elo。用户可以用更多 Token 换取更强性能,也可以主动压低成本。 短板同样明显。Opus 5 的事实知识仍落后 Fable 5。在 AA-Omniscience 测试中,它的幻觉率升至 50%,比 Opus 4.8 高 14 个百分点。低推理档位的性价比也仍略逊于 GPT-5.6 系列。
Opus 5以微弱优势登顶智能榜,单任务成本比Fable 5低26%
其他语言标题
- EnglishOpus 5 narrowly tops the intelligence ranking, with a single-task cost 26% lower than Fable 5.
- 한국어Opus 5가 스마트 순위에서 근소한 차이로 1위를 차지했으며, 단일 작업 비용이 Fable 5보다 26% 낮습니다.