Artificial Analysis 测评显示,Claude Opus 5.5 在 Claude Code max effort 下以 66 分登顶 Coding Agent Index,较 Opus 5(60)高 6 分,三项评测 Terminal-Bench 4.0(63.1%)、DeepSWE v1.1(68.4%)、SWE-Atlas-QnA(66.4%)全部提升。
查看原文:https://x.com/ArtificialAnlys/status/2102932119995756613
来源:X:Artificial Analysis (@ArtificialAnlys)


