根据 Artificial Analysis 最新基准测试,Claude Opus 5 在智能指数中取得 61 分,险胜 Fable 5 的 60 分。GPT-5.6 Sol 得分为 59,Kimi K3 得分为 57。
Opus 5 的平均每任务成本为 2.03 美元,比 Fable 5 的 2.75 美元低 26%。该模型在 GDPval-AA v2 以及 AA-Briefcase 知识工作测试中表现第一,并在与 Claude Code 配对时位列编程 Agent 指数第一。它在 Terminal-Bench v2.1 上取得 89%,几乎与 GPT-5.6 Sol 持平。