Theo bảng benchmark mới nhất của Artificial Analysis, Claude Opus 5 đạt 61 điểm trên chỉ số trí tuệ, nhỉnh hơn không đáng kể so với 60 điểm của Fable 5. GPT-5.6 Sol đạt 59 điểm, còn Kimi K3 đạt 57 điểm.
Opus 5 có mức trung bình 2,03 USD cho mỗi tác vụ, thấp hơn 26% so với mức 2,75 USD của Fable 5. Mô hình dẫn đầu trong các bài đánh giá GDPval-AA v2 và AA-Briefcase cho công việc tri thức, đồng thời xếp thứ nhất trên chỉ số Agent lập trình khi được ghép với Claude Code. Mô hình đạt 89% trên Terminal-Bench v2.1, gần như ngang bằng với GPT-5.6 Sol.