Claude Opus 5 vượt dẫn bảng benchmark trí tuệ với số điểm 61, chi phí thấp hơn Fable 5 26%

Theo bảng benchmark mới nhất của Artificial Analysis, Claude Opus 5 đạt 61 điểm trên chỉ số trí tuệ, nhỉnh hơn không đáng kể so với 60 điểm của Fable 5. GPT-5.6 Sol đạt 59 điểm, còn Kimi K3 đạt 57 điểm.

Opus 5 có mức trung bình 2,03 USD cho mỗi tác vụ, thấp hơn 26% so với mức 2,75 USD của Fable 5. Mô hình dẫn đầu trong các bài đánh giá GDPval-AA v2 và AA-Briefcase cho công việc tri thức, đồng thời xếp thứ nhất trên chỉ số Agent lập trình khi được ghép với Claude Code. Mô hình đạt 89% trên Terminal-Bench v2.1, gần như ngang bằng với GPT-5.6 Sol.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận