Động Sát Beating tin nhanh AI, Anthropic ra mắt Claude Opus 5.5, đây là mô hình đầu tiên trong dòng Claude 5.5. Theo công bố chính thức, nó đạt trình độ Fable 5.1 trên phần lớn tác vụ, nhưng chi phí cho khối lượng công việc điển hình thấp hơn Opus 5 40%, tốc độ đầu ra nhanh hơn hơn 30%. Giá API giảm xuống còn 4 USD đầu vào, 20 USD đầu ra/triệu tokens, đều thấp hơn Opus 5 20%; đọc bộ nhớ đệm giảm còn 0,20 USD, rẻ hơn 60%.
Cải thiện rõ rệt nhất là ở đánh giá lập trình. Trên Terminal-Bench 4.0, Opus 5.5 đạt 66,4%, cao hơn 57,9% của GPT-6 Astra; FrontierCode v1.1 là 54,4% so với 53,3%. Anthropic cho biết, khi chạy FrontierCode ở mức effort mặc định, Opus 5.5 vượt điểm cao nhất của Astra với chi phí mỗi câu hỏi chỉ bằng khoảng một phần năm của đối thủ; GDPval-AA v2.1 cũng đạt 1846 Elo, cao hơn 1735 của Fable 5.1 và 1542 của Astra.
Tuy nhiên nó không dẫn đầu toàn diện. Trên AutomationBench, GPT-6 Astra đạt 41,4%, Opus 5.5 đạt 40,0%; Terminal-Bench-Science cũng có điểm số của Astra cao hơn.
Đây là mô hình đầu tiên được phát hành sau khi Anthropic tuyên bố "làm chậm tiến độ mô hình tiên phong". Công ty cho biết Opus 5.5 đạt thành tích tốt nhất hiện nay trong kiểm toán hành vi tự động của mình. Hạn mức năm giờ của Pro, Max, Team cũng được nâng đồng thời, Sonnet 5.5 và Haiku 5.5 sẽ ra mắt trong vài tuần tới.
