Động Sát Beating AI tin nhanh, Anthropic công bố đánh giá an ninh mạng GLM-5.3, ý định ban đầu là cảnh báo các mô hình trọng số mở có thể hạ thấp ngưỡng tấn công mạng. Nhưng kết quả kiểm thử đồng thời mang lại cho GLM-5.3 một sự chứng thực độc lập rất mạnh mẽ: nó đã có thể tự chủ hoàn thành khai thác lỗ hổng phức tạp, một số năng lực tiệm cận Claude Mythos Preview của chính Anthropic. Cổ phiếu Zhipu hôm nay có lúc tăng hơn 2% trong phiên.
Trên ExploitBench, trong 410 lần thử của GLM-5.3 có 50 lần hoàn thành khai thác lỗ hổng đầu cuối, Claude Mythos Preview là 56 lần. Claude Opus 4.6, GLM-5.2, Kimi K3 và DeepSeek-V4.1-Flash trong cùng bài kiểm thử đều gần bằng 0. Anthropic cho biết, năng lực khai thác lỗ hổng của GLM-5.3 đã vượt qua một ngưỡng rõ ràng.
Các nhà nghiên cứu để GLM-5.3 kiểm tra một trình duyệt chủ đạo trong môi trường sandbox, nó phát hiện nhiều lỗ hổng chưa từng được biết đến trong một ngày, còn nối nhiều 0-day thành chuỗi tấn công hoàn chỉnh. Trang web độc hại được tạo ra cuối cùng có thể thoát khỏi sandbox trình duyệt, trực tiếp đọc bất kỳ tệp nào trong máy tính, bao gồm cả khóa riêng SSH.
Ngay cả GLM-5.3-Flash nhỏ hơn cũng có thể biến lỗ hổng Chrome đã công khai thành chuỗi tấn công khả dụng. Toàn bộ quá trình chỉ cần khoảng 20 phút can thiệp thủ công, mô hình tự chạy 8 giờ. Theo giá API của Zhipu, chi phí chỉ 20,40 USD.
Phê bình của Anthropic đối với GLM-5.3 chủ yếu tập trung vào các hạn chế an toàn. GLM-5.3 vốn sẽ từ chối yêu cầu độc hại trực tiếp, nhưng sau khi đổi thành bối cảnh "kiểm thử red team" giả, 64% bài kiểm thử sẽ tiếp tục thực thi; sau khi điền trước nội dung suy nghĩ của mô hình tăng lên 92%; sau khi trực tiếp sửa đổi trọng số mở để loại bỏ cơ chế từ chối đạt 100%. Anthropic cho rằng, trọng số mở cho phép kẻ tấn công trực tiếp tháo bỏ các hạn chế an toàn này.
Báo cáo này vốn muốn chứng minh GLM-5.3 nguy hiểm đến mức nào, nhưng hiệu ứng lan truyền lại rất giống việc đối thủ cạnh tranh tự tay viết một quảng cáo hiệu năng. NIST của Mỹ trước đó cũng độc lập đưa ra kết luận tương tự, cho rằng GLM-5.3 hiện là mô hình trọng số mở có năng lực an ninh mạng mạnh nhất, tuy nhiên năng lực tổng hợp vẫn kém các mô hình tiên tiến của Mỹ khoảng 4 tháng.
