Theo giám sát của Động Sát Beating, Trung tâm Đổi mới và Tiêu chuẩn AI trực thuộc Bộ Thương mại Mỹ, phối hợp với Viện An toàn AI Anh Quốc, đã kiểm tra khả năng tấn công mạng của Kimi K3. Tài khoản chính thức của Bộ Thương mại nhấn mạnh rằng "Mỹ vẫn dẫn đầu", nhưng giá trị tham khảo của báo cáo đánh giá này có hạn, vì đây không phải là một bài đánh giá ngang hàng hoàn toàn tương đương.
Do hạn chế về môi trường lưu trữ, Kimi K3 chỉ tham gia một phần bài kiểm tra. Ước tính về năng lực mạng tổng thể của nó trong báo cáo chủ yếu dựa trên một chuẩn khai thác lỗ hổng bao gồm 41 nhiệm vụ. Các mô hình khác đã trải qua các bài kiểm tra toàn diện hơn, do đó phạm vi sai số ước tính cho Kimi K3 rộng hơn.
Trong bài kiểm tra khai thác lỗ hổng này, Kimi K3 đạt điểm khoảng 32%, cao hơn mức 24% của GLM-5.2, nhưng thấp hơn nhiều so với mức trung bình khoảng 76% của các mô hình dẫn đầu Mỹ. Mô hình Mỹ thực sự dẫn đầu đáng kể ở hạng mục này, nhưng một chuẩn đơn lẻ không thể đại diện cho toàn bộ khả năng tấn công mạng.
Kimi K3 cũng đã có khả năng tấn công tự chủ thực tế. Sau khi có được điểm truy cập mạng ban đầu, trong một chuỗi tấn công mô phỏng gồm 32 bước, nó hoàn thành trung bình 17 bước. Trong 10 lần thử, nó đã xâm nhập hoàn toàn mạng 1 lần. Các mô hình tiên tiến của Mỹ hoàn thành trung bình 28,5 bước.
Báo cáo cũng phát hiện ra rằng các rào cản an toàn của Kimi K3 đã không ngăn cản nó phát triển lỗ hổng hoặc thực hiện tấn công. Bản thân báo cáo liên tục nhấn mạnh phạm vi kiểm tra có hạn, nhưng khi Bộ Thương mại Mỹ truyền thông ra bên ngoài lại chỉ làm nổi bật "Mỹ vẫn dẫn đầu", thể hiện rõ màu sắc tuyên truyền chính sách.
