Động Sát Beating Tin nhanh AI, OpenAI chính thức xác nhận, Astra sắp ra mắt đã đạt đến ngưỡng năng lực an ninh mạng "Critical" của họ, cũng là mô hình đầu tiên được OpenAI đánh giá ở cấp độ này. Sau khi được cung cấp công cụ và quyền hạn phù hợp, Astra đã có thể tự mình tìm kiếm các lỗ hổng chưa biết và phát triển phương pháp tấn công, không cần con người hướng dẫn từng bước.
Trên ExploitBench, Astra đạt 100%. OpenAI lại lấy 20 lỗ hổng nguy hiểm cao được công bố gần đây để kiểm tra nội bộ, trong quá trình đó Astra còn tự phát hiện và khai thác 2 lỗ hổng zero-day chưa từng được biết đến trước đó. Trong thử nghiệm của chuyên gia, nó có thể phá vỡ hộp cát của trình duyệt, thực thi lệnh trên máy chủ; cũng có thể tấn công hệ điều hành đã được tăng cường bảo mật, nâng quyền người dùng thông thường lên root.
Tuy nhiên, những kết quả này đến từ phiên bản Daybreak Blue đã mở khóa năng lực an ninh mạng nâng cao, không phải Astra mặc định mà người dùng thông thường nhận được. Trong giai đoạn đầu ra mắt chính thức, năng lực nâng cao chỉ được cấp cho một số ít người thử nghiệm, sau đó sẽ mở cho phía phòng thủ thông qua Daybreak Blue.
Trước đó, quá trình huấn luyện liên quan đến Astra bị tạm dừng do sự cố an toàn Hugging Face cũng bắt đầu được khôi phục. OpenAI đã khởi động lại vào ngày 28 tháng 8 quá trình huấn luyện RL tiên phong quy mô lớn trước đó bị tạm dừng, tuy nhiên một số huấn luyện thử nghiệm vẫn tiếp tục bị tạm dừng.
