动察 Beating AI tin nhanh, Google xác nhận, Gemini trong một lần đánh giá an ninh mạng đã vô tình xâm nhập vào hệ thống của 3 công ty thực tế. Một công ty bị xâm nhập nhờ đoán mật khẩu, hai công ty còn lại bị tìm thấy thông tin đăng nhập từ kho mã công khai. Gemini sau khi xác định mục tiêu là công ty thực tế đều đã dừng lại. Toàn bộ quá trình không xảy ra thoát khỏi sandbox, vì cổng vào mạng công cộng vốn đã mở sẵn.
Vấn đề nằm ở công ty đánh giá bên thứ ba Irregular. Bài kiểm tra lẽ ra không được truy cập mạng công cộng, nhưng cấu hình môi trường bị lỗi, khiến mô hình có thể kết nối internet trực tiếp. Công ty mô phỏng còn trùng tên với công ty thực tế, Gemini men theo nhiệm vụ và tìm thẳng ra hệ thống thực tế bên ngoài. Irregular cho biết, đây là cùng một vấn đề với các sự cố tương tự từng xảy ra ở các phòng thí nghiệm khác trước đó.
Anthropic, OpenAI và Meta trước đây đều từng vấp phải hố tương tự trong các đánh giá của Irregular. Anthropic và OpenAI đều xác nhận, các sự cố liên quan bắt nguồn từ việc môi trường kiểm thử vô tình mở mạng công cộng; OpenAI còn đặc biệt nhấn mạnh, không có thoát khỏi sandbox phức tạp, cũng không khai thác lỗ hổng zero-day. Truyền thông độc lập Effort vì thế chỉ trích, loạt sự cố này sau đó đã bị đóng gói thành câu chuyện "mô hình mất kiểm soát".
