Động Sát Beating AI tin nhanh, tài liệu nội bộ mà 404 Media có được cho thấy OpenAI đang thông qua dự án có mật danh "Project Lily", để hàng trăm nhân viên thuê ngoài đọc các cuộc trò chuyện thực tế giữa người dùng và ChatGPT, nhằm huấn luyện và cải thiện mô hình. Người kiểm duyệt không thấy tên người dùng, nhưng có thể thấy toàn bộ cuộc trò chuyện. Một số nhiệm vụ còn kèm theo "bản tóm tắt ký ức" của người dùng, bao gồm những gì đã trò chuyện trước đây, có thể sống ở đâu và các thông tin khác.
Những người này trước tiên sẽ tóm tắt người dùng muốn làm gì, sau đó so sánh nhiều câu trả lời do ChatGPT tạo ra, và chấm điểm từ 1 đến 7. Trọng tâm kiểm duyệt bao gồm thông tin có chính xác không, có xu hướng chiều theo người dùng quá mức không, và liệu ChatGPT có tự thể hiện mình quá giống người thật không.
OpenAI sẽ trước tiên dùng Privacy Filter để loại bỏ tên, thông tin liên hệ và các thông tin cá nhân khác, nhưng quan chức cũng thừa nhận mô hình này có thể bỏ sót thông tin nhận dạng không phổ biến và thông tin riêng tư mơ hồ. Một số nội dung nhạy cảm vẫn có thể xuất hiện trước mặt người kiểm duyệt.
Không phải tất cả cuộc trò chuyện ChatGPT đều bị con người đọc. Bản cá nhân Free, Plus và Pro mặc định bật "cải thiện mô hình cho tất cả người dùng", sau khi người dùng tắt, các cuộc trò chuyện mới sẽ không còn được dùng để huấn luyện; Business, Enterprise và Edu mặc định không dùng để huấn luyện.
