动察 Beating AI tin nhanh, Đại học Giao thông Thượng Hải phối hợp với Đại học Thanh Hoa, ByteDance, Xiaohongshu, Shanghai AI Lab và các nhóm khác công bố bài tổng quan "The Last AI Built by Humans", hệ thống hóa 491 nghiên cứu liên quan, nhằm vạch ra một ranh giới chặt chẽ hơn cho "AI tự tiến hóa" ngày càng mở rộng.
Bài báo chia cải tiến bản thân đệ quy (RSI) thành 5 cấp độ. L1 chỉ thực thi quy trình cải tiến do con người quy định; L2 có thể tự quyết định cách cải tiến; L3 thậm chí có thể tự quyết định vòng tiếp theo nên học gì; L4 sẽ dựa trên phản hồi từ vận hành thực tế, liên tục sửa đổi bộ nhớ, kỹ năng, mã hoặc harness, để những thay đổi này ảnh hưởng đến các nhiệm vụ sau đó; đến L5, ngay cả phương pháp tìm kiếm, bộ đánh giá và chiến lược nghiên cứu chịu trách nhiệm tạo ra vòng cải tiến tiếp theo cũng có thể bị sửa đổi, và giao lại cho vòng tiếp theo tiếp tục sử dụng.
Vì vậy chỉ "biết sửa mã của chính mình" vẫn chưa đủ. Ví dụ một Coding Agent có thể viết lại mã nguồn của chính nó, nhưng nếu thế hệ tiếp theo chọn như thế nào, chấm điểm theo tiêu chuẩn gì, thay đổi nào được giữ lại vẫn do con người viết cứng, thì nó chỉ có thể chứng minh mình biết tự sửa đổi, chứ chưa nắm được cải tiến bản thân đệ quy hoàn chỉnh.
Bài báo còn chia L5 cao nhất thành hai tầng. Tầng thứ nhất là "đệ quy về mặt hình thức": AI đã có thể sửa đổi cơ chế chịu trách nhiệm cải tiến tiếp theo, và để vòng tiếp theo tiếp tục kế thừa. Tầng thứ hai là "thực sự càng sửa càng mạnh": cơ chế sau khi sửa đổi còn phải thực sự tạo ra thế hệ tiếp theo mạnh hơn dưới tài nguyên tương đương và đánh giá độc lập.
Trong 491 bài báo, 43,8% được xếp vào L1, 31,6% ở L2, L5 chỉ có 29 bài, chiếm 5,9%. Phần lớn nghiên cứu thực ra vẫn tập trung vào thực thi cải tiến do con người thiết kế, tự động tìm cách cải tiến; công trình thực sự giao chính cơ chế "cải tiến như thế nào" cho AI rất ít. Ngay cả khi chạm tới L5, việc tích lũy lợi thế ổn định lâu dài vẫn chưa được chứng minh.
Bài báo này chủ yếu đang thiết lập một bộ khung phân loại cho lĩnh vực RSI. L1 đến L5 là tiêu chuẩn do các tác giả đề xuất, vẫn chưa phải là phân cấp thống nhất được ngành công nhận. Bài báo đồng thời đưa vào các bài báo học thuật, báo cáo kỹ thuật, blog chính thức và hệ thống mã nguồn mở, vì không ít thực tiễn RSI tiên tiến vẫn chưa đi vào các bài báo chính thức.
