Động Sát Beating AI tin nhanh, nhóm nghiên cứu của Google đã công bố Dream-RSI, cho phép AI Agent sau khi hoàn thành một vòng nhiệm vụ, lấy những thành công và thất bại trong quá khứ để "mơ". Hệ thống sẽ lưu lại mỗi lần thử và kết quả, rồi dùng những ghi chép cũ này để suy diễn các cách làm khác nhau, ví dụ nên thử con đường nào trước, khi nào từ bỏ, có nên thử nhiều phương án cùng lúc hay không. Vì kết quả trước đây đã từng chạy qua, những suy diễn này không cần thực thi lại nhiệm vụ.
Hệ thống sẽ chọn ra cách làm tốt hơn từ đó, áp dụng trực tiếp vào vòng tiếp theo. Vòng mới lại để lại nhiều thành công và thất bại hơn, lại đem đi "mơ", tiếp tục cải thiện chiến lược. Cứ như vậy hết vòng này đến vòng khác, chính là cái mà bài báo gọi là "tự cải thiện đệ quy". Hiện tại mô hình nền tảng本身 không thay đổi, thứ thực sự được cải thiện là phương pháp "bước tiếp theo làm thế nào" của Agent.
Bài báo đã thử nghiệm phương pháp này trên 8 nhiệm vụ gồm thuật toán, tối ưu toán học và GPU kernel. Lấy một nhiệm vụ thuật toán của Gemini 3.1 Pro làm ví dụ, so với cách làm cố định, số lần gọi Agent giảm từ 550 lần xuống 317 lần, đồng thời chương trình tìm được cuối cùng chạy nhanh hơn.
