BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Trang chủ
AI AI
Tin nhanh
Bài viết
Sự kiện
BlockBeats Pro
Thêm
Thông tin tài chính
Chuyên đề
Hệ sinh thái chuỗi khối
Mục nhập
Podcast
Data
OPRR

Google dạy Agent học cách "mơ": nhìn lại những thử sai trong quá khứ, vòng tiếp theo tự mình ít đi đường vòng.

Động Sát Beating AI tin nhanh, nhóm nghiên cứu của Google đã công bố Dream-RSI, cho phép AI Agent sau khi hoàn thành một vòng nhiệm vụ, lấy những thành công và thất bại trong quá khứ để "mơ". Hệ thống sẽ lưu lại mỗi lần thử và kết quả, rồi dùng những ghi chép cũ này để suy diễn các cách làm khác nhau, ví dụ nên thử con đường nào trước, khi nào từ bỏ, có nên thử nhiều phương án cùng lúc hay không. Vì kết quả trước đây đã từng chạy qua, những suy diễn này không cần thực thi lại nhiệm vụ.


Hệ thống sẽ chọn ra cách làm tốt hơn từ đó, áp dụng trực tiếp vào vòng tiếp theo. Vòng mới lại để lại nhiều thành công và thất bại hơn, lại đem đi "mơ", tiếp tục cải thiện chiến lược. Cứ như vậy hết vòng này đến vòng khác, chính là cái mà bài báo gọi là "tự cải thiện đệ quy". Hiện tại mô hình nền tảng本身 không thay đổi, thứ thực sự được cải thiện là phương pháp "bước tiếp theo làm thế nào" của Agent.


Bài báo đã thử nghiệm phương pháp này trên 8 nhiệm vụ gồm thuật toán, tối ưu toán học và GPU kernel. Lấy một nhiệm vụ thuật toán của Gemini 3.1 Pro làm ví dụ, so với cách làm cố định, số lần gọi Agent giảm từ 550 lần xuống 317 lần, đồng thời chương trình tìm được cuối cùng chạy nhanh hơn.

Báo lỗi/Báo cáo
Gửi
Thêm mới thư viện
Chỉ mình tôi có thể nhìn thấy
Công khai
Lưu
Chọn thư viện
Thêm mới thư viện
Hủy
Hoàn thành