Theo 动察 Beating theo dõi, Grok 4.6 đã bắt đầu tham gia tối ưu hóa và vận hành hệ thống suy luận của chính mình. SpaceXAI đã tiết lộ trong thẻ mô hình rằng họ để một phiên bản cũ hơn của Grok 4.6 tự động tăng tốc Grok Chat. Mô hình có thể tự thử nghiệm các giải pháp, nhưng trước khi gửi mã, nó phải chứng minh rằng toàn bộ hệ thống thực sự nhanh hơn.
Trong 5 giờ, Grok 4.6 đã thử liên tiếp 297 giải pháp tối ưu hóa, bao gồm MoE, tính toán chú ý, lập lịch toán tử cấp thấp và truyền thông. Nó cũng loại bỏ một loạt các giải pháp chỉ nhanh hơn trong bài kiểm tra nhỏ nhưng không mang lại lợi ích khi đưa vào hệ thống hoàn chỉnh. Cuối cùng, mô hình đã gửi 7 PR, trong đó 3 PR đã được đưa vào môi trường sản xuất Grok Chat. Những mã này giúp tăng thông lượng giai đoạn tạo sinh lên 1,5% và giai đoạn xử lý đầu vào lên 3,1%.
Mục tiêu của SpaceXAI không chỉ dừng lại ở việc tối ưu hóa hệ thống suy luận. Thẻ mô hình ghi rõ rằng họ đang thử nghiệm để Grok tự động đảm nhận một phần công việc nghiên cứu và phát triển trong việc huấn luyện và đánh giá các phiên bản mới của chính nó. Các nhiệm vụ đã bao gồm phát hiện gian lận phần thưởng trong quá trình huấn luyện, tạo và kiểm duyệt dữ liệu huấn luyện, khắc phục sự cố trong hệ thống huấn luyện quy mô lớn, và thiết kế đánh giá cho các khả năng mới.
Điều này đã thuộc về khả năng tự cải thiện của AI, nhưng vẫn chưa đến mức tự tiến hóa đệ quy.
