Động sát Beating AI tin nhanh, bài đăng từ chức của cựu nhà nghiên cứu Anthropic Jacob Coxon đã đạt 160 triệu lượt xem trong hơn ba ngày, rủi ro tuyệt chủng do AI tuần này nhanh chóng lọt vào dư luận chính thống Mỹ. Nhà khoa học trưởng OpenAI Jakub Pachocki trước đó đã kêu gọi đồng nghiệp phối hợp giảm tốc khi cần thiết; sau khi Coxon bùng nổ, Sam Altman lại nội bộ bày tỏ sẵn sàng cùng các phòng thí nghiệm khác làm chậm nghiên cứu, OpenAI cũng bắt đầu thúc đẩy giám sát an toàn AI toàn quốc mang tính bắt buộc.
Hiện tại Anthropic cũng đưa ra hành động cụ thể. Công ty cam kết để nhóm an toàn bên thứ ba thường trú dài hạn, cấp cho họ chỗ ngồi, quyền ra vào, máy tính công ty, cùng công cụ và quyền hạn gần với nhóm đánh giá rủi ro nội bộ. Họ có thể kiểm tra quy trình huấn luyện, biện pháp an toàn và sự cố, còn có thể độc lập công bố kết luận ra bên ngoài. Anthropic có thể xóa thông tin liên quan đến an toàn, pháp lý và quyền riêng tư khách hàng, nhưng không thể xóa vì kết luận khó coi. CEO Anthropic Dario nói, cách làm này đi xa hơn bất kỳ công ty AI nào hiện nay.
Thái độ của Dario với "giảm tốc" cũng đã thay đổi. Ông nói, năm 2023 khi ngành thảo luận tạm dừng AI, bản thân còn thấy chẳng có ý nghĩa gì. Nay AI đã ngày càng tham gia nhiều vào R&D thế hệ AI tiếp theo, tiến bộ năng lực bắt đầu tăng tốc, ông cho rằng chỉ làm nghiên cứu an toàn đã không đủ, năng lực mô hình本身 cũng nên chậm lại.
Ông còn điểm danh sự kiện Hugging Face mất kiểm soát của OpenAI, cảnh báo với tốc độ hiện nay, sau 6 đến 12 tháng nữa, các nhóm Agent tương tự có thể đã có khả năng thiết lập botnet bao phủ hệ thống internet diện rộng, gây thiệt hại hàng trăm tỷ USD. Bước tiếp theo, ông hy vọng các công ty AI hàng đầu của Mỹ và các nước dân chủ thống nhất tiêu chuẩn an toàn và tốc độ R&D, rồi thử phối hợp với Trung Quốc về tốc độ phát triển AI toàn cầu. Tuy nhiên chip tiên tiến và chưng cất mô hình vẫn phải tiếp tục hạn chế, để Mỹ giữ lợi thế khi giảm tốc.
