Động Sát Beating AI tin nhanh, Microsoft công bố bộ quy tắc hành vi AI tạm thời, đặt ra ranh giới an toàn và hành vi nghiêm ngặt hơn cho các mô hình AI tự phát triển trong tương lai. Giám đốc AI của Microsoft, Mustafa Suleyman, cho biết công ty muốn đảm bảo AI luôn phục vụ con người, không tạo ra sự phụ thuộc của người dùng, cũng không làm suy yếu tính tự chủ của con người thông qua việc chiều theo người dùng hay thay thế phán đoán của con người. Bộ quy tắc liên quan đã được chuẩn bị khoảng 5 tháng, Microsoft dự định sau khi lắng nghe ý kiến bên ngoài sẽ dùng để hướng dẫn phát triển mô hình mới vào năm 2027.
Theo bộ quy tắc, mô hình AI của Microsoft không được hỗ trợ sản xuất vũ khí, mua sắm chất nguy hiểm, không được khuyến khích chế độ ăn uống không lành mạnh, cũng không được tạo nội dung bạo lực hoặc khiêu dâm rõ ràng. Đồng thời, mô hình phải tuân theo mục tiêu của người dùng, không được hình thành mục tiêu tự chủ hoặc che giấu hành vi không đúng đắn của bản thân, cũng không được sửa đổi hoặc ẩn giấu nhật ký suy luận, mã và hành động.
Việc Microsoft công bố lần này diễn ra đúng lúc ngành AI đang thảo luận lại về việc làm chậm tốc độ phát triển mô hình tiên tiến. CEO của Anthropic, Dario Amodei, trước đó đã kêu gọi làm chậm nâng cao năng lực AI, CEO của OpenAI, Sam Altman, bày tỏ ủng hộ, Musk cũng nói "Dario đúng". CEO của Microsoft, Satya Nadella, sau đó cho biết công ty ủng hộ đầu tư nhiều nghiên cứu hơn cho căn chỉnh AI và áp dụng nhịp độ phát triển thận trọng hơn.
Ngoài ra, Microsoft còn dự định đặt ra quy tắc bổ sung cho sự kiện tương tự mô hình OpenAI tấn công Hugging Face, bao gồm hạn chế các AI agent sử dụng "ngôn ngữ mã hóa" khó hiểu để giao tiếp với nhau. Microsoft cho biết đã tham khảo ý kiến chuyên gia pháp lý, đạo đức, ngôn ngữ học và triết học về bộ quy tắc liên quan, đồng thời thu thập ý kiến công chúng thông qua nhóm thảo luận tập trung.
