Động Sát Beating AI tin nhanh, Hugging Face đã cấm mô hình penclaw-GLM-5.3-abliterated-for-offensive-cyber do công ty an ninh AI Audn tải lên, trang hiển thị rằng nó vi phạm Chính sách Nội dung. Phiên bản này trực tiếp sửa đổi trọng số của GLM-5.3, làm suy yếu hành vi từ chối trả lời của mô hình. Tên kho gốc và phần giới thiệu còn ghi rõ offensive cyber. Tác giả sau đó đã xóa những chữ này và tải lại mô hình.
Lý do cụ thể vì sao bị cấm, Hugging Face không công khai giải thích. Tác giả nói rằng bản thân cũng không hiểu rõ nguyên nhân, có người trong cộng đồng đoán rằng tên gọi offensive cyber đã kích hoạt kiểm duyệt. Chính sách hiện hành của Hugging Face thực sự cấm nội dung nhằm phá hoại, truy cập hệ thống trái phép và tạo mã độc.
Nhưng những phiên bản làm suy yếu giới hạn từ chối trả lời của mô hình như thế này không hiếm trên Hugging Face, trên nền tảng đã có hàng nghìn mô hình abliterated tương tự.
