動察 Beating AI 快訊,Hugging Face 已封禁 AI 安全公司 Audn 上傳的 penclaw-GLM-5.3-abliterated-for-offensive-cyber,頁面顯示其違反 Content Policy。這個版本直接修改 GLM-5.3 權重,削弱模型的拒答行為。原倉庫名和介紹還明確寫著 offensive cyber。作者隨後刪掉這幾個字,重新上傳了模型。
具體為什麼被封,Hugging Face 沒有公開解釋。作者稱自己也沒搞懂原因,社區有人猜測是 offensive cyber 的命名觸發了審核。Hugging Face 的現行政策確實禁止旨在破壞、未經授權訪問系統,以及生成惡意代碼的內容。
但這類削弱模型拒答限制的版本在 Hugging Face 並不少見,平台上已有數千個類似的 abliterated 模型。