動察 Beating AI 快訊,專門把開源模型做成「去拒答版」的 Abliteration.ai 上線 GLM-5.3 的去拒答版本 abliterated-model-large-v2。它直接修改模型權重,削弱模型拒絕請求的機制,主打進攻性網路安全、紅隊和 Agent 測試,並提供付費 API。
智譜此前把 GLM-5.3 開放權重延遲兩周,用於安全評估和加固。8 月 28 日權重開放後,Abliteration 只用了 3 天就上線了這個版本。
GLM-5.3 的網路攻擊能力本來就比 5.2 強很多。ExploitBench 從 24.4% 升到 54.4%,ExploitGym 兩小時完成任務數從 29 個升到 105 個。Abliteration 目前沒有公佈去拒答後的重測成績。
它的 API 默認只強制攔截兒童性內容和自殘,違法活動、仇恨、騷擾、成人性內容等都默認放行。