据動察 Beating 監測,Cloudflare 今日公佈了參與 Anthropic 內部安全專案 Project Glasswing 的實測結果。在針對自身 50 多個程式庫的測試中,Cloudflare 證實安全模型 Mythos Preview 突破了此前大型模型的瓶頸。它不僅能發現孤立的系統缺陷,更能將多個低危漏洞串聯組合,自主寫程式生成可執行的攻擊證明(PoC)。
此前的 Opus 4.7 或 GPT-5.5 在測試中往往只停留在輸出漏洞分析報告的階段。Mythos 則具備了沙盒閉環驗證能力。它會寫出觸發漏洞的程式碼並編譯執行,若執行失敗,模型會自動讀取錯誤訊息、修正假設並再次嘗試,直到徹底打通攻擊鏈。
Cloudflare 透露,業內部分安全團隊已被迫執行 2 小時內完成修補的極限標準。但 Cloudflare 強調,單純壓縮補丁時間會因跳過回歸測試引發更大的系統故障,未來的防禦重心必須轉向從架構層面切斷程式的連通性。
在工程調度上,Cloudflare 發現單流程式設計智慧體會迅速耗盡上下文,無法勝任大規模漏洞挖掘。他們為此搭建了一套平行對抗框架,讓一個智慧體在極窄範圍內尋找漏洞,同時安排另一個搭載不同模型的智慧體專門駁斥前者的結論。這種對抗機制大幅過濾了模型掃描中普遍產生的大量誤報噪音。
由於本次測試使用的是無外部限制的預覽版,Mythos 展現出了極不穩定的內部防護欄。面對同一段目標程式碼,僅僅改變執行環境的上下文描述,模型就會從拒絕執行轉為直接提供攻擊載荷。Cloudflare 警告,由模型自發生成的內生防護欄極其脆弱,未來面向公眾發布時必須強制疊加外部防線。
