動察 Beating AI 快訊,OpenAI 正式確認,即將發布的 Astra 已達到其「Critical」網路安全能力門檻,也是第一款被 OpenAI 評到這一級別的模型。給它合適的工具和權限後,Astra 已能自己尋找未知漏洞,並開發攻擊方法,不需要人一步一步指導。
在 ExploitBench 上,Astra 拿到 100%。OpenAI 又拿 20 個近期披露的高危漏洞做內部測試,Astra 過程中還自己發現並利用了 2 個此前未知的零日漏洞。專家測試中,它能攻破瀏覽器沙箱,在宿主機執行命令;也能攻擊加固過的作業系統,一路把普通用戶權限提到 root。
不過這些結果來自開放了高級網路安全能力的 Daybreak Blue 版本,不是普通用戶拿到的默認 Astra。正式上線初期,高級能力只會給少量測試者,之後再通過 Daybreak Blue 向防禦方開放。
此前因為 Hugging Face 安全事故被暫停的 Astra 相關訓練也開始恢復。OpenAI 已在 8 月 28 日重啟此前暫停的大規模前沿 RL 訓練,不過部分實驗性訓練仍繼續暫停。