動察 Beating AI 快訊,Anthropic 前研究員 Jacob Coxon 的辭職帖三天多衝到 1.6 億瀏覽,AI 滅絕風險這週迅速衝進美國主流輿論場。OpenAI 首席科學家 Jakub Pachocki 此前已經呼籲同行必要時協調減速;Coxon 爆火後,Sam Altman 又在內部表示願意和其他實驗室一起放慢研發,OpenAI 也開始推動強制性的全國 AI 安全監管。
現在 Anthropic 也拿出了具體動作。公司承諾讓第三方安全團隊長期駐場,給他們工位、門禁、公司電腦,以及接近內部風險評估團隊的工具和權限。他們可以檢查訓練流程、安全措施和事故,還能獨立對外發布結論。Anthropic 可以刪掉涉及安全、法律和客戶隱私的信息,但不能因為結論難看就刪。Anthropic CEO Dario 稱,這種做法比目前任何 AI 公司都走得更遠。
Dario 對「減速」的態度也變了。他說,2023 年業界討論暫停 AI 時,自己還覺得沒什麼意義。現在 AI 已經越來越多參與下一代 AI 的研發,能力進步開始加速,他認為光做安全研究已經不夠,模型能力本身也該慢下來。
他還點名 OpenAI 的 Hugging Face 失控事件,警告照現在的速度再過 6 到 12 個月,類似的 Agent 群可能已經有能力建立覆蓋大範圍互聯網系統的僵屍網絡,造成數千億美元損失。下一步,他希望美國等民主國家的頭部 AI 公司統一安全標準和研發速度,再嘗試和中國協調全球 AI 發展速度。不過先進芯片和模型蒸餾仍要繼續限制,讓美國在減速時保持領先。