動察 Beating AI 快訊,Hugging Face CEO Clement Delangue 宣布成立 Open Alignment Initiative,由聯合創始人 Thomas Wolf 牽頭,並公開申請加入 Anthropic 剛提出的「嵌入式評估員」計劃。如果獲批,Hugging Face 的評估人員可以長期駐場,拿到接近員工級的訪問權限,直接檢查模型訓練和安全措施。
Delangue 稱,AI 對齊不能繼續關在少數前沿實驗室內部解決,需要讓更多外部研究者參與。Anthropic 已承諾向第三方開放這類權限,包括工位、門禁、公司電腦和接近內部風險團隊的工具,並允許評估方獨立公布結論。