動察 Beating AI 快訊,Anthropic CEO Dario Amodei 最近主張,讓 METR 這類第三方評估機構長期進駐前沿 AI 公司,獲得接近員工級別的權限,檢查安全措施、事故和模型訓練過程。但《紐約郵報》調查發現,METR 和 Anthropic 所在的 AI 安全圈關係遠比普通「外部審計」更近。
METR 最初叫 ARC Evals,孵化於 Paul Christiano 創辦的 Alignment Research Center。Christiano 不僅曾和 Amodei 在 OpenAI 共事,《紐約郵報》稱兩人還做過室友;他後來又成為 Anthropic Long-Term Benefit Trust 最初五名受託人之一。METR 現任技術人員 Ajeya Cotra 是 Christiano 的妻子,此前還負責 Coefficient Giving 的 AI 安全資助。
更直接的問題來自 METR 自己。今年它評估 Anthropic、OpenAI、Google 和 Meta 時,當時還沒有適用的人員利益衝突政策,也沒有進行正式的迴避流程。METR 披露,直接參與項目的員工和合作者中,至少 6 人與 AI 公司員工存在密切私人關係。
當然這並不能證明 METR 被 Anthropic 控制。METR 明確表示不接受前沿 AI 公司及其員工的資金,做風險評估也不收費,不過這些公司會免費提供大量模型 Token。