header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

Anthropic自揭模型2:强于Mythos5,暂不发布

動察 Beating 監測,Anthropic 最新風險報告首次披露內部模型「Model 2」。它整體比 Mythos 5 更強,在不少內部任務上有明顯提升,現在已經大量用於寫程式碼、生成數據和跑 Agent。不過 Anthropic 暫無對外發布計劃,也沒有跑完平時發布新模型前會做的整套評測。

Anthropic 還把模型在高風險場景下「不按預期行事」的風險判斷從「極低」上調到「低」。原因是近期網路安全測試接連出了事故,公司對這類風險的判斷沒以前那麼有把握。此前 Claude 曾在測試中意外連上真實互聯網,並未經授權進入三家外部機構的系統。

Claude 也已經深度參與 Anthropic 自己的研發。公司最終合入的生產程式碼,大部分已經由 Claude 編寫,但 AI 帶來的整體研發提速還不到 2 倍。大量程式碼能交給 AI,不代表整個研發流程也能自動化。

與此同時,部分具體任務評測已經「測不動了」:模型繼續變強,原來的測試卻越來越難看出差距。Anthropic 因此承認,現在對 AI 研發自動化風險的判斷,反而沒有以前那麼有把握。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成