動察 Beating AI 快訊,做過 LLM 訓練和 CPU 形式化驗證的工程師 Jay Kruer 發文稱,OpenAI 用上萬個 Agent 攻下 Navier-Stokes 難題,並不代表 AI 已經能獨立替代知識工作者。
他的核心理由很簡單:數學題有明確答案,還能用 Lean 自動檢查。現實裡的程式設計、研究和企業工作,目標往往很模糊,也沒有一個程式能直接判斷結果對不對。
沒有可靠的自動檢查,人就得一直盯著 AI。要把任務規則寫到足夠嚴格,又需要昂貴的領域專家。Kruer 認為,這部分監督和驗收成本,甚至可能比人自己把活幹了還高。
他因此把現在的 LLM 稱為「開掛實習生」:能力很強、幹活很快,但還不能放心讓它自己管事。