動察 Beating AI 快訊,百度基礎模型研發部(BMU)正在補強核心模型團隊。知情人士稱,負責人孫天祥從北美某 Frontier Lab 引入了一名花名「武欽」的研究員,和團隊一起加強文心預訓練。對方過去兩年參與過數代前沿大模型研發,但真實姓名和原單位都沒有披露。另一邊,原 DeepSeek 研究員魏浩然及其團隊也從百度內部轉入 BMU,由他擔任文心多模態算法負責人。
魏浩然這條線其實早有伏筆。6 月百度開源 Unlimited OCR 時,三名核心貢獻者中的技術總監只署名「YY」,社區當時就猜測是魏浩然。魏浩然是 DeepSeek-OCR 和 DeepSeek-OCR 2 第一作者;DeepSeek-V4 技術報告也把他標記為已經離職。
Unlimited OCR 發布時在 OmniDocBench v1.6 拿到 93.92%,一度刷新端到端 OCR 紀錄。它沿用了 DeepSeek-OCR 的 DeepEncoder,並重新設計解碼端的注意力機制,可以一次連續解析幾十頁文檔。
孫天祥 7 月剛接手 BMU,同時進入百度模型委員會,月底又進入百度技術戰略委員會。兩個月後,文心的預訓練和多模態兩條核心線都開始補人。