header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

傳混元後訓練骨幹徐燦轉崗微信WeLM:微信AI加碼Agent

据動察 Beating 監測,腾訊混元资深研究員徐燦近期已轉岗微信 WeLM 團隊,從事大模型研發。在姚順雨接手混元大語言模型研發前,徐燦負責混元 LLM 後訓練的一個方向。

徐燦是微軟 WizardLM 項目創建者和論文第一作者,曾提出 Evol-Instruct,讓大模型自动生成更複雜的指令數據用於訓練。他在 2025 年加入腾訊混元,長期研究合成數據、指令訓練和大模型後訓練。

這次轉岗正趕上微信加碼 WeLM 和 Agent。公開招聘信息顯示,WeLM 團隊正在招聘推理優化及 Agent 研究人員,包括研究「通用 Long-Horizon LLM Agent 的訓練策略」。微信此前還發布了 RLHF 訓練框架 WeChat-YATT,用於訓練支撐微信產品的模型。

微信自己的模型也在快速擴展。7 月公開的 Hidden Decoding 研究已經做到 WeLM-HD4-80B 和 WeLM-HD4-617B。與此同時,微信原生 AI 助手「小微」正在小範圍灰度,可以操作微信原生功能並調用小程序。徐燦的後訓練經驗,與微信當前強化 Agent 複雜任務能力的方向高度契合。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成