百度基础模型研发部(BMU)近期迎来重要人事变动与技术升级。部门负责人孙天祥通过内部渠道宣布,北美某前沿实验室的资深专家武钦已正式加入团队,将主导文心大模型预训练能力的强化工作。尽管武钦的具体履历尚未公开,但据知情人士透露,其在过去两年深度参与了多代大模型的核心研发与迭代。
另一位技术骨干魏浩然的动向同样引发关注。这位2023年从中科院大学直博毕业的年轻研究员,曾主导开发双塔多模态Vary模型,其架构被DeepSeek-VL等知名模型借鉴。2026年初加入百度后,他带领团队在OCR领域实现突破性进展——6月开源的Unlimited OCR模型在OmniDocBench基准测试中登顶全球,刷新了端到端OCR性能的纪录。该模型开源后迅速获得学术界与产业界认可,成为OCR技术在大模型时代复兴的标志性成果。
魏浩然的职业轨迹充满亮点。2024年他主导的GOT-OCR2.0系统曾登顶Huggingface热门榜单,同年加入DeepSeek后参与开发V3.2、V4等核心模型,并主导开源的DeepSeek-OCR系列模型在GitHub斩获超20K星标,累计下载量达数千万次。2026年4月发布的技术报告显示,其已于春节前后离职并转投百度,目前担任BMU多模态算法负责人。
作为百度技术体系的新生代代表,1997年出生的孙天祥自2026年7月履新BMU负责人以来,持续推动组织变革与技术迭代。他不仅带领团队完成架构重组,更在7月底百度技术战略委员会换届中,与多位90后技术专家共同进入核心决策层。此次从北美引入顶尖人才武钦,被视为其强化文心大模型基础能力的重要布局。
据内部人士透露,BMU近期正围绕预训练框架、多模态融合等方向展开攻关。武钦的加入或将加速文心在算法效率与跨模态理解上的突破,而魏浩然团队在OCR领域的积累,则可能为百度文档智能处理等业务场景注入新动能。随着年轻技术管理者逐步掌握话语权,百度大模型研发体系正呈现新的发展态势。







