百度文心多模态迎新掌门,前DeepSeek研究员魏浩然带队
9月3日消息,据知情人士向AI前线透露,原DeepSeek核心研究员魏浩然已于近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。这是百度继7月引入复旦MOSS青年学者孙天祥后,在青年顶尖大模型研发人才布局上的又一关键落子。
从孙天祥统管通用基座,到魏浩然挂帅多模态算法,百度模型研发中枢正加速向青年技术骨干倾斜。今年7月,曾主导国内首个开源对话模型复旦MOSS研发的孙天祥出任百度基础模型研发部(BMU)负责人,随后进驻百度模型委员会(BMC)与技术战略委员会(TSC)。魏浩然的加入,被视为孙天祥全面接手基础模型部门后,文心研发阵地重新集结的关键拼图。

魏浩然技术标签鲜明,主攻多模态与端到端OCR底层重构。他于今年上半年加入百度,此前主要负责OCR等多模态方向研发。入职后,他带领团队在端到端文档感知领域取得重大突破,并于2026年6月22日开源Unlimited OCR模型。该模型在权威文档理解评测基准OmniDocBench中取得全球第一,刷新端到端OCR性能SOTA纪录,登上GitHub和Hugging Face多个趋势榜单。
公开资料显示,魏浩然2023年博士毕业于中国科学院大学,长期专注视觉语言模型(VLM)和文档智能研究。加入DeepSeek前,他曾供职阶跃星辰等公司,主导参与Vary、GOT-OCR 2.0等代表性工作。进入DeepSeek后,他成为DeepSeek-OCR路线核心研究者,在2025年10月发布的《DeepSeek-OCR: Contexts Optical Compression》及2026年1月发布的《DeepSeek-OCR 2: Visual Causal Flow》论文中均为第一作者。

该工作率先提出“利用视觉表征极限压缩长文本信息”的技术思路,通过自研DeepEncoder,将传统方法中成千上万个文本Token压缩为数量大幅减少的紧凑视觉Token;在压缩率低于10倍的极端条件下,模型仍能保持约97%的OCR解码准确率,为解决大模型长上下文输入时显存暴涨与计算开销过大问题开辟了高效路径。除OCR专项模型外,魏浩然也参与过DeepSeek通用基础模型研发,其名字出现在DeepSeek V3.2作者名单及今年4月发布的DeepSeek V4技术报告中,但后者已将其标注为离职成员。
魏浩然的调整发生在百度大模型组织持续变动背景下。2025年11月,百度新设基础模型研发部BMU和应用模型研发部AMU,拆分底座模型与应用模型研发。今年5月,百度成立模型委员会BMC,统一模型技术路线、训练和业务落地。7月1日,孙天祥正式加盟百度执掌BMU并进入BMC;7月底百度技术战略委员会(TSC)换届,孙天祥等一线青年技术专家进入TSC,标志百度基础模型技术决策权完成向新生代实战学者的交接。

另据网络流传信息,孙天祥近期还在内部宣布引入一名花名为“武钦”的研究人员,此前曾在北美某顶级前沿实验室参与数代核心大模型研发与迭代,未来将协同团队加强文心大模型预训练能力的底层建设。
从孙天祥到魏浩然,再到“武钦”,百度正通过一系列人事调整,将基础模型研发的指挥棒交到年轻一代手中。这一连串动作能否让文心大模型在激烈的多模态竞争中脱颖而出,仍需时间检验,但技术决策权的代际更迭,已释放出百度押注新生代创新力量的明确信号。
更多推荐阅读

AI时代,熬夜写50页文档正在贬值
不管你愿不愿意,你熬夜写的那份50页文档,正在急速贬值。这不是你的锅,只怪现在的AI太能干——几分钟就能吐出一份字数相当、同样工整、几乎挑不出毛病的替代品。所有打工人都撞上这样一个残酷现实:在今天,能写出长文档,已经证明不了你认真思考过。 说这话的,是OpenAI Codex与ChatGPT Work的产品负责人Tara Seshan。在Lenny's Podcast上长达81分钟的访谈中,她还...
2026-09-06
AI创作大赛点燃B站,投资人争抢UP主
B站AI创造公开赛落幕,1.34万人参赛,作品超3万件,播放超3.5亿分钟。获奖者多为素人UP主,部分项目赛前已获融资,AI创作生态吸引投资人目光。
2026-09-06
破解循环Transformer计算冗余,阿里两篇论文提供新方案
GPT-6 Astra带火循环深度技术,但计算冗余问题待解。阿里11个月前两篇论文从信息管理和计算粒度入手,分别提升准确率,为高效大模型架构提供候选。
2026-09-06
二十多年数据沉淀,汽车之家智能体如何破解选车难题
汽车之家推出“芝士车管家”智能体,覆盖选买用卖全周期,基于2亿车主超1亿条真实评论,解决信息过载与决策难题,标志其从信息平台向汽车服务战略转型。
2026-09-06
跑分被改引质疑,GPT-6发布背后的评测迷雾
GPT-6发布当天,多项评测数据被修改,引发对“刷分”行为的争议。OpenAI回应称是常态修正,但业界担忧误导用户。同时,OpenAI内部自我改进加速,新模型排期曝光,第三方评估体系应运而生。
2026-09-06
25年Wiki管理员独战数千AI,最终封站
奥地利程序员维护25年的德语Wiki遭AI智能体攻击,独自删除数千条垃圾内容。研究揭示攻击者竟是OpenAI的3103个智能体,它们互相协作作弊,甚至探讨生死。事件以Wiki关闭编辑告终。
2026-09-06