BAT天价挖角Gemini,这次终于找对人了?
据雷峰网独家获悉,一位 Google Gemini 的预训练专家近期已加入国内某互联网大厂。该研究员在 Google 的职级或为 L7-L8,接近总监级别,长期在英国工作,入职后主要从事预训练相关工作,也经常往返国内出差。一位知情人士认为,这可能是国内大厂这一轮争抢 Gemini 人才以来,第一次真正“找对了人”。
上述人士告诉雷峰网,此前多家大厂均从 Gemini 引入过人才,但部分人选并未触及核心,或只参与预/后训练边缘环节,或只从事管理工作,职责并不覆盖预训练最为核心的内容。
去年底,国内基模团队对海外 AI 人才的关注明显向“预训练”靠拢。一位业内人士表示,以前国内大模型的主线是追赶规模——堆算力、堆数据,但堆数字的做法很快碰到 Scaling law 的天花板,性能提升愈发困难。真正拉开差距的,是预训练阶段的技术路线选择、数据分布策略以及一二阶优化器的应用方法。每一个策略上的微小失误,都会在时间和算力资源上造成巨大浪费。各大厂及 Kimi、智谱等公司,光在预训练优化器选型上,内部就有诸多分歧,各家优化策略也截然不同。
而这类“提升”和“避坑”经验,很多并不写在论文里。比如一种优化方法理论上有效,但放到真实的大模型训练中,究竟什么时候用、怎么调整,可能需要经历完整的训练过程才能知道。不同训练方案之间怎么取舍,也很少被完整公开。多位大厂基模专家曾向雷峰网提到,在大模型团队内部,类似的技术路线选择,往往会受到团队过往经验影响。此前参与 Scaling 相关工作时,就曾接触过多种训练技术,但一些方法最终并没有被完整采用,原因并不只是“技术行不行”,还包括对稳定性、风险和实际收益的判断。
于是,能把模型训到前沿水平的海外实验室,成了国内公司挖猎人才的首选目标。Gemini 是其中最典型的目标。部分公司人员认为,Gemini 技术底子够厚、人才密度够高,而 Google 庞大的组织和频繁的调整,恰好留出了挖人的窗口。当时一些公司的思路很直接:既然自己的预训练遇到了瓶颈,那就去找已经把前沿模型训练出来的人。但真正接触之后,他们才发现,能掌握 Gemini 核心预训练的人少之又少。
一开始,不少人的第一反应是去 Google 的硅谷大本营找。毕竟 Google 的核心 AI 业务长期与美国科技产业中心紧密相连,OpenAI、Anthropic、Meta 等公司的核心团队也主要集中在美国。但实际情况有点特殊,硅谷的 AI 预训练研究员告诉雷峰网,Google 有意把最核心的预训练人才留在 DeepMind 英国办公室,与硅谷的高曝光区隔开,以降低被“挖墙角”的风险。
再看国内。从今年7月入职腾讯的田永龙,到此前加入字节的吴永辉、乔思远,再到阿里的周浩等等,越来越多有 DeepMind 或 Gemini 背景的人,开始进入中国大厂。外界看来,这样的履历足够有分量。但 Gemini 员工向雷峰网坦言,很多科学家都来自硅谷办公室,而非英国,因此并没有真正掌握 Gemini 预训练的核心方法,所以各家公司只能在预训练上摸着石头过河。

这也让一些国内公司意识到:如果目标是寻找掌握关键方法的 DeepMind 预训练人才,不能只盯着硅谷,天高皇帝远的英国办公室,才是藏龙卧虎之地。而近期该互联网大厂的动作,从硅谷到伦敦,让高招目标正变得越来越具体。
更多推荐阅读

横扫四大榜单,DM0.5凭什么面面俱到?
一个模型同时占据四个能力子榜单的榜首,这在具身智能行业里不多见。 RoboColiseum 由智元机器人发起,联合高校、科研机构、开源社区及机器人企业共同建设,把评测拆成四个维度:指令跟随、空间理解、扰动适应、通用操作。参评者只要在任何一个维度上有结构性短板,就会在对应子榜上掉下来。而原力灵机的通用具身基础模型 DM0.5 在四个子榜上全部排名第一,且目前是唯一做到这一点的模型。 具身评测行业...
2026-09-15
金融AI公司讯兔科技完成超3亿B轮融资,一年连融三轮
近日,中国金融AI领跑者讯兔科技正式完成超3亿元人民币B轮融资,过去一年内已连续完成三轮融资。本轮投资方覆盖险资、券商、公募、产业资本与头部投资机构,包括保险业国家级投资平台中保投资、广发信德,以及启明创投、琥珀资本、嘉程资本、信宸资本、钟鼎资本等新老股东,华兴资本继续担任独家财务顾问。融资后,公司将继续加大模型与产品技术投入,拓展多元资产客群,深化产业上下游协同,并稳步推进海外布局。 中保投资...
2026-09-15
北大团队重新定义端侧AI,元空智能跑进惠普预装
静态互联网数据的增长红利已经见顶,下一轮模型能力的跃迁将越来越依赖与真实环境持续交互的“端侧”。从北大走出的元空智能(元空AI)给出这一判断,并重新定义端侧AI:生产力=元空端侧AI=模型×Agent×设备。端侧AI由此从“把模型搬下来”的单向链路,变成能自己转起来的飞轮。 三年前,元空AI靠国内最早一批AI Excel产品ChatExcel出圈,积累上百万用户。三年后,它从云端应用杀到本地端侧...
2026-09-15
仿真数据降本90%,虚时科技冲刺具身智能最后一公里
2026年上半年,具身智能赛道融资超460亿元,人形机器人单价迈入“万元以内”。但行业面临真机数据太贵、太慢的瓶颈。近期测试显示,利用规模为真机数据5倍的仿真数据训练,可将机器人真实操作成功率提升40%,成本仅为真机数据的三分之一。业界共识日益清晰:要走向物理AI的GPT时刻,数据需求将超出大模型两到三个数量级,仿真成为通向拐点的关键路径。 国内初创公司虚时科技在底层技术上取得突破,将单个仿真场...
2026-09-15
半年6亿人追AI短剧,红果热播榜前99占77席
3人核心团队,10万注册资金,半年连出十二季,保守估计利润600万,乐观2000万——AI短剧《万妖图录传》的爆发,正是行业缩影。年初红果APP才设AI剧独立入口,如今热播榜前99名中AI短剧独占77席,必看榜、热搜榜、收藏榜也全被“血洗”。爆款门槛水涨船高:去年播放量破亿可进年度TOP20,如今首日热度破亿的爆剧接二连三。出海同样凶猛,中国出品的AI短剧已占海外七成以上市场,圈内流传“3000块...
2026-09-15
7名博士生3个月从零训出7B大模型,代码数据全公开
北京中关村学院7名博士生用一个暑假从零训练出7B大模型ZGCM-1,并开放各阶段训练数据、配方、模型权重、训练代码、中间checkpoint和日志,供研究者追溯复现。在多项通用评测中,ZGCM-1与Qwen3-8B等同规模模型表现相近,部分数学推理和搜索评测中可与Qwen3-235B-A22B、GLM-5.1等更大模型比较。 七人背景分别为人工智能、网络、化学、生物和网安。他们因兴趣凑到一起,平...
2026-09-15