腾讯再获AI人才,OpenAI前研究员田永龙加入大语言模型部门,从事视觉语言模型研发。他曾任职谷歌DeepMind和OpenAI,与首席AI科学家姚顺雨有共事经历。姚顺雨此前推动混元模型以用户体验为核心,提升数据质量,近期发布Hy3等模型,性能显著提升。
腾讯在 AI 人才争夺上又有新动作。继去年姚顺雨加入之后,又一位 OpenAI 前研究员选择加盟腾讯。
据腾讯相关负责人透露,OpenAI 前研究员 Yonglong Tian(田永龙)已经正式加入腾讯大语言模型部门,后续将从事 VLM(视觉语言模型)相关的研发工作。
长期稳定更新的攒劲资源: >>>点此立即查看<<<

公开履历显示,田永龙毕业于清华大学,先后在谷歌 DeepMind 和 OpenAI 工作过,主要研究方向涵盖计算机视觉、视觉表征学习以及生成式模型。值得注意的是,他此前与现任腾讯 CEO/总裁办公室首席 AI 科学家姚顺雨有过共事经历。
将田永龙招致麾下,只是腾讯扩充 AI 人才版图的一个缩影。去年 12 月姚顺雨加入后,已经给腾讯的 AI 研发带来了实实在在的变化。
先说说几个关键信息。姚顺雨推动了模型与 C 端应用元宝的联合设计(co-design),混元模型也从过去特别在意外部榜单排名,转向以用户体验为核心目标。数据层面,以往大模型训练数据量大但质量参差不齐,姚顺雨在 HY3 上线前砍掉了大量对模型训练无用的数据,把重心放在了提升数据质量上。
腾讯高级执行副总裁、云与智慧产业事业群 CEO 汤道生对姚顺雨的评价是:做了很多化繁为简的工作,HY3 相比过去也有很大进步。
从模型迭代节奏来看,姚顺雨在今年 4 月交出了加入腾讯后的第一份成绩单。腾讯混元在那时发布了 Hy3 preview 语言模型,并将其开源。姚顺雨当时说,这只是混元大模型重建的第一步。这个模型是个融合了快慢思考的混合专家模型,总参数达到 295B(B 为 10 亿),激活参数 21B,最大支持 256K 上下文长度。
最近混元又发布了 HY3,同样采用 MoE 架构,保持 295B 总参数、21B 激活参数、256K 上下文长度的规格。根据官方介绍,Hy3 延续了能力增长曲线的趋势,通过进一步提升后训练的算力规模以及数据质量和多样性,在各类任务上的表现都比 Hy3 preview 更胜一筹,以较小的尺寸首次达到了比肩国内外大尺寸旗舰模型的效果。
在评测数据上,混元表示,基于真实日志的评估显示,Hy3 的常识错误率比 preview 版本下降了一半,幻觉率更是下降了超过一半。内部评估中,Hy3 在综合办公与生活服务两大场景上已经超过了 GLM 5.1 等国产模型。
混元近期还披露了 HY3 Preview 上线后的运营数据:日均 token 消耗量增长了 20 倍,WorkBuddy 平台上自主选择 Hy3 preview 的用户数增长了 6 倍。这些数字背后,反映出用户对模型迭代的认可正在加速。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述