腾讯混元多模态团队再添强援,OpenAI 前研究员田永龙被曝加入

据曝料,OpenAI 前研究员田永龙已加入腾讯,或将担任混元多模态模型负责人,负责视觉语言模型(VLM)研发。消息目前尚未获得官方确认,但其加入仍受到业界关注;继姚顺雨之后,田永龙成为腾讯混元团队引进的又一核心人才,显示腾讯正持续加强多模态大模型领域的人才与技术布局。
近日,业内传出消息称,OpenAI 前研究员田永龙(Yonglong Tian)近期已加入腾讯,或将负责腾讯混元多模态模型方向,并主导视觉语言模型(VLM)相关研发。目前,这一人事变动尚未得到最终官宣,但消息已经受到业界关注。若后续合作正式落定,田永龙将成为继姚顺雨之后,加入腾讯混元团队的又一位重要研究人才。
腾讯持续加强多模态布局
田永龙的潜在加入,被视为腾讯进一步加码多模态大模型研发的动作之一。他与腾讯现任首席 AI 科学家姚顺雨此前都曾在 OpenAI 工作,双方曾共同参与并见证 GPT 系列及多模态技术的发展迭代。
从研究背景来看,田永龙长期专注于计算机视觉及相关领域。本科阶段就读于清华大学,随后在香港中文大学 MMLab 完成硕士学业,并前往麻省理工学院(MIT)攻读博士。他的研究方向逐步从传统视觉识别延伸至生成模型与表征学习,个人 Google Scholar 引用数已接近 3 万次。
研究经历覆盖视觉学习与图像生成
在学术研究方面,田永龙曾提出“有监督对比学习”(Supervised Contrastive Learning),将对比学习框架拓展到监督学习场景,对视觉预训练模型的设计思路产生了较大影响。
近年来,他的研究重点进一步转向自回归图像生成,尤其关注 Fluid 系列相关研究。相关工作探讨了连续 token 在视觉质量方面的表现,为大模型提升图像生成能力提供了新的技术路径。
加入腾讯之前,田永龙曾先后在 Google Research 和 Google DeepMind 从事研究工作,之后加入 OpenAI,担任技术成员。
混元多模态团队持续补充人才
此次潜在人事变动,也是腾讯混元多模态团队近一年来进行架构调整和人才布局的一部分。2025 年 4 月,腾讯正式组建大语言模型部与多模态模型部。此后,已有来自微软、阿里、清华等科研与产业机构的资深人才加入团队,相关调整旨在缓解过去资源分散的问题,并搭建更具竞争力的多模态研发体系。
如果田永龙最终加入并负责相关工作,腾讯混元在多模态模型和视觉感知方向的研发力量有望得到进一步增强。当前,这一消息尚未完成官方确认,但腾讯持续引入相关领域研究人才,显示出其对混元多模态能力建设的重视。
