庞天宇以一种非常当下的方式官宣了自己加入腾讯——他亲自在小红书上发帖。就在昨天,他通过实名认证账号发布了一则招聘启事,并顺带确认了自己“最近加入了腾讯混元”。
作为清华大学计算机系博士、前新加坡 Sea AI Lab 高级研究科学家,庞天宇也成为继前 OpenAI 研究员姚顺雨之后,腾讯在近几个月内招揽到的第二位“95 后”顶尖 AI 科学家。
在职责分工上,庞天宇与姚顺雨并不存在上下级关系。公开信息显示,庞天宇将担任腾讯混元大模型团队首席研究科学家,以及多模态强化学习技术负责人;而姚顺雨此前披露,除“CEO 首席科学家”这一头衔外,他还负责 AI Infra 部门和大语言模型部门。
值得注意的是,腾讯重点打造的混元 3D 系列——包括世界模型相关业务——在去年一次大规模团队架构调整中,统一归入了多模态部门。
与相对低调的姚顺雨不同,庞天宇早已在中文互联网实现过“破圈”。早在 2021 年,还是清华博士生的他便登上综艺节目《燃烧吧!天才程序员》,成为少数被大众熟知的青年 AI 研究员之一。同时,他也长期以实名身份活跃于知乎等平台,直接参与技术讨论。
加入腾讯后,庞天宇再次选择在小红书“自宣”。这种看似“网红化”的操作,其实正是近一年 AI 圈的行业趋势:社交媒体逐渐成为重要连接器,科研大佬和 AI 负责人在平台上招聘、分享成果、对外发声,各家企业也都有“高 P 大佬”实名发帖。
而在腾讯内部,这种对外的开放姿态,与管理层的表述形成了一种有趣的对照。一方面,马化腾在员工大会上反复强调“稳扎稳打”;另一方面,他又亲自为 AI 社交产品“元宝”站台,并在春节期间推出 10 亿元现金红包活动,强势争夺 C 端用户。
这两条线索交织在一起,构成了腾讯 AI 的新叙事:产品层面,由元宝与混元冲锋在前;组织层面,引入姚顺雨、庞天宇等 95 后顶尖人才,将一批“少年英雄”推到台前。27 岁的腾讯,似乎希望用更年轻的面孔,重新讲述自己的 AI 故事。
01 走上综艺舞台的 AI 研究员
2021 年冬天,综艺节目《燃烧吧!天才程序员》开播,镜头中出现的是一群二十岁出头、专注于网络安全与 AI 的研究者。
节目将选手分为“攻防赛道”和“AI 赛道”。当时 25 岁的庞天宇,作为清华大学计算机系博士四年级学生,以“AI 选手”身份参赛。
在同期的媒体采访中,庞天宇用“普通”来形容自己。他强调自己“不穿格子衬衫”,日常生活包括打篮球、健身、打游戏和看电影。这种呈现方式也正契合节目初衷——借助一批精英青年技术人才,打破公众对程序员“单一、木讷、缺乏社交”的刻板印象。
出生于 1995 年的庞天宇,高中阶段便获得清华大学保送资格。2022 年博士毕业后,他加入新加坡知名研究机构 Sea AI Lab,担任高级研究科学家。Sea 集团在东南亚影响力巨大,也是电商平台 Shopee 的母公司。
在 Sea AI Lab 期间,庞天宇迅速获得学界认可。根据 Google Scholar 统计,他以第一作者或共同第一作者身份,在 ICML、NeurIPS、ICLR 等国际顶级机器学习会议上发表多篇论文,总引用次数已超过 1.4 万次。
尽管引用量并非衡量学术水平的唯一标准,但 1.4 万次引用已属于年轻 AI 研究者中的顶尖水平。作为对比,姚顺雨的 Google Scholar 总引用数更高,接近 1.6 万次。不过,两人的研究方向差异明显,单纯比较引用意义并不大。
在 Sea AI Lab 的研究生涯中,庞天宇的研究兴趣覆盖机器学习多个核心方向,尤其聚焦于可信机器学习、深度生成模型以及鲁棒性(robustness)。
所谓鲁棒性,是指模型在噪声、分布变化或对抗干扰等非理想条件下,依然能够保持稳定表现的能力。它关注的不是模型在“标准测试集”上的极致成绩,而是在真实复杂环境中是否可靠、是否可控。
在机器学习领域,鲁棒性与准确率之间长期被认为存在不可避免的权衡关系。庞天宇在 ICML 2022 的一篇论文中指出,这种矛盾并非模型能力的本质问题,而更多源于鲁棒性定义本身的不合理。
他提出了一种名为 SCORE(自洽鲁棒错误率)的新定义,通过重新设计鲁棒性训练的损失度量方式,以更符合“局部等变性(local equivariance)”的视角来描述鲁棒模型应有的行为。实验结果表明,模型可以在保持高准确率的同时,实现更稳定的对抗鲁棒性。
整体来看,庞天宇的研究路径始终围绕复杂环境下模型的稳定性与可靠性展开。这类研究并不直接追逐模型能力上限,却对多模态系统和智能体在真实产品中的可靠运行至关重要。在腾讯不断强化多模态与 Agent 能力的背景下,这种研究取向本身就具备明显的工程和产品导向。
近两年,庞天宇的研究重点进一步延伸至大模型与多模态系统在真实部署中的风险问题。2024 年,他参与发表的 ICML 2024 论文,系统性展示了多模态大模型在 Agent 化之后可能出现的“安全放大效应”:在实验中,单一对抗输入一旦被某个智能体“记住”,就可能在多智能体交互中迅速传播,进而导致整个系统失效。
这项研究首次将“大模型越狱”问题从单模型层面推进到多智能体系统层面,并给出了可复现的实验路径。
从公开成果来看,庞天宇的研究覆盖生成、理解以及系统层面的关键问题,既能参与核心模型研发,也能应对多模态与 Agent 落地过程中的稳定性和边界挑战。这种技术完整度,与腾讯混元体系的现实需求高度契合,也在一定程度上解释了腾讯向其抛出橄榄枝的原因。
02 庞天宇来到腾讯要做什么?
腾讯的多模态部门,是在去年组织架构重组后形成的。从腾讯的模型版图来看,该部门涵盖图像生成、视频生成以及 3D 生成等方向,包括单体模型与世界模型。
随着“少帅”庞天宇的到来,有必要先盘点他所接手的混元多模态基础。
在图像生成方面,混元图像已更新至 3.0 版本(HunyuanImage3.0-Instruct),并推出图生图能力及开源版本。与早期更强调“生成质量”的模型不同,这一版本更突出对复杂指令的理解与执行,将文本理解、视觉理解和图像编辑整合进同一套多模态架构。
在视频生成领域,腾讯在 2025 年持续完善混元视频系列,补充了图生视频、定制化生成等能力,并优化推理与部署方案,使其更适合开发者使用。
3D 则是腾讯多模态布局中最具长期指向性的方向。目前,腾讯已正式发布并开源混元 3D 世界模型,可根据文本或图像生成可漫游的三维场景,并支持导出至真实生产管线继续编辑和使用。
围绕这一模型,混元 3D 系列在 2025 年持续迭代,同时推出面向生产流程的工具产品,强化几何精度、可控性以及结果复现能力。
综合来看,混元多模态的阶段性成果已经十分清晰:在图像、视频、3D 三条线上同步推进,同时在生态层面坚持全面开源,试图持续扩大在开发者社区中的影响力。
从行业视角看,腾讯混元在多模态方向的开源模型活跃度较高。其中,混元 3D 系列在 Hugging Face 社区的下载量已超过百万次,在开发者群体中具备一定声量。相比之下,尽管混元也推出了大语言模型(如 Hunyuan-Large、Hunyuan-A13B 等),但在业内影响力仍不及其多模态生态。
随着多模态能力逐步补齐,新的难题也随之显现。当前混元多模态面临的核心问题,已不再是“能生成什么”,而是能否稳定、准确地按照用户意图完成复杂任务。
在不同模态下,这一挑战各有侧重:图生图不仅要改得精准,还不能误伤其他区域,同时保持风格与结构一致;视频生成的难点在于运动是否自然、镜头与主体前后是否一致,以及长序列是否容易失控;而在 3D 场景中,挑战则集中在几何精度、结果可控性以及生产流程的稳定复现。
去年 8 月,字母 AI 曾专访腾讯混元 3D 负责人郭春超。他在采访中表示,后续重要的优化方向之一,是逐步降低用户使用门槛,“比如帮助用户做更多 prompt 改写,或提供更多模态输入,如‘文+图’、‘文+多图’,让可控性更贴近用户的真实想法”。
可以看出,提升可靠性一直是混元内部聚焦的重点。随着腾讯近期不断释放加码 C 端 AI 业务的信号,多模态模型持续优化的紧迫性进一步上升。
在最近举行的腾讯员工大会上,马化腾亲自为元宝站台。腾讯一方面上线“元宝派”这种多人社交形态的探索,另一方面配合春节 10 亿元红包玩法,将 AI 助手从单人对话拉向群体场景和高频社交分发。元宝中的多模态能力也即将迎来海量用户的真实检验。
相比 B 端场景,C 端应用对模型输出稳定性的要求明显更高。B 端用户往往可以接受一定程度的反复尝试,而 C 端用户虽然对细节质量容忍度更高,但对可靠性要求更严苛,因为他们缺乏足够耐心进行多次试错。
基于此,可以对庞天宇“来干什么”作出一种判断:补强混元在多模态强化学习和模型行为边界研究方面的能力,提升多模态场景下模型输出的稳定性,并优化跨模态生成与理解任务。
除业务层面之外,庞天宇的加入同样释放了清晰的组织信号。作为腾讯近期招揽的第二位 95 后 AI 学者,他的到来,显然体现了腾讯在 AI 战略中,有意将年轻人才推向台前。
03 AI 业务要摆脱“旧形象”,新面孔很重要
“我们的团队非常年轻且国际化,博士比例大约占到三分之二,基本都来自海内外名校。”郭春超在去年一次专访中这样描述混元 3D 团队。
不久之后,腾讯对外公布了架构大调整,并先后引入姚顺雨和庞天宇,分别坐镇语言模型/基础设施层以及多模态领域。
这背后,反映出腾讯在 AI 人才结构上的明显转向。过去两年,腾讯愈发明确地将 AI 人才视为技术竞争的核心资产。
在刚刚过去的腾讯年会上,马化腾表示:“每个企业的基因不同、体质不同,腾讯的风格就是稳扎稳打。”他同时指出,ChatGPT、DeepSeek 等产品改变了行业进程,但腾讯仍将坚持以“产品长期竞争力和用户体验”为核心路径。
与此同时,他提到腾讯在过去一年显著加大了对原生 AI 人才的吸引力度,希望通过年轻化力量重构研发团队。在腾讯迈入 27 岁之际,马化腾用“重构”和“年轻人才”两个关键词,概括 AI 业务的战略调整。
这一思路在腾讯的“青云计划”中体现得更为具体。该计划面向全球招募 2024—2026 年毕业的博士,以及 2025—2026 年毕业的本科和硕士生,为青年人才提供导师资源、算力支持以及极具竞争力的薪酬和职级。
马化腾所说的“重构”,在某种程度上为腾讯 AI 及混元团队搭建了一套梯队式成长叙事,让更多技术青年看到在腾讯内部成长为核心技术骨干的路径。
与此同时,字节跳动、阿里巴巴等大厂也在用真金白银抢人:字节上调薪酬和年终奖金预算,奖金池规模提升约 35%,以增强 AI 业务的薪资竞争力;阿里在秋招中,AI 岗位占比超过六成,明确将 AI 技术人才作为重点增长方向。
为对标这些动作,腾讯不仅加大资源投入,也开始树立一批年轻的“带头人”,让姚顺雨、庞天宇等人成为团队的标识性人物。
在相当长的一段时间里,腾讯给外界的整体印象偏向克制与稳健。但“稳扎稳打”的另一面,是组织与决策上的惯性,这在 AI 竞赛中并不占优:在 C 端层面,腾讯的元宝尚未压制豆包和 DeepSeek,甚至在部分声量与活跃度指标上,被后来者千问反超。
正因如此,从核心团队成员入手进行调整,对外释放更年轻、更具进攻性的面孔,成为腾讯打破路径依赖、重塑 AI 叙事的必要选择。
频繁在小红书和知乎发布招聘启事的庞天宇,正是这一转变最直观的信号——在定义未来生产力的 AI 行业里,叙事本身也必须是“新瓶装新酒”。27 岁的腾讯,需要一批“少年英雄”,为年仅 3 岁的混元讲好 AI 的故事。



