据《智能涌现》独家获悉,腾讯混元多模态理解负责人胡瀚近期提出离职。胡瀚曾任微软亚洲研究院视觉计算组首席研究员,2025年初加入腾讯后负责视觉大模型研究,后转入大语言模型部旗下的“Frontier”前沿技术研究组,专注多模态理解,汇报给姚顺雨。他还曾承担世界模型研发工作。目前,胡瀚此前所在的研究组或将聚焦世界模型前沿研究,腾讯方面未予置评。
自2026年中以来,腾讯混元体系持续调整。7月初,前OpenAI研究院博士田永龙加入大语言模型部,接替胡瀚负责视觉语言模型(VLM)研发。姚顺雨上任后,将资源和人才聚焦于基础模型研发,如撤销AI Lab并合并其核心团队,同时加大对大语言模型人才的招聘力度。6月5日,腾讯云AI产业大会上,高管汤道生质疑腾讯AI是否“慢了”,但内部人士透露姚顺雨比高层更急,曾多次争取算力资源,并对数据问题严厉问责。
多模态理解研究虽已成熟(准确率超85%),但商业收益有限,用户更愿为文档处理、PPT制作等办公场景付费,这需要模型的推理、Coding和Agentic能力。腾讯算力资源相对有限(2025年资本开支792亿元,远低于阿里1260亿元和字节规划的700亿美元),因此暂缓多模态理解,聚焦前沿方向。7月6日,姚顺雨交出答卷——大模型Hy3,在中尺寸模型中已能与GLM-5.2、DeepSeek V4 Pro竞争,标志着混元半年内通过组织重组和战略回归,跻身AI第一梯队。