9月9日,腾讯大模型团队迎来了一位重量级技术专家的正式到岗。前OpenAI研究员田永龙已加入腾讯CEO/总裁办公室,出任“混元多模态负责人”。他将直接向腾讯大模型负责人姚顺雨汇报,并重点负责VLM(视觉语言模型)相关的研发工作。田永龙在计算机视觉与生成式模型领域深耕多年,曾在谷歌与Google DeepMind任职,其加入被业内视为腾讯在大模型视觉理解领域发力的重要信号。
[IMG:1]这并非腾讯首次引入OpenAI的核心研发力量。早在去年12月17日,腾讯便任命前OpenAI高级研究员姚顺雨为“CEO/总裁办公室”首席AI科学家。姚顺雨同时兼任AIInfra部与大语言模型部负责人,直接向腾讯高管刘炽平、卢山汇报。随着田永龙的到位,腾讯混元团队已形成“前OpenAI核心”双核驱动的研发架构。两人曾在OpenAI有过共事经历,这种默契将有助于腾讯在多模态大模型的技术攻关上加速推进。
技术团队的持续扩充,直接推动了腾讯混元大模型性能的跃升与市场表现的爆发。据OpenRouter数据显示,在8月31日至9月6日的统计周期内,全球AI大模型总调用量达到115万亿Token。其中,中国大模型周调用量为56.72万亿Token,连续19周超过美国。在这一轮竞争中,腾讯表现尤为抢眼。其于8月28日发布的新一代MoE(混合专家模型)旗舰产品——混元Hy4 preview,以周调用量14.7万亿Token的成绩位居全球第一,环比增幅高达379%。
[IMG:2]从技术参数上看,混元Hy4 preview展现了旗舰模型的硬核实力。该模型总参数量达到770B,但通过MoE架构,激活参数仅为49B。这种设计使得模型在保持高性能推理的同时,大幅降低了推理成本。此外,该模型支持100万Token的上下文长度,这意味着它可以处理相当于几本长篇小说的文本量,在长文本总结、复杂代码生成等场景下具备显著优势。这一参数配置在当前的通用大模型市场中处于第一梯队,为腾讯在B端和C端市场的落地提供了坚实基础。
此次调用量榜单的竞争格局也折射出全球AI产业的微妙变化。除腾讯混元Hy4 preview登顶外,GPT-5.6Luna位列第二,智谱GLM-5.3Flash升至第三。值得注意的是,全球调用量排名前五的模型中,有四款来自中国。据OpenRouter发布的该周数据显示,中国模型在应用活跃度上已呈现集体领跑态势。这表明,在经历了大模型“百模大战”的初期混战后,中国科技企业已逐步在工程化落地与生态应用上建立起竞争优势。
[IMG:3]尽管数据亮眼,但行业面临的挑战依然严峻。大模型研发是一场持久战,巨额的算力投入与人才成本对企业经营构成了持续压力。虽然混元Hy4 preview选择了开源策略,有助于快速构建开发者生态,但如何在商业变现与生态开放之间找到平衡点,仍是腾讯需要解决的难题。此外,随着多模态成为下一代大模型的必争之地,田永龙能否迅速将视觉语言模型(VLM)的技术优势转化为产品胜势,将直接影响腾讯混元在下一阶段竞争中的地位。
从产业视角看,腾讯正试图通过“顶层架构设计+核心人才引进”的组合拳,巩固其在AI浪潮中的既有优势。姚顺雨负责整体大模型架构与基础设施,田永龙攻坚多模态前沿,这种分��旨在打通从底层算力到上层应用的完整链条。据业内人士分析,随着视觉理解能力的融入,大模型将不再局限于文本处理,而是向更复杂的物理世界交互演进。腾讯混元此次的人事与技术动作,或许正是为了应对这一即将到来的行业变革所做的关键布局。
本文由AI辅助生成



