首页 > AI头条  > 正文

OpenAI又走一员大将:田永龙疑似投奔腾讯混元,将执掌多模态方向

2026-07-08 14:20 · 来源: AIbase基地

据报道,OpenAI前研究员田永龙已于近期加入腾讯,预计将出任混元多模态模型方向的负责人,后续参与视觉语言模型的研发工作。若这笔人事变动最终落定,这将是继姚顺雨之后,又一位从OpenAI核心研究团队转投腾讯混元的研究人员。

田永龙与姚顺雨的渊源可追溯至OpenAI共事时期。 2025 年 9 月, 28 岁的姚顺雨从OpenAI离职加入腾讯,担任"CEO/总裁办公室"首席AI科学家,直接向总裁刘炽平汇报。两人在OpenAI期间同属研究团队,亲历了GPT系列与多模态技术的快速迭代,如今再度汇聚于腾讯混元麾下。

清华到MIT的顶级履历,Google Scholar引用近2. 9 万

田永龙的学术履历堪称中国计算机视觉领域顶尖人才的典型路径。他本科毕业于清华大学,随后在香港中文大学获得研究硕士学位,师从汤晓鸥和王晓刚,在MMLab打下视觉识别与深度学习的基础。此后他进入MIT EECS系,在生成模型领域学者Phillip Isola指导下攻读博士,于 2022 年毕业,研究重心从传统视觉识别转向生成模型和表征学习。

博士毕业后,田永龙先后在Google Research和Google DeepMind担任高级研究科学家,随后转投OpenAI担任Member of Technical Staff。其Google Scholar引用数已达 28778 次,h-index为35,仅 2026 年就有 3436 次引用。他最具影响力的工作之一是有监督对比学习,将对比学习框架推广到监督场景,影响了SimCLR、MoCo等后续视觉预训练模型的设计思路。

混元多模态持续招兵买马,人才拼图加速成型

田永龙的加入,是腾讯混元多模态团队近一年来一系列人事调整的最新一环。 2024 年底,原多模态统筹负责人刘威离职创业主攻视频生成,此后该方向一度由腾讯副总裁蒋杰直接负责。 2025 年 4 月,腾讯在TEG体系内正式成立大语言模型部与多模态模型部,从组织架构上解决此前"虚拟团队、资源分散"的痛点。

此后人才引入持续加速:前微软亚洲研究院首席研究员胡瀚、原阿里通义实验室应用视觉团队负责人薄列峰、清华大学博士庞天宇相继加盟。如今再加上可能到来的田永龙,腾讯混元多模态团队的人才拼图正在快速成型。从姚顺雨到田永龙,腾讯正用"OpenAI校友网络"持续为核心研发注入活水,这场AI人才争夺战的格局正悄然改变。


  • 相关推荐
  • 上线仅仅一周!腾讯混元大模型Hy3总调用量增长超68倍

    腾讯混元官方发文称,截至今日,腾讯混元大模型Hy3总调用量较上一代模型(Hy2)增长已超68倍。 同时,延续了Hy3 preview版本的增长态势,Hy3展现出更高的增长斜率;发布一周后,Hy3在OpenRouter全球大模型调用量总榜排名第一。 在Agent产品中,Hy3也展现出更强的竞争力,WorkBuddy自选模型的用户中,选择Hy3的占比达到60%。

  • 豆包视频通话背后,火山引擎重构 Agent 时代多模态传输底座

    多模态交互正成为提升通用Agent用户体验的关键。过去AI多为文本或图片问答,如今用户期望AI能透过摄像头实时讲解、在任务中持续对话。这背后需要低延迟、稳定、可打断的传输系统。豆包从WebSocket、QUIC到WebRTC逐步演进,火山引擎更自研多模态传输系统,通过C/S架构、MoQ协议和网关智能处理,解决弱网、高并发、成本等问题。该系统已在豆包亿级DAU场景落地,使业务规模翻10倍。长远看,多模态传输正从通信管道成为AI原生基础设施,支撑高频率、全场景的人机交互。

  • 腾讯混元:新模型Hy3调用激增 WorkBuddy已紧急扩容

    腾讯混元Hy3模型因WorkBuddy首发上线后用户量激增,算力资源紧张致排队率超50%,现已紧急扩容完成。Hy3采用MoE架构,总参数量295B,支持256K上下文,以较小尺寸接近大模型效果。在办公场景测试中,其任务成功率从72%提升至90%,平均耗时缩减34%,主打Agent智能体与生产力场景能力升级。

  • OpenAI报告:ChatGPT出现重大故障

    今日,OpenAI官方状态页面显示,ChatGPT出现服务故障,存在错误率升高、部分用户无法正常登录以及间歇性报错等问题。 OpenAI 团队正在对此展开排查处理,截至本文发稿时,该故障已持续20分钟以上。

  • AI日报:豆包、千问下线AI拟人化功能;腾讯混元Hy3发布;Gemini3.5 Pro7月17日发布

    通义千问推出全新实时语音识别模型Fun-ASR-Realtime,提升性能与语言覆盖。豆包、通义千问应新规下线AI拟人化功能,引发用户不满。腾讯混元Hy3发布,强化智能体能力并以高性价比定价与开源策略推动普及。全球首例AI智能体全流程勒索攻击“JADEPUFFER”曝光。Meta调整节奏,Llama API预览版将下线,模型仍可获取,建议开发者迁移。Google Gemini 3.5 Pro定档7月17日,正面对垒DeepSeek V4。影坛版权博弈升级,Midjourney在好莱坞诉讼中要求片厂“自证清白”。JoyAI上线UGC数字人功能,打造个性化虚拟形象。

  • 价格战一触即发!奥特曼放话OpenAI降价75%:被DeepSeek等中国AI逼的

    OpenAI创始人兼首席执行官萨姆奥特曼在社交媒体上公开表示,公司旗舰模型GPT-5.6 Sol的定价已是竞争对手Anthropic Claude Fable 5的一半,并称OpenAI很乐意降价75%。 此次价格战信号发出之际,正值Anthropic在企业客户和开发者市场加速扩张,中国AI低价模型持续施压。 GPT-5.6系列于7月10日正式发布,旗舰版Sol(太阳)定价为每百万输入Token 5美元(约合34元人民币)、输出30美元(约合204

  • 腾讯发布混元Hy3极致量化版本:单卡就能跑!总参数295B

    腾讯推出混元Hy3极致量化版,295B总量、21B激活,支持256K上下文。为降低部署门槛,提供1bit(85.5GB单卡承载)、4bit(双卡运行)和GPTQ+Int4企业API三种方案。量化后性能近乎无损,1bit版在同代码、长文本等任务中仅小幅下降,打破低比特必降智痛点。同时通过MTP加速,1bit解码提速约50%,4bit接近60%,大幅缓解本地生成卡顿。

  • 像真人聊天!OpenAI发布GPT-Live:AI可同步听与说

    OpenAI发布新一代语音模型GPT-Live,让人与AI的对话更加自然流畅,体验更接近真人交流。 据介绍,目前每周有超过1.5亿人使用ChatGPT的语音和听写功能,应用场景涵盖免提日常帮助、语言练习、睡前故事讲述,以及通勤途中的闲聊陪伴。 此前的语音功能依赖于较为传统的回合制模型,在回答准确性和对话自然度方面存在局限,有时难以维持顺畅的交互节奏。 而GPT-Live实现了边�

  • OpenAI计划推出旗下首款硬件产品:移动式智能音箱 定位为AI陪伴助手

    OpenAI备受瞩目的首款硬件设备,将是一款可移动、无屏幕的智能音箱,定位为人工智能时代的新型家用电脑。 该产品仍在开发中,定位具备人类特质的居家AI陪伴助手。它将帮助用户控制智能家居设备、播放媒体内容、回答问题、收发信息,并调用ChatGPT的丰富功能。 不过,OpenAI的硬件布局已遭遇阻力。苹果公司上周起诉OpenAI窃取商业秘密。OpenAI方面认为,该设备与苹

  • 腾讯最强语言模型转正!混元Hy3正式发布:更聪明、更便宜

    腾讯混元大模型Hy3正式发布,采用MoE架构,总参数2950亿,激活参数210亿。Hy3展现出超越同级乃至更大尺寸旗舰模型的性能,在多任务上取得显著进步,尤其在软件开发、办公、金融建模等生产力场景实用价值突出。其幻觉率与常识错误率大幅降低,跨脚手架泛化能力增强。腾讯云API定价输入1元/百万Tokens。

今日大家都在搜的词: