首页 > 传媒 > 关键词  > 腾讯云最新资讯  > 正文

腾讯云副总裁吴运声:大模型全矩阵产品升级 助力产业落地

2024-09-06 16:33 · 稿源: 站长之家用户

9月5日,在2024腾讯全球数字生态大会云上智能峰会上,腾讯云副总裁、腾讯云智能负责人、优图实验室负责人吴运声分享了腾讯云在智能领域的比较新进展,并探讨了大模型在产业中的应用和未来发展。

腾讯云副总裁、腾讯云智能负责人、优图实验室负责人吴运声

吴运声在演讲中指出,大模型的发展呈现出两个明显趋势:模型性能不断提升和落地场景不断丰富。他强调,面向场景创造价值才是大模型发展的意义。基于全矩阵的大模型产品,腾讯已经服务了众多客户,在知识管理、智能客服、研发提效、智能营销、内容生成、办公协同、风险管控等场景中,帮助企业实现了降本增效和业务创新。

腾讯云的大模型策略以实用性为核心,满足不同企业在大模型时代的需求。腾讯已经构建起了全链路的大模型产品矩阵,包括底层基础设施、帮助企业训练专属模型的TI平台和行业大模型解决方案,自研的混元大模型,构建应用的平台工具,以及基于大模型的各类智能应用。

吴运声介绍,腾讯比较新发布的混元Turbo版本通过自研的万亿级层间异构MoE技术,相比前代模型实现了训练效率提升108%,推理效率提升高,推理成本降低50%。同时,混元Turbo的效果在多个基准测试上对标GPT-4o,且第三方测评居国内首先。

腾讯云在今年5月还一并推出了三款PaaS产品——大模型知识引擎、图像创作引擎和视频创作引擎。经过两个月的迭代,这些产品的能力进一步升级,可以为电商、出海等领域的客服营销、企业知识社区等众多业务场景提供效率的助力和创新的支持,也进一步加快了大模型在实际场景中应用落地的速度。

在模型训练工具方面,为了帮助企业用户更便捷地打造专属模型,人工智能开发平台TI平台也进行了全新升级。在精调数据准备层面,TI平台全新支持面向多模态大模型的数据集管理和数据标注,首创了基于Schema的标注方法,支持用户自动生成个性化标注工作台,支持文生文、图生文、图文改写、图文混合问答等主流场景下的全部细分任务类型。

同时,腾讯云将2D数智人、3D数智人和声音复刻管线全面输出,支持企业私有化部署和灵活定制。管线输出意味着,客户可以将训练数据和训练模型都部署在自己的环境上,推动数智人在更多场景的普及和落地。

附:演讲全文

尊敬的各位嘉宾、媒体朋友们,

大家好!

我是腾讯的吴运声,很高兴在这里跟大家分享腾讯云在智能领域的比较新进展和思考。

大模型已经发展了两年,我们能明显看到两个趋势:一方面,模型性能在不断提升,围绕着模型的产品使用门槛也变得更低、更加易用;另一方面,企业和开发者积极探索大模型与自身业务场景的结合,大模型的落地场景不断丰富、更纵深。我们认为,面向场景创造价值才是大模型发展的意义。

腾讯的大模型策略,从最开始就以实用为目标,我们希望构建起离产业最近的AI产品矩阵。从底层的高性能计算、存储、网络等AI infra产品,到一站式的人工智能开发平台TI和行业大模型解决方案,再到自研的混元大模型,以及基于大模型的各类工具和智能应用,我们提供了全方位的产品,满足企业在大模型时代的各类需求。无论是做大模型的企业,还是想要搭建AI应用的创业者,还是想利用AI来实现降本增效的企业,都能在腾讯云上找到好用的工具。

去年的生态大会上,我们正式发布了全链路自研的腾讯混元大模型。经过不断的迭代创新,混元已经稳居国内大模型首先梯队。

今天,我们正式推出了更快更强的混元Turbo版本,通过自研的万亿级层间异构MoE结构,混元Turbo用更多的专家数、更少的激活参数量实现了更好的效果。相比前一代MoE大模型,腾讯混元Turbo的训练效率提升108%,推理效率提升1倍,推理成本降低50%,仅用一半训练语料,就实现效果提升14%,中文场景的效果对标GPT-4o。技术创新让我们可以更多地让利给客户,混元Turbo的定价仅为混元Pro版的一半。

在多模态领域,混元的多项能力也在国内保持领先。混元生图是头个中文原生的DiT架构文生图开源模型,目前在网络衍生的模型数量超过2000个。这也充分证明了开发者对于我们模型能力的认可。

近期,混元还推出了基于 MoE 架构的多模态理解大模型混元vision。我们在架构、训练方法和数据处理方面进行了创新和深度优化,显著提升了性能,能支持比较高7K 分辨率、比较大长宽比16:1的图片的理解。在近期发布的中文多模态大模型 SuperCLUE-V 基准评测中,腾讯混元斩获国内排名首先,超越了多个主流闭源模型。

在自研的混元大模型之外,为了帮助企业用户更便捷地打造专属模型,我们的人工智能开发平台TI平台也进行了全新升级。在精调数据准备层面,我们全新支持面向多模态大模型的数据集管理和数据标注,首创了基于Schema的标注方法,支持用户自动生成个性化标注工作台,支持文生文、图生文、图文改写、图文混合问答等主流场景下的全部细分任务类型。

高质量的训练数据是精调出一个可落地大模型的前提条件。TI 平台的多模态数据集管理和数据标注能力,可提升大模型精调的数据准备效率和训练数据质量,从而提升大模型训练效率和最终效果。

大模型训练之外,针对OCR和工业质检场景等垂直训练场景,我们也对产品进行了升级。OCR场景中,可以实现智能反馈出模糊、反光等场景下的误识别,水印识别平均准确率提升至95%。在工业质检场景下,我们全新支持基于Visual Prompting 的小样本分割链路,并推出缺陷感知通用模型、缺陷自动合成功能,可实现“0” 标注或“1”标注下解决质检问题。

具体到模型工具产品方面,今年5月,我们推出了三个大模型PaaS产品:知识引擎、图像创作引擎和视频创作引擎,帮助企业快速、轻松打造AI原生应用。

大模型知识引擎聚焦企业知识服务场景。通过该平台,企业用自然语言和简单配置,5分钟就可以开发出一款大语言模型应用,服务于客服营销、企业知识社区等业务场景。经过几个月的产品迭代,知识引擎产品在用户需求识别与理解、企业知识处理、检索和理解能力上,都有很大的升级。

比如,我们综合运用向量检索、摘要检索、text2sql多种技术手段,显著提升了复杂大表的检索及问答准确率。同时,我们升级了升级多模态知识解析、检索、阅读理解能力,实现读懂文中的“数据图”、“自然场景图”、“图文关系”。

同时,我们提供了更灵活的购买方式,支持组件能力的单独输出,企业可以按需购买文档解析、文档拆分、向量化等能力,按需部署到自身的应用中去。

在图像创作引擎层面,基于混元生图能力的升级,我们的图像风格化、AI写真、商品背景生成、模特换装等功能也进一步实现了迭代。在AI写真层面,我们实现了免训练技术突破,输入一张照片后可直接跳过训练环节等待,一键生成高清写真艺术照,整体出图耗时缩短75%。

针对很多电商商家高频使用的商品背景生成能力,我们大幅提高了背景画面真实度、商品分割细腻度,以及商品与背景间融合的自然度与交互合理性,实现商品在不同场景中高度逼真的虚拟效果展示。在模特换装场景下,我们采用3D先验方案,提升重建人像效果,在高度保持模特脸部、手部细节的同时,比较准确将服装版型细节与模特身体特征对齐,确保换装后的效果逼真自然。

基于混元的DiT架构模型,我们的视频创作引擎也迎来了全新的升级,新增了图片跳舞、图片唱演和视频转译等能力。

首先,我们来看下图片跳舞能力,目前,我们已经实现了单段舞蹈的生成时间从10分钟下降至1分钟级别,同时支持转身、侧身等难例舞蹈动作。人物跳舞的自然度已经有了很大的提升,这背后是我们基于3d-boby重建技术,进一步优化了算法,画面的真实度和自然度也有了明显提升。

在图片唱演层面,我们目前可以支持一张人像图片生成一段唱演视频,视频生成的人物的面部表情和情绪演绎都更加自然灵动。

同时,针对很多客户有需求的在视频转译能力,我们接入了混元文生文大模型和 TTS 技术,让转译后的视频能够保留说话人的音色特征,同时实现说话人口型与目标语种一致的视听效果。目前视频转译功能支持15+小语种,覆盖主流外语翻译,可应用于视频本地化、跨境电商等场景。

基于腾讯先进的形象驱动、自然语言理解和识别能力,我们的数智人形象自然度业界领先。目前,腾讯云智能数智人已经在业务办理、用户运营、营销获客以及品牌宣传等业务场景中落地。

今天,我们也将2D数智人、3D数智人和声音复刻管线全面输出,支持企业私有化部署和灵活定制。管线输出意味着,客户可以将训练数据和训练模型都部署在自己的环境上。我们的合作伙伴也可以基于我们的管线能力批量生成数智人,更好地推动数智人在更多场景的普及和落地。

基于我们全矩阵的大模型产品,我们已经服务了众多客户,在知识管理、智能客服、研发提效、智能营销、内容生成、办公协同、风险管控等场景中,很多客户利用我们的产品实现了降本增效和业务创新。

在智能客服与知识管理场景中,基于大模型的生成能力,可以显著提升复杂问题的解决效率,提升回答质量。比如,汽车售后服务是一个典型的专业客服场景,涉及的知识复杂,汽车说明书包括图片、表格等众多形式,传统客服机器人无法及时准确地回答问询。我们与长安汽车共创,利用大模型知识引擎整合汽车使用手册等资料,有效解决了客户在车辆使用和维护中的疑问,显著提升了客户服务体验。

在智能营销场景,大模型可以提升广告素材的生产效率,提升营销互动的趣味和互动性。比如,蒙牛在一场营销活动中,利用图生图能力,将用户上传的全家福转化生成为特制的卡通画风,助力会员拉新、提升用户活跃。活动期间小程序相对于去年同期提升80%以上。

在内容创意场景,大模型可以让内容生产的周期大幅缩短,提供更多的创意玩法。比如,人民日报、新华社等媒体结合我们的文生视频能力,创作了很多视频作品。过去,视频内容需要一帧帧进行设计和制作,制作周期短则数天,长则数月。现在借助视频生成能力,只需一段文字或者几张图片,就能在几分钟内生成优质视频内容。

在研发提效领域,我们一方面提供了TI平台等工具,帮助易车、阅文等企业搭建自己的大模型,显著降低了模型构建的时间和成本;另一方面,通过AI代码助手等工具,我们也辅助开发者,提升研发的效率,帮助企业提升整体研发效能。

在办公协同场景中,腾讯旗下的企业微信、腾讯会议、腾讯文档都已经接入了混元大模型。在大模型的助力下,企业微信可对英文邮件进行智能检查,辅助英文邮件纠错,腾讯会议可以自动总结会议纪要,腾讯文档能够自动生成各类文档。这些功能把个体从繁琐的工作中解放出来,也显著提升了团队协同的效率。

在风险管控领域,风控大模型可以解决传统风控中建模时间长、效率低的难题。通过打包丰富的反欺诈知识,实现“小样本”训练,快速构建契合业务需求的风控模型体系。比如,东风日产汽车金融,基于少量提示样本迁移,就完成了适配自身业务场景的风控模型定制。相比于传统的建模方式,模型KS性能提升超过20%,在跨场景的泛化性测试上性能提升53%。

今天我们也很荣幸请来了很多客户来分享他们的落地实践。未来,我们也希望与更多客户携手,推动大模型落地到场景中,真正为企业创造价值!谢谢大家!

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 腾讯云安全发布人工智能风险评估框架,助企业构建可信智能体

    9月17日,腾讯云在2025全球数字生态大会上发布人工智能风险控制框架及多款安全产品。该框架涵盖六大风险模块、七层级、130余项措施,系统性应对AI应用全生命周期的安全挑战,包括数据泄露、供应链隐患及权限滥用等核心问题。同时推出LLM-WAF防火墙、AI-SPM态势管理等产品,构建覆盖研发、部署、运维的全链路防护体系,助力企业建立可信、稳定的AI服务生态。

  • 英特尔举办工业AI与具身智能生态大会,加速智造升级

    在2025年中国国际工业博览会上,英特尔携手生态伙伴以“工业+AI”为核心,展示了具身智能、人形机器人、工业AI与大模型等前沿解决方案。发布了基于酷睿Ultra平台的工厂落地案例,实现“大小脑融合”从概念到真实工业场景的跨越。通过全栈式边缘AI技术体系,为智慧工厂等行业智能化转型提供支撑。英特尔将持续推动开放平台与工业场景结合,加速智能制造发展。

  • 考拉悠然开源悠然无界大模型BLM-1.0,以空间智能引擎驱动产业变革

    9月28日,在成都举行的“2025天府人工智能产业生态大会”上,考拉悠然宣布其自主研发的“悠然无界大模型BLM-1.0”完成迭代升级并全面开源,同时发布基于该模型的UU Holo Glass O1 AR工业眼镜。此举标志着公司以“技术开源+场景落地”双轮驱动策略,推动空间智能产业生态共建。BLM-1.0突破传统模型局限,具备跨空间、跨任务、跨本体的“三跨”统一能力,在空间理解、推理与执行三大核心能力上刷新行业纪录。配套AR眼镜深度融合空间感知与多模态交互,实现工业运维、安装巡检等场景的全程自动化与智能辅助,显著提升效率并降低成本。

  • 传奇IP续作:融合创新技术 数字娱乐产业迎来新发展机遇

    娱美德公司旗下中国工作室研发的《传奇M:暮光双龙》即将内测。这款中韩合作游戏采用虚幻4引擎,实现4K画质与智能战斗系统,支持PC与移动端互通。文章指出,技术创新正推动游戏产业突破成本、质量、效率的"不可能三角",2024年中国游戏市场收入达3257.83亿元。中韩游戏产业通过优势互补,持续深化技术合作与文化交流,共同推动数字娱乐产业高质量发展。

  • 腾讯云:扎根产业,出海破圈

    与产业共生共长,一直是腾讯云的愿景。 2025年9月16日,腾讯全球数字生态大会在深圳如期举行,其间腾讯云展现了多项新产品的进展和能力升级,并全面开放AI能力。 这意味着,腾讯云的产数融合又进了一步。 当下,腾讯云正在与千行百业深度融合,助力企业拥抱“智能化”与“全球化”,进而推动产业可持续高质量增长。 毋庸置疑,腾讯云“智向远大”。

  • 模型即服务,应用即未来:阿里云助力中小企业AI应用规模化落地

    阿里云针对中小企业AI落地“不会用、用不起、用不好”痛点,提出全链路解决方案。数据显示,77%全球中小企业已定期使用AI工具,中国市场需求增长强劲。阿里云通过通义大模型技术迭代、AIStack一体化底座及4R服务框架,降低使用门槛与成本。典型案例如万小智AI员工实现“分钟级交付”,博登智能提升数据处理效率7倍。方案覆盖制造、医疗等12大行业,助力企业从“有算力”到“能落地”,推动AI应用成为行业常态。

  • “人工智能+”时代,企业做对什么才能抢占先机?

    国务院8月26日发布《关于深入实施“人工智能+”行动的意见》,提出加快AI技术与实体经济深度融合,推动产业智能化升级。到2035年,我国将全面步入智能经济和社会新阶段。金蝶集团作为企业数字化服务商,以“AI优先”为战略,将AI技术深度融入SaaS产品与服务,推出金蝶云·星空EMA平台及多款智能产品,覆盖财务、供应链、差旅等场景,助力企业构建“AI+业务”新能力,实现高效管理与创新发展。

  • 构建消费租赁可信可控新生态,联想云锁服务方案发布,助推租赁行业智能化革命

    联想与人人租达成长期合作,推出“云锁服务方案”,旨在解决设备租赁行业的管理粗放、逾期丢失、回收效率低等痛点。该方案通过设备锁定、远程控制与租赁管理三大核心能力,覆盖设备从投放到回收的全生命周期,实现智能化、数字化管理。合作将围绕设备供给、质量控制、回收翻新、服务保障四大维度展开,共建行业标准,推动租赁服务从“设备管理”向“智能服务”升级,助力行业迈向高质量发展新时代。

  • 腾讯云李力:坚持同源同构,为企业打造更贴近Agent的AI原生云

    9月17日,腾讯云在2025全球数字生态大会上宣布智算全面升级,推出“更贴近Agent的AI+Infra”解决方案,包括Agent+Runtime、云专家服务智能体Cloud Mate及全链路安全能力。腾讯云副总裁李力强调,“同源同构”是核心原则,确保产品服务一致性与全球化布局。方案旨在提升模型推理效率、工具集成灵活性和系统稳定性,助力AI从实验室走向生产级应用。腾讯云通过硬件多元支持、软件加速优化及智能运维服务,降低企业技术门槛,已服务国内90%大模型厂商及千行百业。

  • AI智能锁首标发布,萤石引领行业新变革

    2025中国国际五金展上,萤石网络联合多家企业发布《AI智能锁》团体标准,这是行业首个团队标准。萤石作为核心制定者,凭借其安全技术、全域自研能力及产品创新,获“AI智能锁引航者”认证。旗舰产品Y5000FVX Ultra搭载双摄、雷达系统,实现精准识别与主动安防,并通过OTA升级持续优化。萤石蓝海大模型2.0赋能智能锁,提供消息服务、视频搜索等智慧入户功能,推动行业从工具向“入户管家”升级。市场数据显示,萤石在高端细分领域销量领先,彰显技术优势与市场认可。

今日大家都在搜的词: