首页 > 传媒 > 关键词  > 腾讯云最新资讯  > 正文

腾讯云副总裁吴运声:大模型全矩阵产品升级 助力产业落地

2024-09-06 16:33 · 稿源: 站长之家用户

9月5日,在2024腾讯全球数字生态大会云上智能峰会上,腾讯云副总裁、腾讯云智能负责人、优图实验室负责人吴运声分享了腾讯云在智能领域的比较新进展,并探讨了大模型在产业中的应用和未来发展。

腾讯云副总裁、腾讯云智能负责人、优图实验室负责人吴运声

吴运声在演讲中指出,大模型的发展呈现出两个明显趋势:模型性能不断提升和落地场景不断丰富。他强调,面向场景创造价值才是大模型发展的意义。基于全矩阵的大模型产品,腾讯已经服务了众多客户,在知识管理、智能客服、研发提效、智能营销、内容生成、办公协同、风险管控等场景中,帮助企业实现了降本增效和业务创新。

腾讯云的大模型策略以实用性为核心,满足不同企业在大模型时代的需求。腾讯已经构建起了全链路的大模型产品矩阵,包括底层基础设施、帮助企业训练专属模型的TI平台和行业大模型解决方案,自研的混元大模型,构建应用的平台工具,以及基于大模型的各类智能应用。

吴运声介绍,腾讯比较新发布的混元Turbo版本通过自研的万亿级层间异构MoE技术,相比前代模型实现了训练效率提升108%,推理效率提升高,推理成本降低50%。同时,混元Turbo的效果在多个基准测试上对标GPT-4o,且第三方测评居国内首先。

腾讯云在今年5月还一并推出了三款PaaS产品——大模型知识引擎、图像创作引擎和视频创作引擎。经过两个月的迭代,这些产品的能力进一步升级,可以为电商、出海等领域的客服营销、企业知识社区等众多业务场景提供效率的助力和创新的支持,也进一步加快了大模型在实际场景中应用落地的速度。

在模型训练工具方面,为了帮助企业用户更便捷地打造专属模型,人工智能开发平台TI平台也进行了全新升级。在精调数据准备层面,TI平台全新支持面向多模态大模型的数据集管理和数据标注,首创了基于Schema的标注方法,支持用户自动生成个性化标注工作台,支持文生文、图生文、图文改写、图文混合问答等主流场景下的全部细分任务类型。

同时,腾讯云将2D数智人、3D数智人和声音复刻管线全面输出,支持企业私有化部署和灵活定制。管线输出意味着,客户可以将训练数据和训练模型都部署在自己的环境上,推动数智人在更多场景的普及和落地。

附:演讲全文

尊敬的各位嘉宾、媒体朋友们,

大家好!

我是腾讯的吴运声,很高兴在这里跟大家分享腾讯云在智能领域的比较新进展和思考。

大模型已经发展了两年,我们能明显看到两个趋势:一方面,模型性能在不断提升,围绕着模型的产品使用门槛也变得更低、更加易用;另一方面,企业和开发者积极探索大模型与自身业务场景的结合,大模型的落地场景不断丰富、更纵深。我们认为,面向场景创造价值才是大模型发展的意义。

腾讯的大模型策略,从最开始就以实用为目标,我们希望构建起离产业最近的AI产品矩阵。从底层的高性能计算、存储、网络等AI infra产品,到一站式的人工智能开发平台TI和行业大模型解决方案,再到自研的混元大模型,以及基于大模型的各类工具和智能应用,我们提供了全方位的产品,满足企业在大模型时代的各类需求。无论是做大模型的企业,还是想要搭建AI应用的创业者,还是想利用AI来实现降本增效的企业,都能在腾讯云上找到好用的工具。

去年的生态大会上,我们正式发布了全链路自研的腾讯混元大模型。经过不断的迭代创新,混元已经稳居国内大模型首先梯队。

今天,我们正式推出了更快更强的混元Turbo版本,通过自研的万亿级层间异构MoE结构,混元Turbo用更多的专家数、更少的激活参数量实现了更好的效果。相比前一代MoE大模型,腾讯混元Turbo的训练效率提升108%,推理效率提升1倍,推理成本降低50%,仅用一半训练语料,就实现效果提升14%,中文场景的效果对标GPT-4o。技术创新让我们可以更多地让利给客户,混元Turbo的定价仅为混元Pro版的一半。

在多模态领域,混元的多项能力也在国内保持领先。混元生图是头个中文原生的DiT架构文生图开源模型,目前在网络衍生的模型数量超过2000个。这也充分证明了开发者对于我们模型能力的认可。

近期,混元还推出了基于 MoE 架构的多模态理解大模型混元vision。我们在架构、训练方法和数据处理方面进行了创新和深度优化,显著提升了性能,能支持比较高7K 分辨率、比较大长宽比16:1的图片的理解。在近期发布的中文多模态大模型 SuperCLUE-V 基准评测中,腾讯混元斩获国内排名首先,超越了多个主流闭源模型。

在自研的混元大模型之外,为了帮助企业用户更便捷地打造专属模型,我们的人工智能开发平台TI平台也进行了全新升级。在精调数据准备层面,我们全新支持面向多模态大模型的数据集管理和数据标注,首创了基于Schema的标注方法,支持用户自动生成个性化标注工作台,支持文生文、图生文、图文改写、图文混合问答等主流场景下的全部细分任务类型。

高质量的训练数据是精调出一个可落地大模型的前提条件。TI 平台的多模态数据集管理和数据标注能力,可提升大模型精调的数据准备效率和训练数据质量,从而提升大模型训练效率和最终效果。

大模型训练之外,针对OCR和工业质检场景等垂直训练场景,我们也对产品进行了升级。OCR场景中,可以实现智能反馈出模糊、反光等场景下的误识别,水印识别平均准确率提升至95%。在工业质检场景下,我们全新支持基于Visual Prompting 的小样本分割链路,并推出缺陷感知通用模型、缺陷自动合成功能,可实现“0” 标注或“1”标注下解决质检问题。

具体到模型工具产品方面,今年5月,我们推出了三个大模型PaaS产品:知识引擎、图像创作引擎和视频创作引擎,帮助企业快速、轻松打造AI原生应用。

大模型知识引擎聚焦企业知识服务场景。通过该平台,企业用自然语言和简单配置,5分钟就可以开发出一款大语言模型应用,服务于客服营销、企业知识社区等业务场景。经过几个月的产品迭代,知识引擎产品在用户需求识别与理解、企业知识处理、检索和理解能力上,都有很大的升级。

比如,我们综合运用向量检索、摘要检索、text2sql多种技术手段,显著提升了复杂大表的检索及问答准确率。同时,我们升级了升级多模态知识解析、检索、阅读理解能力,实现读懂文中的“数据图”、“自然场景图”、“图文关系”。

同时,我们提供了更灵活的购买方式,支持组件能力的单独输出,企业可以按需购买文档解析、文档拆分、向量化等能力,按需部署到自身的应用中去。

在图像创作引擎层面,基于混元生图能力的升级,我们的图像风格化、AI写真、商品背景生成、模特换装等功能也进一步实现了迭代。在AI写真层面,我们实现了免训练技术突破,输入一张照片后可直接跳过训练环节等待,一键生成高清写真艺术照,整体出图耗时缩短75%。

针对很多电商商家高频使用的商品背景生成能力,我们大幅提高了背景画面真实度、商品分割细腻度,以及商品与背景间融合的自然度与交互合理性,实现商品在不同场景中高度逼真的虚拟效果展示。在模特换装场景下,我们采用3D先验方案,提升重建人像效果,在高度保持模特脸部、手部细节的同时,比较准确将服装版型细节与模特身体特征对齐,确保换装后的效果逼真自然。

基于混元的DiT架构模型,我们的视频创作引擎也迎来了全新的升级,新增了图片跳舞、图片唱演和视频转译等能力。

首先,我们来看下图片跳舞能力,目前,我们已经实现了单段舞蹈的生成时间从10分钟下降至1分钟级别,同时支持转身、侧身等难例舞蹈动作。人物跳舞的自然度已经有了很大的提升,这背后是我们基于3d-boby重建技术,进一步优化了算法,画面的真实度和自然度也有了明显提升。

在图片唱演层面,我们目前可以支持一张人像图片生成一段唱演视频,视频生成的人物的面部表情和情绪演绎都更加自然灵动。

同时,针对很多客户有需求的在视频转译能力,我们接入了混元文生文大模型和 TTS 技术,让转译后的视频能够保留说话人的音色特征,同时实现说话人口型与目标语种一致的视听效果。目前视频转译功能支持15+小语种,覆盖主流外语翻译,可应用于视频本地化、跨境电商等场景。

基于腾讯先进的形象驱动、自然语言理解和识别能力,我们的数智人形象自然度业界领先。目前,腾讯云智能数智人已经在业务办理、用户运营、营销获客以及品牌宣传等业务场景中落地。

今天,我们也将2D数智人、3D数智人和声音复刻管线全面输出,支持企业私有化部署和灵活定制。管线输出意味着,客户可以将训练数据和训练模型都部署在自己的环境上。我们的合作伙伴也可以基于我们的管线能力批量生成数智人,更好地推动数智人在更多场景的普及和落地。

基于我们全矩阵的大模型产品,我们已经服务了众多客户,在知识管理、智能客服、研发提效、智能营销、内容生成、办公协同、风险管控等场景中,很多客户利用我们的产品实现了降本增效和业务创新。

在智能客服与知识管理场景中,基于大模型的生成能力,可以显著提升复杂问题的解决效率,提升回答质量。比如,汽车售后服务是一个典型的专业客服场景,涉及的知识复杂,汽车说明书包括图片、表格等众多形式,传统客服机器人无法及时准确地回答问询。我们与长安汽车共创,利用大模型知识引擎整合汽车使用手册等资料,有效解决了客户在车辆使用和维护中的疑问,显著提升了客户服务体验。

在智能营销场景,大模型可以提升广告素材的生产效率,提升营销互动的趣味和互动性。比如,蒙牛在一场营销活动中,利用图生图能力,将用户上传的全家福转化生成为特制的卡通画风,助力会员拉新、提升用户活跃。活动期间小程序相对于去年同期提升80%以上。

在内容创意场景,大模型可以让内容生产的周期大幅缩短,提供更多的创意玩法。比如,人民日报、新华社等媒体结合我们的文生视频能力,创作了很多视频作品。过去,视频内容需要一帧帧进行设计和制作,制作周期短则数天,长则数月。现在借助视频生成能力,只需一段文字或者几张图片,就能在几分钟内生成优质视频内容。

在研发提效领域,我们一方面提供了TI平台等工具,帮助易车、阅文等企业搭建自己的大模型,显著降低了模型构建的时间和成本;另一方面,通过AI代码助手等工具,我们也辅助开发者,提升研发的效率,帮助企业提升整体研发效能。

在办公协同场景中,腾讯旗下的企业微信、腾讯会议、腾讯文档都已经接入了混元大模型。在大模型的助力下,企业微信可对英文邮件进行智能检查,辅助英文邮件纠错,腾讯会议可以自动总结会议纪要,腾讯文档能够自动生成各类文档。这些功能把个体从繁琐的工作中解放出来,也显著提升了团队协同的效率。

在风险管控领域,风控大模型可以解决传统风控中建模时间长、效率低的难题。通过打包丰富的反欺诈知识,实现“小样本”训练,快速构建契合业务需求的风控模型体系。比如,东风日产汽车金融,基于少量提示样本迁移,就完成了适配自身业务场景的风控模型定制。相比于传统的建模方式,模型KS性能提升超过20%,在跨场景的泛化性测试上性能提升53%。

今天我们也很荣幸请来了很多客户来分享他们的落地实践。未来,我们也希望与更多客户携手,推动大模型落地到场景中,真正为企业创造价值!谢谢大家!

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 快鹭科技四大应用,筑牢企业数字化基建

    快闪科技以AI办公智能体为核心,推出覆盖人力、采购、行政、财务四大场景的数字化解决方案。人力方面构建一站式管理平台,实现招聘到薪酬的全流程自动化;采购环节打造智能供应链,优化供应商管理;行政应用实现资源整合与流程标准化;财务系统通过OCR识别等技术实现自动化核算与风险管控。四大应用紧密协同,基于AI+低代码技术打通企业底层数据,助力降本增效、优化决策,推动企业从操作型向战略型数字化转型,实现高质量发展。

  • 聚焦制造业智能化转型 中国科学技术大学依托昇腾突破知识增强大模型关键技术

    中国科学技术大学宋骞团队基于昇腾平台开发了工业知识图谱构建框架和大模型增强推理技术。该研究通过融合领域小模型与大语言模型,构建了"初始识别-知识抽取-知识引导反思"三阶段框架,显著提升了知识抽取准确性。在智能运维系统应用中,团队采用ETL架构处理多模态数据,结合RDF语义网技术构建知识图谱,并研发故障智能预测诊断模块。同时创新性地提出知识增强与过滤框架,利用PLM嵌入空间降低计算负担,有效提升知识增强的灵活性。研究成果显著提升了工业设备智能运维水平,实现了核心技术的自主创新适配,为构建安全高效的现代工业体系提供关键技术支撑。

  • 百度第一!百度智能云一见领跑视觉大模型赛道

    IDC最新报告显示,百度智能云凭借"文心一言4.5"多模态大模型和"文心X1"深度思考模型,在视觉大模型领域综合实力排名第一。其智能云平台在算法模型、工程化落地、行业覆盖等方面优势显著,已服务餐饮、钢铁、电力等20多个行业,帮助数百家企业实现生产全环节的数字化管理。典型案例包括:为风电集团构建安全管控系统,巡检效率提升6-10倍;与中钢研合作金相分析模型,检测准确率达95%;助力连锁餐饮实现全国1000+门店服务质量量化管理,订单覆盖率从5%提升至95%。通过"云端大模型+边缘小模型"的协同架构,在保障精度的同时大幅降低应用成本,推动专业级视觉AI应用普及。

  • 政策东风叠加企业让利 智能门锁市场从“高端尝鲜”到“大众刚需”转型

    2025年上半年中国智能门锁市场迎来普惠民新拐点,全渠道销量达897万套,同比增长6.8%。政策补贴和技术创新推动市场均价降至887元,C端市场占比提升至57.6%。王力安防等企业通过智能制造体系降低成本,推出1699元高性价比产品组合,并创新研发超C级圆柱体锁芯、三防分立技术等安全方案。生物识别技术加速下沉,人脸识别已渗透至中端市场,掌静脉识别正从中高端向主流市�

  • 行业首个AI数字云仓项目获中物联科技进步一等奖,释放了什么信号?

    物流行业面临传统仓储效率低下、库存滞销率高等结构性矛盾。中国物流与采购联合会召开科技大会,聚焦数智供应链和AI+物流,其中日日顺的AI数字云仓项目获一等奖。该项目以AI算法为核心,打通全链路数据,实现库存资源共享与智能调度,有效解决库存积压和配送滞后问题。政策层面持续支持物流数智化转型,企业应用案例显示成本降低、效率提升。未来行业竞争将聚焦技术创新与全链路协同能力,物流正从"资源驱动"向"科技驱动"深度变革。

  • 深信服托管云助力化工企业上云转型

    2024年全国粮食总产量突破1.4万亿斤,高标准农田建设是丰收关键。某化工集团作为智慧农业重要参与者,通过数字化转型构建"本地超融合+线上公有云"混合云架构,但面临业务扩张带来的运维压力大、成本失控等问题。该集团采用就近延伸的混合云方案:线下基于原有超融合集群,线上采用专属托管私有云模式,通过物理专线实现高速互联。方案成效显著,业务系统稳定运行1年以上,资源利用率提升30%,运维成本降低20%。该方案既满足本地业务低延迟需求,又通过专业团队运维保障了业务连续性,为农业数字化转型提供了可借鉴的实践路径。

  • “AI+云”双引擎! 华为云828即将来袭,开启企业智能升级新纪元

    华为云在828B2B企业节推出多项AI解决方案,助力中小企业数字化转型。其MaaS平台让企业快速调用AI模型,Flexus云服务提供高性价比算力,覆盖从技术到商业落地的全链路需求。活动期间推出万元礼包、抽奖免单等优惠,降低企业上云门槛。华为云通过"模型即服务"理念,将AI原生嵌入业务场景,同时提供安全可靠的云基础设施,帮助各行业企业实现智能化升级,加速"上云用数赋智"进程。

  • Agentic AI落地加速:迈富时企业级智能体中台2.0,让 AI Agent成为企业 “数字员工”

    Gartner将代理型AI列为2025年十大战略趋势之首,预测到2028年15%的日常工作决策将由自主智能代理完成。迈富时发布的AI-Agentforce2.0企业级智能体中台,通过"技术赋能+场景落地"双轮驱动,构建了从模型能力到业务价值的闭环。该平台具有三大核心优势:1)"模型-应用-开发平台"三位一体架构;2)ChatBox+工作流双开发模式,支持快速部署;3)企业级安全保障,满足金融等敏感行业需求。已在保险、零售、供应链等领域实现规模化应用,最高提升37%销售转化率。该方案让企业能低成本打造专属数字员工团队,真正释放代理型AI的战略价值。

  • 卓世联合致远互联共建企业级超级智能体 构建人智协同新范式

    8月9日,由致远互联主办的“2025协同管理论坛”在武汉光谷盛大举行。卓世科技创始人兼CEO屠静女士受邀发表主题演讲,并与致远互联携手共建全新企业级超级智能体平台。从多模态智能体集群的底层能力首秀,到“一句话搞定差旅、报表、会议总结、供应链计划”等沉浸式应用场景体验,从与致远互联产品体系的深度预集成,到联合百家伙伴共建协同AI生态,卓世科技将与千

  • 工业软件“大脑”植入国产操作系统:制造业数字化转型的麒麟方案

    全球工业软件巨头达索系统与国产操作系统银河麒麟完成深度技术适配,达索核心平台3DEXPERIENCE(3DX)在银河麒麟系统上实现稳定运行。这标志着国产操作系统在高端工业软件生态建设取得重大突破,为中国制造业数字化转型提供新动能。3DX平台作为覆盖产品全生命周期的工业软件,其与国产系统的兼容性验证通过,意味着中国企业可摆脱对国外操作系统的依赖,无缝运行国际主流工业软件。此次合作既验证了银河麒麟系统在高端工业场景的可靠性,也为国产基础软件与国际顶尖工业软件的融合树立标杆,将助力构建安全创新的数字化环境。

今日大家都在搜的词: