首页 > 业界 > 关键词  > 正文

腾讯自研混元大模型正式亮相,通过腾讯云对外开放

2023-09-07 11:15 · 稿源:站长之家

站长之家(ChinaZ.com) 9月7日 消息:国产大模型进入长跑期,从参数至上转向实用优先。

9月7日,在2023腾讯全球数字生态大会上,腾讯混元大模型正式亮相,并宣布通过腾讯云对外开放。

腾讯混元大模型是由腾讯全链路自研的通用大语言模型,拥有超千亿参数规模,预训练语料超2万亿tokens,具备强大的中文创作能力,复杂语境下的逻辑推理能力,以及可靠的任务执行能力。

图片1_爱奇艺.jpg

值得关注的是,腾讯混元大模型是“从实践中来,到实践中去”的实用级大模型。腾讯云、腾讯广告、腾讯游戏、腾讯金融科技、腾讯会议、腾讯文档、微信搜一搜、QQ浏览器等超过50个腾讯业务和产品,已经接入腾讯混元大模型测试,并取得初步效果。

据了解,混元大模型将作为腾讯云MaaS服务的底座,客户不仅可以直接通过API调用混元,也可以将混元作为基底模型,为不同产业场景构建专属应用。

腾讯集团高级执行副总裁、云与智慧产业事业群CEO汤道生表示:“以大模型生成技术为核心,人工智能正在成为下一轮数字化发展的关键动力,也为解决产业痛点带来了全新的思路。大模型需要基于产业场景,与企业数据融合,才能释放出最大的价值。”

久久为功,全链路技术自研

据腾讯集团副总裁蒋杰介绍,腾讯混元大模型从第一个token开始从零训练,掌握了从模型算法到机器学习框架,再到AI基础设施的全链路自研技术。

从2021年开始,腾讯先后推出千亿和万亿参数的NLP稀疏大模型,打破CLUE三大榜单记录,实现在中文理解能力上的新突破。

目前,业界大模型在场景中的应用依然有限,主要集中在容错率高、任务简单的休闲场景。腾讯在算法层面进行了一系列自研创新,提高了模型可靠性和成熟度。

针对大模型容易“胡言乱语”的问题,腾讯优化了预训练算法及策略,让混元大模型的幻觉相比主流开源大模型降低了30%至50%;通过强化学习的方法,让模型学会识别陷阱问题;通过位置编码优化,提高了超长文的处理效果和性能;提出思维链的新策略,让大模型能够像人一样结合实际的应用场景进行推理和决策。

此外,腾讯还自研了机器学习框架Angel,使训练速度相比业界主流框架提升1倍,推理速度比业界主流框架提升1.3倍。

图片2_爱奇艺.jpg

腾讯混元大模型 全链路自研

得益于全链路自研技术,腾讯混元大模型能够理解上下文的含义,并且有长文记忆能力,可以流畅地进行专业领域的多轮对话。除此之外,它还能进行文学创作、文本摘要、角色扮演等内容创作,做到充分理解用户意图,并高效、准确的给出有时效性的答复。

在中国信通院《大规模预训练模型技术和应用的评估方法》的标准符合性测试中,混元大模型共测评66个能力项,在“模型开发”和“模型能力”两个重要领域的综合评价均获得了当前的最高分。在主流的评测集MMLU、CEval和AGI-eval上,混元大模型均有优异的表现,特别是在中文的理科、高考题和数学等子项上表现突出。

上海财经大学校长刘元春认为:“借助于全链路自研,中国将不断积累大模型相关人才和技术,逐渐形成体系化的产业链、人才链、技术链和创新链,最终走出一条发展通用人工智能的中国路径,助力我们在数字技术的创新上取得突破性进展。”

腾讯全面拥抱大模型

蒋杰表示:“我们研发大模型的目标不是在评测上获得高分,而是将技术应用到实际场景中。腾讯将全面拥抱大模型。”

图片3_爱奇艺.jpg

在此次大会上,蒋杰展示了腾讯会议、腾讯文档、腾讯广告等多个业务,在接入腾讯混元大模型后的实际应用情况。

比如腾讯会议基于混元大模型打造了AI小助手,只需要简单的自然语言指令,就能完成会议信息提取、内容分析等复杂任务,会后还能生成智能总结纪要。据实测,在指令理解、会中问答、会议摘要、会议待办项等多个方面,混元大模型均获得较高的用户采纳率。

图片4_爱奇艺.jpg

腾讯混元大模型在腾讯会议中的应用

在文档处理方面,腾讯混元大模型支持数十种文本创作场景,在腾讯文档推出的智能助手功能中已有应用。同时,混元还能够一键生成标准格式文本,精通数百种Excel公式,支持自然语言生成函数,并基于表格内容生成图表,目前这些功能正在内测阶段,将在成熟后面向用户开放。

在广告业务场景,腾讯混元大模型支持智能化的广告素材创作,能够适应行业与地域特色,满足千人千面的需求,实现文字、图片、视频的自然融合。此外,基于混元大模型的能力,广告智能导购能够帮助商家在企业微信等场景,提升服务质量和服务效率。

图片5_爱奇艺.jpg

腾讯混元大模型在腾讯广告中的应用

据了解,今年6月,腾讯云推出了模型即服务(MaaS)解决方案,提供涵盖模型预训练、模型精调、智能应用开发等一站式的行业大模型服务。

最近,腾讯云也全面接入Llama2、Bloom等20多个主流模型,和混元一样,都支持直接部署调用。客户可以根据实际需求,基于混元、也可以基于开源模型,打造自己专属的行业大模型。

举报

  • 相关推荐
  • 腾讯最强语言模型转正!混元Hy3正式发布:更聪明、更便宜

    腾讯混元大模型Hy3正式发布,采用MoE架构,总参数2950亿,激活参数210亿。Hy3展现出超越同级乃至更大尺寸旗舰模型的性能,在多任务上取得显著进步,尤其在软件开发、办公、金融建模等生产力场景实用价值突出。其幻觉率与常识错误率大幅降低,跨脚手架泛化能力增强。腾讯云API定价输入1元/百万Tokens。

  • 腾讯混元:新模型Hy3调用激增 WorkBuddy已紧急扩容

    腾讯混元Hy3模型因WorkBuddy首发上线后用户量激增,算力资源紧张致排队率超50%,现已紧急扩容完成。Hy3采用MoE架构,总参数量295B,支持256K上下文,以较小尺寸接近大模型效果。在办公场景测试中,其任务成功率从72%提升至90%,平均耗时缩减34%,主打Agent智能体与生产力场景能力升级。

  • 腾讯WorkBuddy首发接入混元Hy3大模型:限时免费!适配办公全场景

    腾讯办公AI WorkBuddy首发接入295B参数的混合专家模型Hy3,开启两周免费试用。该模型采用快慢双思考机制,任务解决率达90%,交付周期缩短近1/3。办公场景下强化了长文档处理与多工具自主协同,代码方面重点优化前端全链路生成调试能力,成本控制友好,适合长期作为主力模型。

  • 启境GT7正式亮相,智能猎装开启新征程

    广汽与引望深度合作的启境GT7,以“入门即满配”理念树立智能猎装车新标杆。该车发售五款车型,售价20.99万-32.99万元。核心亮点在于全维安全,采用玄盾笼式车身,配备满配8安全气囊,并搭载华为ADS5系统下的CAS5.0全维防碰撞系统,实现从被动防护到主动规避的闭环。其在电池安全、车门应急解锁及云端协同预警等方面的突破性设计,为行业带来技术革新。

  • 销售易AI原生CRM赋能荆楚,共绘“五谷丰登”产业新图景丨2026腾讯云武汉峰会

    销售易推出AI原生CRM NeoAgent2.0,亮相武汉腾讯云峰会,与腾讯桌面AI WorkBuddy深度集成,实现“入口级智能+业务闭环”,用户一句话即可创建商机、跟进客户。助力湖北“光谷”“车谷”等“五谷”产业升级。米其林上线4个月实现渠道100%覆盖,拜访规划从半天缩至5分钟,累计生成超6800小时洞察数据。产品成展会焦点,正以AI赋能千行百业,推动华中数智经济加速增长。

  • 腾讯“置换”快手:留下身体,带走心脏

    ​7月2日,香港中环的基金经理们还在为可灵AI的30亿美元融资消息举杯。BAT三家互联网巨头罕见同台,腾讯领投13.63亿元,投后估值180亿美元,快手的AI故事终于有了一个体面的价格标签。 但仅仅是四天后,另一份公告悄然挂出,像一盆冰水浇在了同一个故事的封面上。腾讯通过大宗交易抛售2.73亿股快手B类股份,套现约120亿港元,持股比例从15.68%骤降至9.37%,连主要股东身份�

  • 预售价80万起!尊界V800正式亮相,重塑国产超豪华MPV礼遇新标准

    鸿蒙智行发布尊界V800/V680,V800成首款百万级国产MPV,以私享吧台重塑商务接待标准。新车强调空间、内饰与隐私,搭载专属移动会客厅,跳出配置堆砌,深入本土出行痛点,以“以茶会客”文化为核心,用原创技术与人性化服务定义超豪华MPV新标杆。

  • AI日报:豆包、千问下线AI拟人化功能;腾讯混元Hy3发布;Gemini3.5 Pro7月17日发布

    通义千问推出全新实时语音识别模型Fun-ASR-Realtime,提升性能与语言覆盖。豆包、通义千问应新规下线AI拟人化功能,引发用户不满。腾讯混元Hy3发布,强化智能体能力并以高性价比定价与开源策略推动普及。全球首例AI智能体全流程勒索攻击“JADEPUFFER”曝光。Meta调整节奏,Llama API预览版将下线,模型仍可获取,建议开发者迁移。Google Gemini 3.5 Pro定档7月17日,正面对垒DeepSeek V4。影坛版权博弈升级,Midjourney在好莱坞诉讼中要求片厂“自证清白”。JoyAI上线UGC数字人功能,打造个性化虚拟形象。

  • Kimi K3新一代国产大模型确认本月发布:比DS V4正式版规模还大

    2026上半年已经过去,下半年正式开始,在竞争激烈的大模型市场上本月还有多款重磅产品,除了DS V4正式版之外,Kimi新一代大模型K3也会发布。 Kimi公司员工Young_AGI已经在X上确认7月会发布Kimi K3,只不过他没有提及具体的时间,也没有提到K3大模型的技术细节。 Kimi目前最新的大模型的是Kimi K2.7 Code,是一款专攻AI编程的大模型,6月12日发布,15日又推出了高速版Kimi K2.7 Code。 �

  • openJiuwen亮相开放原子开源生态大会,共建开源开放AgentOS底座

    在2026开放原子开源生态大会上,openJiuwen技术论坛聚焦AI+Agent落地挑战。华为Fellow陈海波指出,智能体护城河在工程能力与协同范式,而非模型;强调多智能体正从单体走向群体协同。现场发布了开源AgentOS三层架构,其JiuwenSwarm蜂群协同新范式使复杂任务成功率突破90%、节省30%+ Token。社区已壮大致力于生产级部署,并携手金融、制造等伙伴推动生态繁荣,坚持开源共创。

今日大家都在搜的词: