首页 > 传媒 > 关键词  > 人工智能最新资讯  > 正文

万卡万P万亿参数通用算力!摩尔线程夸娥智算中心解决方案重磅升级

2024-07-04 09:40 · 稿源: 站长之家用户

7月3日,上海——摩尔线程重磅宣布其AI旗舰产品夸娥(KUAE)智算集群解决方案实现重大升级,从当前的千卡级别大幅扩展至万卡规模。摩尔线程夸娥(KUAE)万卡智算集群,以全功能GPU为底座,旨在打造国内领先的、能够承载万卡规模、具备万P级浮点运算能力的国产通用加速计算平台,专为万亿参数级别的复杂大模型训练而设计。这一里程碑式的进展,树立了国产GPU技术的新标杆,有助于实现国产智算集群计算能力的全新跨越,将为我国人工智能领域技术与应用创新、科研攻坚和产业升级提供坚实可靠的关键基础设施。

此外,摩尔线程联合中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后)分别就三个万卡集群项目进行了战略签约,多方聚力共同构建好用的国产GPU集群。

摩尔线程创始人兼CEO张建中表示:“当前,我们正处在生成式人工智能的黄金时代,技术交织催动智能涌现,GPU成为加速新技术浪潮来临的创新引擎。摩尔线程矢志投身于这一历史性的创造进程,致力于向全球提供加速计算的基础设施和一站式解决方案,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。夸娥万卡智算集群作为摩尔线程全栈AI战略的一块重要拼图,可为各行各业数智化转型提供澎湃算力,不仅有力彰显了摩尔线程在技术创新和工程实践上的实力,更将成为推动AI产业发展的新起点。”

AI主战场,万卡通用算力是标配

大模型自问世以来,关于其未来的走向和发展趋势亟待时间验证,但从当前来看,几种演进趋势值得关注,使得其对算力的核心需求也愈发明晰。

首先,Scaling Law将持续奏效。Scaling Law自2020年提出以来,已揭示了大模型发展背后的“暴力美学”,即通过算力、算法、数据的深度融合与经验积累,实现模型性能的飞跃,这也成为业界公认的将持续影响未来大模型的发展趋势。Scaling Law将持续奏效,需要单点规模够大并且通用的算力才能快速跟上技术演进。

其次,Transformer架构不能实现大一统,和其他架构会持续演进并共存,形成多元化的技术生态。生成式AI的进化并非仅依赖于规模的简单膨胀,技术架构的革新同样至关重要。Transformer架构虽然是当前主流,但新兴架构如Mamba、RWKV和RetNet等不断刷新计算效率,加快创新速度。随着技术迭代与演进,Transformer架构并不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,技术的进步都展现了对更高性能计算资源的渴望。

与此同时,AI、3D和HPC跨技术与跨领域融合不断加速,推动着空间智能、物理AI和AI4Science、世界模型等领域的边界拓展,使得大模型的训练和应用环境更加复杂多元,市场对于能够支持AI+3D、AI+物理仿真、AI+科学计算等多元计算融合发展的通用加速计算平台的需求日益迫切。

多元趋势下,AI模型训练的主战场,万卡已是标配。随着计算量不断攀升,大模型训练亟需超 级工厂,即一个“大且通用”的加速计算平台,以缩短训练时间,实现模型能力的快速迭代。当前,国际科技巨头都在通过积极部署千卡乃至超万卡规模的计算集群,以确保大模型产品的竞争力。随着模型参数量从千亿迈向万亿,模型能力更加泛化,大模型对底层算力的诉求进一步升级,万卡甚至超万卡集群成为这一轮大模型竞赛的入场券。

然而,构建万卡集群并非一万张GPU卡的简单堆叠,而是一项高度复杂的超 级系统工程。它涉及到超大规模的组网互联、有效率的集群计算、长期稳定性和高可用性等诸多技术难题。这是难而正确的事情,摩尔线程希望能够建设一个规模超万卡、场景够通用、生态兼容好的加速计算平台,并优先解决大模型训练的难题。

夸娥:国产万卡万P万亿大模型训练平台

夸娥(KUAE)是摩尔线程智算中心全栈解决方案,是以全功能GPU为底座,软硬一体化、完整的系统级算力解决方案,包括以夸娥计算集群为核心的基础设施、夸娥集群管理平台(KUAE Platform)以及夸娥大模型服务平台(KUAE ModelStudio),旨在以一体化交付的方式解决大规模GPU算力的建设和运营管理问题。

基于对AI算力需求的深刻洞察和前瞻性布局,摩尔线程夸娥智算集群可实现从千卡至万卡集群的无缝扩展,旨在满足大模型时代对于算力“规模够大+计算通用+生态兼容”的核心需求,通过整合超大规模的GPU万卡集群、极 致的计算效率优化以及高度稳定的运行环境,以万卡智算集群的新超 级工程,重新定义国产集群计算能力的新标准。

夸娥万卡智算解决方案具备多个核心特性:

超大算力,万卡万P:在集群计算性能方面,全新一代夸娥智算集群实现单集群规模超万卡,浮点运算能力达到10Exa-Flops,大幅提升单集群计算性能,能够为万亿参数级别大模型训练提供坚实算力基础。同时,在GPU显存和传输带宽方面,夸娥万卡集群达到PB级的超大显存总容量、每秒PB级的超高速卡间互联总带宽和每秒PB级超高速节点互联总带宽,实现算力、显存和带宽的系统性协同优化,全面提升集群计算性能。

超高稳定,月级长稳训练:稳定性是衡量超万卡集群性能的关键。在集群稳定性方面,摩尔线程夸娥万卡集群平均无故障运行时间超过15天,最长可实现大模型稳定训练30天以上,周均训练有效率在99%以上,远超行业平均水平。这得益于摩尔线程自主研发的一系列可预测、可诊断的多级可靠机制,包括:软硬件故障的自动定位与诊断预测实现分钟级的故障定位,Checkpoint多级存储机制实现内存秒级存储和训练任务分钟级恢复以及高容错有效能的万卡集群管理平台实现秒级纳管分配与作业调度。

极 致优化,超高MFU:MFU是评估大模型训练效率的通用指标,可以直接反应端到端的集群训练效率。夸娥万卡集群在系统软件、框架、算法等层面一系列优化,实现大模型的有效率训练,MFU最 高可达到60%。其中,在系统软件层面,基于极 致的计算和通讯效率优化等技术手段,大幅提升集群的执行效率和性能表现。在框架和算法层面,夸娥万卡集群支持多种自适应混合并行策略与有效显存优化等,可以根据应用负载选择并自动配置最 优的并行策略,大幅提升训练效率和显存利用。同时,针对超长序列大模型,夸娥万卡集群通过CP并行、RingAttention等优化技术,有效缩减计算时间和显存占用,大幅提升集群训练效率。

全能通用,生态友好:夸娥万卡集群是一个通用加速计算平台,计算能力为通用场景设计,可加速LLM、MoE、多模态、Mamba等不同架构、不同模态的大模型。同时,基于有效易用的MUSA编程语言、完整兼容CUDA能力和自动化迁移工具Musify,加速新模型“Day0”级迁移,实现生态适配“Instant On”,助力客户业务快速上线。 

万众一芯,共建大模型应用生态

万卡集群的建设需要产业界的齐心协力,为实现大模型创新应用的快速落地,让国产算力“为用而建”。发布会现场,摩尔线程携手中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后),分别就青海零碳产业园万卡集群项目、青海高原夸娥万卡集群项目、广西东盟万卡集群项目进行了战略签约。

借助摩尔线程先进的夸娥全栈智算解决方案,各方将携手共建强大的全国产智算平台,以加速产业数字化转型和高质量发展。夸娥万卡智算集群项目标志着国产AI算力基础设施的又一重大进展,将为各地的数字经济发展注入新活力。

图注:摩尔线程与中国移动通信集团青海有限公司战略签约

图注:摩尔线程与中国联通青海公司、北京德道信科集团战略签约

图注:摩尔线程与中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司战略签约

发布会后,无问芯穹、清程极智、360、京东云、智平方等五家合作伙伴代表纷纷登台,分享了摩尔线程夸娥智算集群如何助力其在大模型训练、大模型推理、具身智能等不同场景和领域的创新,展现了夸娥智算集群在实际应用中的巨大潜力与广泛适用性。

摩尔线程愿与广大行业伙伴并肩同行,发挥全栈AI的力量,加速推动一个由万卡智算集群为强大底座,多领域伙伴共建、广泛赋能数字经济的国产智算生态,共同开启一个属于大模型与生成式人工智能的新时代,为美好世界加速。在WAIC期间,摩尔线程将在上海世博展览馆(H2馆D616)开展“全栈AI 为美好世界加速”的主题成果展示,包括加速卡、服务器、超融合一体机和AIGC应用在内的摩尔线程全栈AI产品悉数亮相,并携手众多行业合作伙伴联合展示基于夸娥智算集群的丰富行业大模型与应用方案。

关于摩尔线程

摩尔线程成立于2020年10月,以全功能GPU为核心,致力于向全球提供加速计算的基础设施和一站式解决方案,为各行各业的数智化转型提供强大的AI计算支持。

我们的目标是成为具备国际竞争力的GPU领军企业,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。我们的愿景是为美好世界加速。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 京东云升级JoyScale AI算力平台:支持超10万卡调度

    京东云在上海发布九大AI产品,包括智能体2.0、大模型开发平台和算力平台等,助力企业重构AI基础设施。针对AI应用深化带来的技术挑战,京东云推出以GPU为核心的JoyScale算力平台,具备两大优势:极致算力性能,支持单集群万卡调度和超10万卡全局调度,大模型算力利用率提升至75%;灵活异构算力管理,适配十余种国产算力,集群利用率提升70%。基于京东复杂场景实践,京东云构建一站式大模型产品矩阵,从底层算力设施到上层应用开发,支持企业快速部署大模型及应用。未来将持续深耕技术,以开放协同的生态理念拓展大模型技术边界,助力企业重塑AI生产力。

  • ChatGPT重磅升级GPT-4.1:编程专家模型登场

    OpenAI于5月15日正式推出GPT-4.1模型,采用差异化推送策略:付费用户可体验完整版,普通用户使用轻量级GPT-4.1 mini。新版模型在编程任务表现突出,能精准遵循指令,避免冗长输出。测试显示其响应速度提升30%,输出稳定性提高40%,部分性能超越GPT-4o。同时OpenAI宣布将斥资30亿美元收购编程工具Windsurf,强化开发者生态,与Google同日发布的Gemini-GitHub形成直接竞争。两大巨头的动作标志着AI编程助手进入生态竞争新阶段。

  • 碳企通CBAM解决方案:三步破解碳关税困局

    本文介绍了应对欧盟碳关税(CBAM)的三步解决方案:1)智能诊断:通过自主研发的计算引擎精准预测2024-2026年碳关税支出,误差率<5%,并定位生产环节碳排热点;2)快速认证:建立欧盟合规认证快速通道,认证周期缩短至7个工作日,通过区块链确保数据不可篡改;3)持续优化:动态监测32国碳政策变化,建立碳成本分摊模型。案例显示某钢铁企业通过该方案降低碳强度19%,年节省碳关税82万欧元。方案优势包括欧盟双认证资质、全流程闭环服务和可控成本(申报费用比自建团队低65%)。

  • 618抢先剧透!AI数字人分身系统重磅升级:自定义装修+智能体

    该文章介绍了一个智能装修系统的五大核心功能更新:1.新增可视化自定义装修功能,无需编程即可自由设计前端页面;2.接入AI智能体系统,自动生成精准营销文案;3.新增API接口分销功能,支持批零差价盈利;4.全面接入DeepSeek技术,实现多平台高质量文案生成;5.新增VIP会员模式,严格绑定功能权限与有效期。系统通过智能化升级,显著提升了装修设计、内容创作和商业变现的效率。

  • 用户如何获取MCP服务?AIbase资源仓库全方位解决方案指南

    AI技术快速发展背景下,Model Context Protocol(MCP)作为新兴通信协议,正在改变AI与外部工具交互方式。AIbase平台敏锐洞察MCP潜力,打造专业资源仓库(https://mcp.aibase.cn/),提供海量服务器、客户端工具、插件等资源,配备智能搜索、详尽文档和活跃社区。该平台凭借技术沉淀,持续更新前沿内容,支持开发者学习交流和实践创新。MCP协议将推动AI技术更广泛应用,AIbase作为重要推手,通过丰富资源和专业支持,助力构建繁荣的MCP技术生态。

  • 快手电商升级全系列智能产品解决方案,重塑商家全域高效经营体验

    5月8日至9日,快手电商在杭州召开"破局2025·快手电商商家大会"。大会围绕全域经营新机遇和AI赋能电商全链路展开,推出多项扶持政策:1)降低开店门槛,提供0元开店、保证金下调等优惠;2)全年投入超1000亿冷启流量扶持新商家;3)升级"生意通"数据服务平台,提供智能诊断;4)推出"智能顾问"产品,提供全链路陪伴服务。数据显示,2024年新入驻商家数同比增长超40%,月GMV超10万商家增长20%。快手电商强调将持续优化经营成本、提升效率,通过AI技术赋能商家实现降本增效,打造公平透明的经营环境。

  • 佳能电影机专业直播解决方案:用专业系统赋能创作自由

    文章探讨了影像创作从追求"画质清晰"到注重"情绪表达"的转变趋势,指出佳能EOS C400电影机通过6K全画幅背照堆栈式CMOS传感器、HDR宽色域表现和智能对焦系统等技术优势,在交响乐、篮球赛、台球赛和Livehouse等复杂场景中实现了专业级影像创作。该设备不仅提供稳定画质,更通过系统协同性、快速响应和人性化设计,让创作者能专注于镜头语言和节奏把控,将技术限制转化为创作助力,最终实现"看得清"到"拍得对"的进阶,让影像成为传递情感的艺术表达。

  • 太极华青以全矩阵解决方案护航电子凭证会计数据标准推广应用

    财政部等九部门联合发文推广电子凭证会计数据标准,推动电子凭证全流程无纸化处理。太极华青作为会计软件服务商,推出覆盖电子凭证全生命周期的解决方案,包括"凭证通"电子凭证服务平台、"轻松报"智能报销平台等,助力单位实现业务财务一体化管理。试点期间436家单位累计处理电子凭证超2亿张,验证了标准的科学性和有效性。方案融合AI、RPA等技术,实现智能采集、验签、解析等功能,并与预算管理一体化系统无缝对接,提升财务管理效率。通过事前防控、事中纠偏、事后溯源的全流程监管机制,有效防范财务风险,推动会计工作数字化转型。

  • 微软将 Wins11 的“智能应用控制”夸大宣传为“顶级杀毒解决方案

    尽管微软将 SAC 宣传为一项突破性创新,其实它的核心理念与 PC 用户 20 年前在 Windows XP 时代采用的一些安全措施十分相似……

  • 腾讯与高通骁龙X系列合作:打造面向PC端的游戏安全解决方案

    腾讯游戏安全中心5月16日宣布,在2025游戏安全行业峰会上,腾讯与高通达成战略合作。双方将在骁龙X系列上深化合作,打造面向PC端的高性能游戏安全解决方案。腾讯游戏安全ACE是其自主研发的拥有20年反作弊经验的产品,覆盖游戏加固、反外挂、内容审核等全生命周期安全能力。此次合作将把腾讯20年游戏安全技术部署于高通专为AI+PC设计的骁龙X系列,为《无畏契约》等重点PC游戏提供支持。峰会由广东省游戏产业协会指导,腾讯游戏安全ACE、腾讯云等主办。