首页 > 传媒 > 关键词  > 正文

UALink联盟Kurtis:开放Scale-Up互连加速构建可部署AI超节点

2026-07-06 16:48 · 稿源: 站长之家用户

近日,2026ODCC夏季全会在江西景德镇成功举办。大会汇聚行业权威专家、企业代表等,聚焦打通智算、通算上下游生态,凝聚标准共建、技术落地,共探算力网络发展新路径。在6月26日下午的全体会议上,UALink联盟主席、AMD架构和策略总监Kurtis Bowman发表了题为"UALink for Open AI Scale-Up: From Open Fabric to Deployable AI Supernodes"的主题演讲,系统阐述了UALink作为开放加速器互连标准的核心价值、2026年4月一系列规范的重大升级,以及UALink在中国生态的落地实践经验。

(Kurtis全会分享现场)

AI基础设施瓶颈正在转移

Kurtis在演讲开始就指出,AI基础设施的瓶颈已从算力本身转向加速器之间如何快速、可靠、开放地交换内存驻留数据。集合通信正在主导训练和推理的同步操作,内存带宽已成为新的"时钟频率",运维必须跨越多租户和多厂商环境进行扩展。

在此背景下,Scale-Up与Scale-Out的分工日趋清晰:以太网负责集群层面的数据中心互连,而UALink提供xPU加速器之间基于内存语义的专用Scale-Up Fabric,两者形成互补。UALink的核心定位是一个开放的、以内存为中心的加速器Scale-Up Fabric,支持AI加速器之间直接的基于内存语义的Load/Store和原子操作,单个超节点可支持1024个加速器,serdes支持106.25G/212.5G速率,面向全行业多厂商开放。

Kurtis强调,UALink坚持开放路线,打破封闭生态。AI基础设施不应受限于单一封闭的xPU加速器、交换机、PHY层或封装层方案,任何厂商的CPU、加速器、交换机都可以通过开放规范自由接入。

2026规范族:从互连标准到可落地系统

2026年4月上旬,UALink联盟一次性发布四项新规范,标志着UALink协议跃升为完整的实施生态。

Common2.0规范新增了In-Network Compute(在网计算),支持ReadReduce、WriteMulticast、Broadcast、Reduce、AllReduce等集合通信原语和块级集合操作。现代AI工作负载高度依赖通信——同步、归约、广播、Token路由和多Rank协调以高频重复发生,将集合通信工作从端点下沉到网络交换层,可显著降低训练和推理中的同步开销和带宽压力,让加速器拥有更多可用计算周期。

200G DL/PL2.0规范将数据链路与物理层从Common规范中独立拆分,使物理层能够更快演进。新增的链路弹性(Link Resiliency)机制使多通道链路在部分通道故障时仍能持续运行;链路折叠(Link Folding)机制则在无需全带宽时将空闲SerDes置于低功耗状态,让可靠性和功耗管理成为互连的基础能力。

Manageability1.0规范定义了Pod级控制平面模型,包括Pod Controller、节点管理代理和交换机管理代理,通过gNMI+YANG、Redfish、UALink-SAI等标准接口实现配置、运维、观测和恢复。Virtual Pod机制使一个物理Fabric能够承载多个隔离的工作负载,单Pod最大可管理1024个加速器和1024个物理交换机。

Chiplet1.01规范定义了UALink Chiplet如何通过UCIe3.0标准与加速器芯片Die连接,同时保留UALink的Station、Port和Lane语义。单UALink Station带宽可达800G/1000G,UCIe Flit效率达93%,为加速器SoC、交换机和封装团队提供了更快的集成路径。

中国生态:从规范走向验证再走向落地

ODCC已成为连接UALink规范与中国实施实践的重要桥梁。2025年3月,ODCC和UALink联盟签署合作备忘录,联手推动UALink生态在国内的落地计划;2026年3月,ODCC在其春季全会上正式发布了UALink测试验证服务,覆盖互连IP、链路协议、事务交互和数据传输验证。

Kurtis在此次全会的演讲中也再次指出,无论是中国的产业界,还是学术界的研究均指向相同的Scale-Up互连需求,包括AI训练/推理业务对超高带宽、低延迟和高可用网络的严苛要求,对集合通信中的拥塞控制,减少网络拥塞导致的GPU利用率损失的需求等等。而UALink与这些核心需求高度契合——开放Scale-Up、在网集合通信、可管理Pod和Chiplet集成。ODCC的测试验证服务标志着UALink在中国正从规范走向验证。

而同期举办的UALink技术分论坛也印证了国内UALink技术生态的蓬勃生机。 本次分论坛汇聚了AMD、Intel、阿里云、Qualcomm、光速摩方、楠菲微、芯动科技和合见工软等产业链核心专家,围绕UALink协议规范、加速器芯片集成、交换芯片进展、IP与EDA工具链等议题展开深度分享,完整呈现了UALink生态在国内从标准制定到产业落地的全产业链的进展。

(UALink分论坛现场)

开放AI超节点的落地路径

围绕开放AI超节点的落地,产业界可以遵循四阶段路径:第一步,基于Common2.0+ DL/PL2.0+ Manageability + Chiplet进行设计;第二步,集成交换机、AI加速器、Retimer、Chiplet和控制器等芯片与IP;第三步,通过ODCC合规测试、Plugfest和IP级测试验证互操作性;第四步,部署可管理、可观测、多租户的虚拟Pod。

自2024年10月成立以来,UALink联盟成员企业总数已突破115家,涵盖超大规模云厂商、半导体制造商、系统集成商、IP供应商及研究机构。在SC25大会上,Synopsys已成功演示UALink200G IP在2米以上无源铜缆上的稳定运行。IP供应商已开始交付IP和VIP,Switch厂商正在推进芯片开发,加速器厂商也将推出支持UALink的xPU产品。

总结

在ODCC全会演讲的最后,Kurtis再次强调了UALink生态当前的五大核心要点:UALink是面向AI加速器的开放Scale-Up Fabric;2.0规范新增网内集合计算提升通信效率;200G DL/PL2.0改善了可演进性、弹性和功耗管理;Manageability1.0将Fabric转化为可运维的Pod;Chiplet1.01支持基于UCIe的未来加速器SoC集成。作为开放的Scale-Up互连技术生态,UALink的核心战略价值在于开放互连的超节点、互通的组件,以及更广泛的AI基础设施创新底座。同时,这也是UALink联盟对整个AI算力生态的愿景。在通向智算未来Scale-Up之路上,中国地区领先的UALink规范实践经验,对构建开放协作、标准共建的全球AI基础设施生态具有非常重要的指导意义。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • AI不只在云端,也在家门口:A.O.史密斯全国首个AI-LiNK民生服务站开放

    南京南化新村社区揭牌全国首个政企共建的A.O.史密斯“AI-LiNK智慧家居民生服务站”,解决居民对智慧家居“不会用、老房难改、维修难”等痛点。服务站融合智能体验、便民服务与科普课堂,居民不出小区即可学习操作、咨询安全、获取维保。站内提供居家安全检测、适老化智能教学及老房轻量化改造一站式服务,并举办邻里活动。旨在让AI技术贴近生活,为千家万户提供专业贴心的家居服务。

  • 从UMX到Scale-Up光互连 阿里云勾勒Agentic AI基础设施新趋势

    2026开放计算大会在京举行,阿里云聚焦Agentic AI时代算力基础设施变革。大会指出四大趋势:算力向CPU与GPU深度协同演进;长上下文推理引爆“存储墙”,阿里云发布磐久UMX统一内存架构以消除瓶颈;Scale-Up互联走向光互连与开放标准,阿里云推出业界首款即将量产的SNPO光互连模块;AI能力下沉至硬件固件,实现自然语言智能运维。阿里云正通过全栈自研,打造面向Agentic AI的深度协同基础设施。

  • 百度智能云完成64B世界模型512卡训练验证 支撑大模型高效Scale

    百度百舸基于通用GPU集群,在无NVLink/HPN条件下完成512卡Cosmos3-Super 64B模型训练,实现97.48%近乎线性扩展效率。验证大模型训练效率不仅靠硬件,更依赖框架、网络与基础设施的系统协同,AI Infra工程优化成为释放算力、支撑世界模型训练的关键路径。

  • AI视频创作选哪个剪辑工具省钱省Token?优选一站式平台updream

    AI视频创作常因多工具切换、素材反复生成导致高成本低效。核心理清:碎片化工具增加时间和算力双重消耗。源头解法是选一体化的AI创作平台,如updream。它借可视化工作流、成熟模板复用、内置编辑与消耗可溯源,大幅减少无效Token浪费,且独有热门IP素材,兼顾省钱与专业出品。

  • 内娱第一人 戚薇开放形象AI授权:开启明星AI商业化新范式

    8月6日,戚薇通过社交平台官宣推出个人官方数字分身,正式开放自身形象的规范化AI授权,其主演的AI漫剧也将上线。这一举动让她成为内娱首个公开开放AI形象授权的艺人。 戚薇的数字分身可被用于AI漫剧、虚拟代言、数字互动等场景。她在官宣中表示,希望通过数字分身探索新的内容形态,也为行业提供一种可参考的AI形象授权模式。律师解读指出,肖像权属于人格权范畴

  • 9万人“内测”三年,美团把自家AI工作台开放给了商家

    下午两点,一家餐饮店老板的手机震了好几次。 信息涉及到的内容异常复杂,从新增差评到分店订单下滑的提示,还有等待拍板的新店营销方案。过去,解决上述任何一个问题都需要花费他许多精力。自这个午后,一切将变得惬意,他给“门店经营小助手”发了一句话,几分钟后拿到评价管理、用户分析、营销分析三份报告,内容里逐条标注是否异常。 7月27日,美团CatPaw升�

  • AI视频创作工作流用哪个工具搭建?updream解锁持续高质量出片

    AI视频创作长期受碎片化流程和重复调试困扰,经验无法固化,新项目往往需从零开始。updream平台通过Skill画布实现工作流永久保存与可视化搭建,结合Skill社区一键复用成熟链路,并辅以多Agent协同、内置剪辑、Seedance等模型支持,打通从创作到输出的闭环。创作者可沉淀专属模板,专注创意,大幅提升效率与稳定性。

  • 【技术揭秘】突破互连带宽瓶颈:悍铭万卡集群背后的系统工程挑战

    悍铭集团首次披露万卡GPU集群技术细节。核心挑战在于网络通信,采用Fat-Tree拓扑与自适应路由,带宽利用率超95%;并行策略融合数据、流水线及张量并行,配合梯度累积与异步检查点,解决“木桶效应”并实现故障热迁移。散热采用液冷与风冷结合,供电确保72小时持续。软件生态预置优化,实现“开箱即用”的训练环境。

  • 百度百舸AI Infra再升级,率先支持RLinf v0.3

    开源框架RLinf v0.3发布,首次打通从仿真训练到真机迭代的完整闭环。百度智能云成为国内首家适配云厂商,开发者可在其百舸平台一键部署环境,无需繁琐配置。该版本扩展支持多种主流模型与训练范式,加速具身智能产业化。百度百舸已服务超30家头部企业,将通过优化基础设施持续推动前沿技术创新落地。

  • 小熊电器以“红色引擎”跑出AI小家电新赛道加速度

    小熊电器获评“百个非公企业党建基层观察点”。企业通过思想引领、机制创新、先锋示范、组织聚链四维融合,破解党建与经营“两张皮”,将党建写入章程、推行交叉任职,打造线上学习矩阵和党员科技攻坚队,以党建串联上下游与院校,实现产业链共赢。这套“红色引擎”驱动企业创新与品牌建设,2025年海外营收同比增42.37%,成为非公党建赋能高质量发展的区域样板。

今日大家都在搜的词: