首页 > 传媒 > 关键词  > 超级计算机最新资讯  > 正文

生物计算领域,为什么超算安腾比通用计算机算得还要快?

2024-04-09 17:00 · 稿源: 站长之家用户

一直以来,超 级计算机因其无可匹敌的运算实力而在科研界享有“巨擘”之称,大众耳熟能详的莫过于那些荣登全球超算Top500推荐榜的翘楚品牌,如Frontier和神威·太湖之光等,它们展现出了卓越的通用高性能计算能力。然而,在生物计算这一细分领域中,即便是这些巨头也会显得有些“力不从心”,难以全面应对诸如大规模分子动力学模拟、蛋白质三维结构预测等相当挑战性的任务。这时,就不得不提在生物计算领域占据显著地位的专用超 级计算机安腾(Anton)了。

安腾超 级计算机   图片来源:D.E. Shaw Research

安腾超 级计算机是由美国D. E. Shaw研究所于2007年首 次发布,专门用于对生命科学研究和生物制药研发领域至关重要的算法——分子动力学模拟算法的加速。在计算分子动力学模拟(Molecular Dynamics, 简称MD)问题时,超算安腾的计算效率比全球最 强的超算Frontier还要高上数十倍。

为什么安腾超 级计算机能比美国Frontier算得还要快?

秘诀就在于安腾超 级计算机的“专项定制”属性。安腾超 级计算机由大量的特定应用集成电路(ASIC)组成,通过一个专门的高速三维环形网络相互连接 。不同于通用超算的一刀切设计,超算安腾的架构专为细粒度事件驱动而设计运算,通过增加计算与通信的重叠来提高性能。

由于安腾超 级计算机主要专注于分子动力学模拟加速,即其所应对的主要任务属于通讯密集型的并行计算范畴。在此背景下,超算安腾在芯片设计、通信网络这两个方面进行了特殊设计,从而有效提升此类任务的计算效率。

512个深度定制ASIC芯片 提供强大算力支持

首先,在硬件层面,由于CPU、GPU等通用的算力芯片无法满足特定问题对算力性能的要求,因此,专用超 级计算机常常选择搭载ASIC芯片(即专用集成电路),以针对性地提供解决特定问题所需的强大算力支持。

安腾超 级计算机的核心优势就在于其使用的512个MD专用ASIC芯片。这些芯片经过深度定制,具有针对性强的指令集架构(ISA),能够比较准确执行分子动力学模拟(MD)中最耗时和最频繁的计算任务,如分子间的长程和短程相互作用力的计算,为这些关键计算步骤提供硬件算法层面的性能优化,例如快速傅里叶变换(FFT)等算法。

图片来源:D.E. Shaw Research

同时,为了减少计算延迟,安腾超 级计算机还设计高度专业化的专用硬件数据路径和控制逻辑,用于评估范围受限的相互作用,并执行电荷扩散与力插值。除了在芯片上密集整合高度定制化的计算逻辑之外,这些流水线还针对每个操作都采用了定制化精度。

“量体裁衣”般的并行计算硬件设计  只为提升计算性能

GPU、通用超算等通用的计算架构更多关注的是访存密集型任务的优化,而超算安腾则是针对通讯密集型的并行计算问题进行了特化优化。因此超算安腾在处理高度依赖大量通讯密集型并行计算的分子动力学计算任务时,自然就会比传统的通用超 级计算机架构多出许多天然的优势。

具体来说,超算安腾上运算的分子动力学算法的主要应用领域之一是对蛋白质进行的仿真模拟。这类仿真模拟任务需要计算机记录当前每个原子的位置、运动状态等,之后利用分子动力学模拟计算这些粒子之间相互影响的运算结果。在这样的情况下,每个节点需要承担的运算并不复杂,所以并不需要每个计算单元具有极其高强的计算能力;也不需要大规模数据的输入输出存,所以也不是访存密集型任务。因此在设计上,安腾超 级计算机取消了其它并行计算硬件中十分常见的缓存,也就是不需要很大的存储空间。

例如,对于一个包含25,000个粒子的MD模拟,其整体架构状态只需要1.6兆字节,放到一个由512个节点构成的系统中,每个节点仅占用3.2千字节。鉴于此特性,超算安腾选择在ASIC上仅仅配备SRAM和小型L1缓存,并确保在常规操作条件下,所有的代码和数据都能够妥帖地装载在芯片之上,没有把宝贵的硅片面积用于构建大型缓存或是复杂的内存层级结构,而是将这些资源重点投入到通信和计算性能的提升上。

此外,分子动力学模拟中,最为消耗计算资源的是分子间的长程相互作用力的计算,如静电相互作用等。据统计,在通用处理器上运行的标准MD模拟中,计算静电和范德华力所耗费的时间占到了总体计算时间的约90%。由于这些力的计算都是基于成熟的物理原理和公式得出的,不太可能随力场模型进化而发生巨大改变,基本因此非常适合硬件加速。但是,要想实现MD模拟的显著提速,光是加速这些“核心循环”还不够,还需要对其他相关的计算任务进行同步加速。依据阿姆达尔定律,即使把前述占用90%计算时间的任务的计算效率大幅优化,如果其余10%的计算任务还是维持现状的话,整个系统的最 大加速比也只能达到10倍左右的上限。因此,超算安腾特意划拨了相当一部分硅片面积用于加速那些诸如键力计算、约束条件计算、速度和位置更新等其他关键任务。

服务器摆放与网络结构的特殊设计 有效提升通讯效率

在通信层面,由于分子动力学模拟是一种需要大规模并行化的计算密集型方法,因此快速并行分子动力学模拟的实现就需要节点间通信的高带宽和低延迟。为提高通讯效率,安腾超 级计算机也做了一些特别的设计。

例如,整个超算安腾的服务器都被紧密地摆放在一个正方体的机箱中,这样的好处在于节点之间依靠网络互联,紧密排列使得网络的传输距离大大降低,可靠性和速度大大提升,所以速度有了很大的提升。

又比如,超算安腾设计了独特的内存子系统,专门用于积累每个粒子所受的力,这样可以减少计算过程中必要的数据交换。为了进一步提高计算效率,安腾超 级计算机采用了低延迟、高带宽的网络结构,不仅在单个ASIC芯片内部实现了快速通信,还在不同ASIC芯片之间也建立起了有效的互联网络。这个网络特别支持常见的MD通信模式,比如多播和稀疏数据结构的压缩传输,同时也支持协调式的“推送”式通信方式,即生产者主动将结果发送给消费者,无需消费者预先请求数据。此外,系统中还配备了一系列独立的直接内存访问(DMA)引擎,用于卸载计算单元的通信任务,使得通信和计算过程能更紧密地重叠执行,从而最 大程度减少等待时间。

ASIC芯片通过高速通道直接连接,形成三维环形拓扑结构

图片来源:D.E. Shaw Research

通过以上分析可见,安腾超 级计算机通过一系列精密的硬件和软件协同设计,聚焦于加速分子动力学模拟的关键环节,使得其在处理大规模生物分子系统长达百微秒级别的经典分子动力学模拟时表现出比较罕见的有效性。

安腾超 级计算机的技术路线无疑为我国超算领域、尤其是专用超算领域的技术研发提供了路线借鉴参考。在生物制药、生命科学、新能源新材料等前沿科技火热发展的重点垂直领域,我们应当加强全栈式的软硬件协同创新,挖掘在特定计算难题上的重大产业和创新机会,不断提升在全球超算竞赛中的竞争力与影响力。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 抖音公开算法原理 通过神经网络计算预估用户行为

    站长之家(ChinaZ.com)4月16日 消息:抖音集团在抖音安全与信任中心开放日活动上,首次向公众全面公开了其算法原理、机制及治理政策。此次开放日活动旨在邀请广大网友深入了解抖音的推荐算法,体验抖音安全与信任中心的功能,并广泛征集社会各界的意见和建议,共同构建一个更加美好、安全、可信任的社区环境。抖音的推荐算法作为人工智能机器学习技术的重要应用场�

  • Neousys宸曜发布支持酷睿200S的强固型无风扇嵌入式计算平台

    Neousys宸曜科技发布全新无风扇嵌入式计算平台Nuvo-11000系列,搭载英特尔酷睿Ultra 200S处理器(代号Arrow Lake),采用3nm制程工艺并集成AI NPU,CPU性能提升1.2倍,AI算力达36 TOPS。该系列支持DDR5-6400内存和PCIe Gen5,配备M.2 Gen5 x4插槽,读写速度超11,000MB/s,最高支持96GB非ECC内存。延续品牌坚固特性,支持-25°C至70°C宽温运行和8-48V宽压输入,提供6个2.5G/千兆网口(支持PoE+)、8个USB 3.2 Gen2接口及3个4K显示输出。通过宸曜卡式扩展盒和MezIO接口,可灵活扩展PCIe x16 Gen4插槽及各类工业I/O接口。系列包含多款机型,满足不同行业对尺寸、GPU算力和性能的需求,兼容前代产品尺寸,便于升级。

  • 英伟达将首次在美制造 AI 超算、及 Blackwell 芯片

    站长之家(ChinaZ.com) 4月15日 消息:随着 AI 行业的蓬勃发展,英伟达位于美国的人工智能芯片和超 级计算机工厂将创造数千个就业机会。科技巨头英伟达(NVIDIA)宣布,其 AI 超 级计算机将完全在美国本土生产。在全球贸易战的背景下,英伟达这一举动是为了减少对海外市场的依赖,并促进美国国内的生产。英伟达确认,他们已开始在台积电位于美国亚利桑那州凤凰城的工厂生产�

  • 黄仁勋5000亿豪赌:AI超算首次Made in USA

    英伟达宣布了一项开创性计划,在美国制造AI超级计算机,通过与台积电、富士康等巨头合作,打造价值5000亿美元的AI基础设施。英伟达周一抛出重磅消息,宣布将首次在美国制造AI超级计算机。未来四年内,英伟达将通过与台积电、富士康、纬创资通、安靠(Amkor)和矽品(SPIL)的合作,在美国打造出价值5000亿美元的AI基础设施。目前,位于亚利桑那州凤凰城的台积电工厂已经�

  • 通用户该如何使用MCP协议?MCP协议怎么用?

    AIbase是一个全面且专业的AI工具导航平台,致力于帮助用户在众多的人工智能产品和服务中找到最适合自己需求的选项。该平台收录了超过7000个人工智能网站和产品,覆盖了40多个不同的领域,如AI绘画生成、AI文案写作、AI视频编辑、AI智能营销等。AIbase是一个全面且强大的平台,为开发者提供了丰富的MCP技术资源和支持,是探索MCP技术的不二之选。

  • 科学家发现太阳系外可能存在生命:相关物质仅能通过生物代谢产生

    近日,天文学领域传来一项引人瞩目的研究成果:一支科研团队借助詹姆斯韦布空间望远镜搭载的尖端仪器,对一颗距离地球124光年的系外行星展开深度观测。这颗编号为K2-18b的行星位于狮子座方向,其质量约为地球的8.6倍,体积相当于地球的2.6倍。研究团队通过精密光谱分析,在其大气层中捕捉到二甲基硫醚(DMS)与二甲基二硫醚(DMDS)的独特化学信号——这两种含硫化合物在�

  • 互联网打工人亲身讲述:三诺生物如何助我糖尿病逆转

    作为一名互联网加班狗,我的生活总是被忙碌的工作填满。加班到深夜、外卖解决三餐成了常态,奶茶和甜品更是我缓解压力的“良药”。在糖尿病逆转这条路上,早点科学干预,真的能改变人生。

  • Check Point Quantum防火墙软件R82版荣获通用准则EAL4+认证

    Check Point公司宣布其Quantum防火墙软件R82版本获得通用准则(Common Criteria)EAL4+级别认证。该认证由德国联邦信息安全办公室(BSI)颁发,评估范围涵盖安全网关、安全管理及Maestro超大规模网络编排器等组件。EAL4+是商业技术产品中广泛认可的高保障级别,证明该平台符合严格国际标准,能为关键基础设施和政府机构提供可信安全保障。此次认证进一步巩固了Check Point作为全球网络安全解决方案提供商的领先地位,其产品已在30多个国家部署。公司表示将持续为监管行业客户提供可验证的安全保障。

  • 罗永浩质疑厂商为何不能物理关闭麦克风 李小龙:试试华为超级隐私模式

    罗永浩发微博质疑厂商为何不做物理关闭麦克风,他表示,大家都在抱怨被各种App偷听和推送广告,但没有厂商做物理关闭麦克风,是因为跟软件行业的利益捆绑太深吗?华为李小龙作出回应,建议罗永浩试试华为手机的超级隐私模式。此前上市的OPPOFindN3典藏版也加入了类似的功能,该机搭载一颗国密二级安全认证的独立安全芯片专门针对商务场景推出了VIP模式”,用户一键就能关闭摄像头、麦克风、定位等敏感权限,在谈要事的时候,一键关闭这些权限能够有效避免被窃听的风险。

  • 超级玩伴亮相2025消博会,受邀高规格闭门会议

    海口, 2025 年 4 月13日 —— 作为全球瞩目的消费领域顶级盛会之一, 2025 年第五届中国国际消费品博览会(以下简称“消博会”)在海南盛大举行,吸引了来自全球 70 多个国家和地区,超四千家品牌及企业参展,展现消费科技的未来蓝图。在本届消博会中,AI家庭情感陪伴领域的代表性企业——超级玩伴,以“科技×情感”的独特视角,首次亮相并展示其AI情感互动科技解决方