首页 > 业界 > 关键词  > 正文

传英伟达正在开发120GB HBM2e显存的Hopper H100 PCIe加速卡

2022-09-26 16:15 · 稿源: cnbeta

近日有消息称,英伟达正在开发一款 Hopper H100 PCIe 加速卡,特点是具有高达 120GB 的 HBM2e 显存。截至目前,该公司已经发布了两个版本的 Hopper H100 GPU,分别是 SXM5 和 PCIe 板型。虽然两款 SKU 都配备了 80GB VRAM,但前者用上了全新的 HBM3 标准、而后者仍为 HBM2e 。

最新消息是,据 s-ss.cc 爆料,英伟达可能正在开发全新的 PCIe 扩展卡版本的 Hopper H100 GPU —— 但它并未配备 80GB HBM2e VRAM、而是增加到了 120GB 。

消息称这张新卡配备了六个 HBM2e 堆栈、拥有 6144-bit 总线位宽 @ 120GB VRAM、辅以 SXM5 同款 GH100 GPU 。

总计 16896 个 CUDA 核心、带宽超 3 TB/s、单精度性能 30 TFLOPS —— 与 SXM5 版本相当。

照此规格,英伟达 Hopper GH100 GPU 拥有 144 组 SM 流处理器 / 8 个 GPC —— 每组 GPC 包含 9 个 TPC,每 TPC 由 2 组 SM 单元组成。

每组 SM 单元最多由 128 个 FP32 单元,那样满血版应该是 18432 个 CUDA 核心。

GH100 GPU 完整规格参考:

● 每颗 GPU 拥有 8 GPC、72 TPCs(9 TPC / GPC)、2 SM / TPC、144 SM 单元

● 每组 SM 单元拥有 128 个 FP32 CUDA 核心,每颗 GPU 拥有 18432 个 FP32 CUDA 核心。

● 每组 SM 单元拥有 4 个第四代张量核心,每颗 GPU 拥有完整 576 个 Tensor Cores 。

● 6 组 HBM3 或 HBM2e 显存堆栈,辅以 12 个 @ 512-bit 显存控制器。

● 配备 60 MB 二级缓存

以下是 SXM5 外形的 NVIDIA H100 GPU 规格:

● 每颗 GPU 拥有 8 GPC / 66 TPC、2 SM / TPC、132 SM 单元

● 每组 SM 单元拥有 128 个 FP32 CUDA 核心,每颗 GPU 拥有 16896 个 FP32 CUDA 核心。

● 每组 SM 单元拥有 4 个第四代张量核心,每颗 GPU 拥有 528 个 Tensor Cores 。

● 5 组 @ 80GB HBM3 显存堆栈,辅以 10 个 @ 512-bit 显存控制器。

● 配备 50MB 二级缓存

● 支持第四代 NVLink 和 PCIe 5.0

目前尚不清楚英伟达正在搞测试原型,还是酝酿推出 Hopper H100 GPU 的未来迭代。

不过该公司最近在 GTC 2022 大会上表示,Hopper GPU 现已全面投产,预计首批产品会在下月到来。

举报

  • 相关推荐
  • 大家在看
  • 英伟达2024年将向中国出售100万块H20:销售额超过120亿美元

    快科技7月7日消息,据媒体报道,行业分析师指出,即便在更为严苛的市场限制条件下,H20计算卡依然展现出强劲的销售潜力,深受客户青睐。据预测,英伟达有望在2024年向中国市场供应超过百万块H20计算卡,这一数字彰显了其市场认可度。具体而言,每块H20计算卡的定价区间稳定在1.2万至1.3万美元之间(折合人民币约为87,220元至94,489元),基于这一价格预估,其总销售额有望突破120亿美元大关,这一数字将显著超越英伟达上一个财年在中国的总收入,彰显出巨大的市场价值。值得注意的是,国内众多科技企业长期以来依赖英伟达CUDA生态系统构建

  • PCIe 7.0首次引入光学:满血带宽高达512GB/s

    PCIe6.0标准规范于2022年初正式发布,至今尚未商用落地新一代PCIe7.0已经徐徐走来,首次引入光学通信连接。PCIe6.0被认为是PCIe问世近20年以来变化最大的一次,信号调制机制改为PAM4,配套支持FEC前向纠错机制、FLIT流量控制单元编码,带宽继续翻番,x16双向可达256GB/s。向下兼容可是PCIe一直以来的优秀传统。

  • 股价一年暴涨超200%!英伟达市值超越欧洲最大股市

    日前,英伟达股价再度大涨,市值超过3.4万亿美元,一夜暴增超1000亿美元,市值超越微软,首次成为全球市值最大公司。截止周二收盘,英伟达市值已达到3.335万亿美元,高于英国股市3.18万亿美元的总市值。美国已有三家公司市值突破3万亿美元大关,分别是英伟达、微软和苹果。

  • 多地监管机构盯上英伟达:狂占92%的GPU CUDA扼杀了公平竞争

    快科技7月2日消息,因涉嫌违反公平竞争,多地监管机构盯上英伟达。据报道,法国的反垄断监管机构可能指控英伟达公司存在违反公平竞争原则的行为。据悉,法国监管机构最担忧的问题就是英伟达的CUDA芯片编程软件,它是唯一和英伟达GPU芯片百分百兼容的软件,而GPU又是现在各大科技公司想要训练模型、提升计算能力必不可少的硬件。随着程序员们逐渐习惯且依赖英伟达的CUDA软件,原本不少分析师都认为CUDA是英伟达的护城河”,但现在监管机构却认为,这在某种程度上违反了公平竞争行为。自从英伟达成为生成式AI热潮的最大受益者之后,它就引起

  • 华为Pura 70北斗卫星消息版来了:12GB 512GB售价6099元 只贵了100

    近日,华为官网备件维修价格页上线了Pura70北斗卫星消息版,主体是Pura70标准版。目前该版本已经在部分线下门店开启预售,12GB512GB售价6099元、12GB1TB售价7099元,相比普通版本只贵了100元。需要注意的是,华为Pura70标准版此前并不支持星闪技术北斗卫星消息版是否配备还需要后续揭晓。

  • 100斤减到120斤?绿瘦教你怎么打破越减越胖的魔咒

    很多人就开始减重计划,但在减重过程中,发现自己怎么越减越胖了?绿瘦今天跟大家分享,为什么在减重过程中会出现这种让人困惑乃至沮丧的现象,以及我们又该如何解决这种问题。越减越胖的原因1.过度节食许多人在减重时选择过度节食,认为吃得越少,体重就会减得越快。减重是一项需要科学方法并持之以恒的事情,绿瘦建议大家切勿盲目追求快速效果,采用科学的体重管理方式,才能真正达到瘦身目的。

  • 苹果联手OpenAI何惧!周鸿祎:华为像是苹果微软英伟达结合体

    近日,周鸿祎谈及苹果与OpenAI联手合作的事,其表示华为应做好算力芯片,打造云服务。在被问到苹果与OpenAI联手合作,华为有没有其他选择,或者能走出自己的路”时,周鸿祎表示,华为太厉害了,它等于是把苹果、英伟达、OpenAI、亚马逊、微软的路都走了一遍”。周鸿祎对于华为一直都非常认可,之前表示360会全系支持华为,同时也表示支持华为各种产品等等。

  • 英伟达市值蒸发超2000亿美元 市值缩水至约3.1万亿美元

    NVIDIA在最近的两日里,市值经历了剧烈的蒸发,总额超过2000亿美元,导致其从全球市值最高的宝座上跌落至第三位。该公司股价收跌超过3%,每股价格定格在126.57美元,连续数日的跌幅累计超过6%,市值缩水至约3.1万亿美元,落后于科技巨头苹果和微软。市场分析人士指出,这些举措预计将为NVIDIA带来近100亿美元的收入,同时也显示出公司对于未来“主权AI”市场的积极布局。

  • 英伟达AMD差点合并,老黄提了个条件,结果黄了

    在AI浪潮中赢麻了的英伟达,如今市值已达3.1万亿,远超另外两家芯片巨头AMD和英特尔。我的super-manager到现在已经在那里工作了40年。比如针对前面老哥所说的“……我们的第一个错误,AMD内部人士可能不会喜欢我这么说,就是在这里犯下的”这段:此外,在此之前对于AMD收购英伟达这事儿,圈内有一种说法是当时AMD和英伟达市值其实相差不多,一个不留神,AMD让英伟达给吞了都有可能。

  • 英伟达市值一夜大增万亿元 大涨近4.6%

    英伟达股价迎来强劲反弹,收盘时大涨近4.6%,市值一夜之间飙升了约1380亿美元,再次稳固了其作为全球市值前三甲的地位,仅次于微软和苹果。回顾英伟达近期的股价走势,不难发现其经历了从辉煌到低谷再至反弹的戏剧性变化。这些数字无疑为投资者提供了信心,也解释了为何在经历大幅下跌后,英伟达股价能够迅速反弹。

  • 免费AI在线变声器:创新AI技术,轻松改变声音。

    免费AI在线变声器是一种利用人工智能技术,允许用户上传语音或输入文本,并将其转换成不同声音的工具。它与传统变声器不同,提供更逼真和准确的效果,支持性别声音转换,适用于角色扮演、游戏、内容创作等多种场景。

  • color4bg.js:动态生成炫酷多彩的网页背景

    color4bg.js 是一个使用 WebGL 和 JavaScript 生成动态、抽象且视觉震撼的背景图像的 JavaScript 库。它允许用户自定义多达六种颜色,以生成背景图案,支持动态动画效果,并可通过种子值确保每次生成相同的图案,便于集成到网页设计中。

  • MemFree:智能搜索工具,快速获取互联网及本地数据

    MemFree是一个创新的搜索工具,它允许用户快速从互联网、书签、笔记和文档中获取准确的答案。它通过先进的算法索引和搜索技术,帮助用户节省时间,提高工作效率。

  • Inrō:Instagram自动化营销助手

    Inrō是一个AI驱动的营销自动化工具,专为Instagram设计,帮助企业通过直接消息(DM)提升用户参与度和转化率。它通过分析用户互动历史和上下文,自动组织受众并个性化消息内容。Inrō还提供了与现有信息系统的集成,以及自动化的潜在客户获取和跟踪功能。产品背景信息包括其母公司EDGAR SAS是Meta批准的供应商,符合Instagram的社区准则、隐私政策和服务条款,并且提供数据安全和加密传输。

  • Gan.AI Video Recorder:录制无限个性化视频,提高会议效率和交易成功率。

    Gan.AI Video Recorder 是一款在线视频录制工具,它允许用户快速录制屏幕和摄像头,并通过个性化功能来增强视频的吸引力和效果。产品的主要优点包括无限视频录制、个性化字幕和缩略图、动态网站背景滚动以及定制化登录页面等。这些功能使得Gan.AI Video Recorder 成为提高工作效率和交易成功率的有效工具。

  • Superjoin:自动将实时数据导入Google Sheets的AI工具。

    Superjoin是一个集成了AI技术的插件,允许用户无需编写任何代码即可将实时数据从他们喜爱的工具中导入到Google Sheets。它为RevOps团队提供了无需编码和开发人员即可操作的解决方案,支持一键连接无限数据源,自动刷新数据,并支持双向同步。

  • Prime Intellect:AI开发规模化的民主化平台

    Prime Intellect是一个致力于AI开发规模化民主化的平台,提供全球计算资源的发现、模型训练以及共同拥有智能创新的能力。它通过分布式训练跨集群,使得用户能够训练最前沿的模型,并且共同拥有由此产生的开放AI创新成果,包括语言模型和科学突破。

  • Zed:高性能、多人协作代码编辑器

    Zed是由Atom和Tree-sitter的创造者开发的高性能、多人协作代码编辑器,开源且集成了AI代码生成功能。它利用多核心CPU和GPU,实现即时启动、快速文件加载和响应键盘输入。Zed支持GitHub Copilot,并通过内置助手面板与模型进行对话式交互,以生成或重构代码。

  • AuraFlow:开源的基于流的文本到图像生成模型

    AuraFlow v0.1是一个完全开源的、基于流的文本到图像生成模型,它在GenEval上达到了最先进的结果。目前模型处于beta阶段,正在不断改进中,社区反馈至关重要。感谢两位工程师@cloneofsimo和@isidentical将此项目变为现实,以及为该项目奠定基础的研究人员。

  • 墨狐AI:短篇小说写作助手

    墨狐AI是一个专为短篇小说创作者设计的在线写作助手,它通过提供创意大纲、续写故事、生成剧情树和剧本创作等功能,帮助作者激发灵感,提高写作效率。产品背景信息显示,墨狐AI旨在解决创作者在创作过程中遇到的难题,如灵感枯竭或故事发展困难。目前,墨狐AI的定位是辅助工具,详情可访问官网查看更多介绍。

  • LLaVA-NeXT:大型多模态模型,处理多图像、视频和3D数据。

    LLaVA-NeXT是一个大型多模态模型,它通过统一的交错数据格式处理多图像、视频、3D和单图像数据,展示了在不同视觉数据模态上的联合训练能力。该模型在多图像基准测试中取得了领先的结果,并在不同场景中通过适当的数据混合提高了之前单独任务的性能或保持了性能。

  • 老鱼简历:在线制作简历,简单高效。

    老鱼简历是一个在线简历制作平台,提供多种简历模板,支持AI生成简历,帮助用户快速制作出专业且个性化的简历。用户可以根据自己的需求选择不同的模板,并通过简单的在线编辑完成简历的制作,支持下载为PDF或PNG格式,满足不同场景的求职需求。

  • Enchanted:与私有自托管语言模型对话的iOS/macOS应用

    Enchanted是一个开源的、兼容Ollama的macOS/iOS/visionOS应用,它允许用户与私有自托管的语言模型如Llama 2、Mistral、Vicuna等进行对话。它基本上是一个连接到私有模型的ChatGPT应用界面。Enchanted的目标是提供一个产品,允许在iOS生态系统(macOS、iOS、Watch、Vision Pro)的所有设备上提供无过滤、安全、私密和多模态的体验。

  • Logo Galleria:在线AI Logo制作,快速生成个性化标志。

    Logo Galleria是一个在线AI Logo制作平台,利用人工智能技术帮助用户快速生成个性化的标志设计。它通过用户输入的行业、风格等参数,提供定制化的标志设计方案,满足不同用户的设计需求。该平台的主要优点是操作简便、设计效率高,可广泛应用于品牌建设、产品包装等场景。

  • Afforai.com:AI驱动的参考文献管理助手

    Afforai是一个AI驱动的参考文献管理助手,旨在帮助研究人员管理、注释、引用论文,并以AI的可靠性进行文献综述。它提供了一个全新的研究材料存储方式,使用户能够专注于真正重要的事情。Afforai支持多种文档格式,包括DOI、URL、PDF等,并具有多种搜索模式,可以连接数百篇论文进行总结、比较和翻译。此外,Afforai还提供数据引用,使用户能够方便地核实信息来源,确保研究的可靠性。

  • Rodel Agent:集成聊天、文本转图像、文本转语音和机器翻译的桌面应用

    Rodel Agent 是一款集成了聊天、文本到图像、文本到语音以及机器翻译功能的Windows桌面应用程序。它支持当前主流的AI服务,为用户提供了卓越的桌面AI体验。该产品的主要优点包括强大的集成功能、用户友好的界面以及对主流AI服务的支持,能够显著提高用户的工作效率和创造力。

  • DictionaryByGPT4:一本由GPT4生成的英语单词书,覆盖8000+单词

    DictionaryByGPT4是一个由GPT4模型生成的英语单词学习工具,它通过分析超过8000个单词,为每个单词提供词义、例句、词根词缀、变形、文化背景、记忆技巧和小故事等全方位信息,帮助用户深入理解单词的来源、使用场景以及记忆方法。该产品特别适合需要提升英语词汇量和理解力的学习者。

  • gpt-frontend-code-gen:前端页面生成神器,提升开发效率

    gpt-frontend-code-gen 是一个基于 React 和 Vite 构建的前端项目,结合 Koa 后端服务,实现前端页面生成并预览的功能。它使用 GPT-4 模型,支持 Chakra UI 和 ShadcnUI 组件生成,允许开发者通过对话形式持续迭代和修改页面,直到达到满意的效果。

  • OpenDiLoCo:开源实现分布式低通信AI模型训练

    OpenDiLoCo是一个开源框架,用于实现和扩展DeepMind的分布式低通信(DiLoCo)方法,支持全球分布式AI模型训练。它通过提供可扩展的、去中心化的框架,使得在资源分散的地区也能高效地进行AI模型的训练,这对于推动AI技术的普及和创新具有重要意义。

  • SmartCrawl:将任何网站转化为AI驱动的API。

    SmartCrawl是一个创新的在线工具,它允许用户将任何网站转化为API,通过AI技术实现数据的自动化抓取和处理。这项技术对于需要从网站获取数据的开发者和企业来说非常重要,因为它简化了数据集成的过程,提高了效率。产品目前处于Beta测试阶段,用户可以通过加入等待名单来获取试用机会。

今日大家都在搜的词: