资讯

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

2022-03-23 00:50:25 41点赞 38收藏 32评论

今晚 NVIDIA 如期举行了 GTC 2022 大会,CEO黄仁勋先端上来的是代号为“Hopper”核心的 H100、GH100 和 DCX H100三款加速卡/加速系统。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

这三款针对了不同场景的平台和领域,定位最低的是H100,也就是单芯,GH100是针对高性能HPC计算、高端AI人工智能平台,而DGX H100是专门针对高端AI计算的平台,内有8路H100,拥有更强大的性能,不过它也不是最强大的,往下看。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

H100的规格和之前传闻的有所不同,采用的是台积电4nm,而不是5nm,而且是深度定制工艺,采用CoWoS 2.5D晶圆级封装,内集成多达800亿个晶体管,号称世界上最先进的芯片。

核心没有透露,此前传闻说完整版有8组GPC(图形处理器集群)、72组TPC(纹理处理器集群)、144组SM(流式多处理器单元),而每组SM有128个FP32 CUDA核心,总计1843个。另外,Tensor张量核心来到第四代,共有576个,另有60MB二级缓存。

显存方面,包括六颗HBM3或者HBM2e,单路512-bit位宽,总计位宽高达6144-bit,这是传统GDRR6X不能比的,所以HBM这种超级带宽显存仍大有用途,希望未来能重新回归部署在游戏显卡中。

该卡支持PCIe 5.0、第四代NVLink,带宽提升至900GB/s,七倍于PCIe 5.0,相比A100也多了一半。

性能方面,FP64/FP32 60TFlops(每秒60万亿次),FP16 2000TFlops(每秒2000万亿次),TF32 1000TFlops(每秒1000万亿次),都三倍于A100,FP8 4000TFlops(每秒4000万亿次),六倍于A100。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

H100计算卡有SXM、PCIe 5.0两种形态,其中后者功耗高达700W,远高于A100的300W。哦对了,AMD刚刚发布的M210也是300W。

H100拥有132组SM计算单元,总计高达16896个CUDA核心、528个Tensor核心、50MB二级缓存。显存方面,配有5颗最新一代的HBM3,总容量80GB,位宽5120-bit,总带宽高达3TB/s,比A100多了一半。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

DGX H100系统集成八路H100芯片、搭配两颗PCIe 5.0 CPU处理器(Intel Sapphire Rapids四代可扩展至强?),拥有总计6400亿个晶体管、640GB HBM3显存、24TB/s显存带宽。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

性能方面,AI算力32PFlops(每秒3.2亿亿次),浮点算力FP64 480TFlops(每秒480万亿次),FP16 1.6PFlops(每秒1.6千万亿次),FP8 3.2PFlops(每秒3.2千亿次),分别是上代DGX A100的3倍、3倍、6倍,而且新增支持网络内计算,性能3.6TFlops。

同时它还配备Connect TX-7网络互连芯片,台积电7nm工艺,800亿个晶体管,400G GPU Direct吞吐量,400G加密加速,4.05亿/秒信息率。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

其实DGX H100是最小的计算单元,为了扩展,这一次NVIDIA还设计了全新的VNLink Swtich互连系统,可以连接最多32个节点,也就是能扩展256颗H100芯片,整套系统称之为“DGX POD”。

显存方面,这套系统的总显存高达20.5TB HBM3,总带宽768TB/s,AI性能高达颠覆性的1EFlops(100亿亿亿次每秒),实现百亿亿次计算。

NVIDIA 发布 H100、GH100和DCX H100 加速卡/系统

最后,还有“H100 CNX”,除了集成H100 GPU核心外、还有 CX-7 SmartNIC网络芯片。通过让GPU直连网络,消除系统带宽,该卡支持PCIe 5.0,最高支持7个多GPU实例并发。

H100 CNXH100 CNX

NVIDIA将从3季度开始向OEM供货,包括Atos、思科、戴尔、富士通、技嘉、新华三、慧与、浪潮、联想、宁畅、超威等将采用H100、GH100和DGX100推出新系统。

扩展阅读

NVIDIA 发布 Grace 系列处理器,还有双芯版,性能无对手,专为加速系统平台除了全新“Hopper”架构H100核心的加速卡和加速系统,NVIDIA还带来了加速平台专用CPU——Grace。NVIDIAGrace拥有多达144个核心,支持最高内存带宽可达1TB/s,功耗500W,官方表示性能上没有对手。NVIDIAGrace家族还有一个版本,叫GraceCPUSuperch玩家直呼内行| 1 评论0 收藏0查看详情
展开 收起
32评论

  • 精彩
  • 最新
  • 不务正业,赶紧开发矿卡啊。

    校验提示文案

    提交
  • 好像和臭打游戏的关系不大

    校验提示文案

    提交
  • 回楼上 搞深度学习用的

    校验提示文案

    提交
    楼上魔怔了 [高兴]

    校验提示文案

    提交
    收起所有回复
  • 这个能挖矿么

    校验提示文案

    提交
  • 这个挖矿更厉害吗

    校验提示文案

    提交
  • ***比如适用人群?适用什么行业?有什么好处?

    校验提示文案

    提交
    适用于“未来”

    校验提示文案

    提交
    数据中心系列,AI和HPC用途。

    校验提示文案

    提交
    还有1条回复
    收起所有回复
  • 往虚拟现实,深度学习,元宇宙方向走,nv基本上快没对手了,omniverse平台垄断更是基本无悬念

    校验提示文案

    提交
    确实,有一种窒息感。

    校验提示文案

    提交
    基本就是甩开所有玩家了,你要想进来就得买我设备,用我软件生态!我赚的就是设备和软件的钱,你用我的产品开发就是快!

    校验提示文案

    提交
    还有1条回复
    收起所有回复
  • nv最强芯片

    校验提示文案

    提交
  • switch之最强芯片 [邪恶] [邪恶] [邪恶] [邪恶] [邪恶]

    校验提示文案

    提交
  • 看评论果然不是我一个一脸懵逼,把显卡回归正常价格才是正事

    校验提示文案

    提交
  • 显卡这种不挣钱的买卖留给intel和中国人搞吧,nv搞宇宙开发计划去了,他们的算力还差一步就可以和外星人交流了

    校验提示文案

    提交
  • 看这百亿亿运算,有点秒天秒地秒空气的节奏,是不是跟苹果学的

    校验提示文案

    提交
  • 这卡玩扫雷,能不能上3帧?在线等,挺急的。

    校验提示文案

    提交
  • 当年终结者天网都没这么高算力

    校验提示文案

    提交
  • 装两个在特斯拉上面,睡觉是不是放心点。。

    校验提示文案

    提交
    你觉得特斯拉能提供这么高得功耗么

    校验提示文案

    提交
    一个700w啊,两个1400w,一个小时才1.4度电,对特斯拉不是毛毛雨。。。

    校验提示文案

    提交
    收起所有回复
  • n卡网速快 [观察]

    校验提示文案

    提交
  • 直接快进⏩,算力多少?

    校验提示文案

    提交
  • 少废话,算力多少?

    校验提示文案

    提交
  • 咸鱼上的特斯拉英伟达散热器就是这玩意的吧

    校验提示文案

    提交
    那是p106m相当于1060 3g

    校验提示文案

    提交
    收起所有回复
  • 单位的A100还没采购完H100就出了 [皱眉] 到时候要是申请下来就是V100 A100 H100三代同用了 [邪恶]

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
最新文章 热门文章
38
扫一下,分享更方便,购买更轻松