英伟达GTC大会发布的AI芯片及相关技术
英伟达GTC大会主要介绍了英伟达在AI芯片领域的最新进展,包括Blackwell和Rubin芯片的性能参数、推理效率提升、AI工厂概念以及人形机器人技术的发展。以下是这次大会的核心内容:

添加图片注释,不超过 140 字(可选)
英伟达GTC大会发布新一代AI芯片:
BlackwellUltra芯片:代号为“Ultra”,即GB300AI芯片,接棒去年的“全球最强AI芯片”B200,实现性能突破。参数包括1.1ExaFLOPS FP4推理性能,0.36ExaFLOPS FP8训练性能,1.5倍于GB200NVL72的性能提升,配备20TB HBM3内存和40TB快速内存。
DGXStation和DGXSpark:DGXStation配备784GB系统内存和800Gbps网络,支持20petaflops的AI性能;DGXSpark命名为ProjectDIGITS,搭载GB10GraceBlackwell超级芯片,每秒提供高达1000万亿次AI计算操作。
下一代AI芯片Rubin:
性能参数:Rubin的性能将达到Hopper的900倍,相较Hopper已实现68倍的提升。VeraRubinNVL144预计2026年下半年发布,参数包括3.6ExaFLOPS FP4推理性能,1.2ExaFLOPS FP8训练性能,3.3倍于GB300NVL72的性能提升,配备13TB/s HBM4内存。
硬件配置:标准版Rubin配备HBM4内存,性能大幅提升;RubinUltra版本将于2027年下半年推出,性能参数包括15ExaFLOPS FP4推理性能,5ExaFLOPS FP8训练性能,14倍于GB300NVL72的性能提升,配备4.6PB/s HBM4e内存。
AI工厂与网络基础设施:
Dynamo操作系统:专为AI工厂打造的分布式推理服务库,提供GPU规划引擎、智能路由器、低延迟通信库和内存管理器等功能。
网络交换机:推出Spectrum-X和Quantum-X硅光网络交换机,提供高带宽和低延迟连接,支持跨站点连接数百万GPU,降低能耗和运营成本。
人形机器人与物理引擎:
IsaacGR00TN1:全球首款开源人形机器人功能模型,采用“双系统”架构,模仿人类的认知原理,通过视觉语言模型支持环境和指令推理。
Newton物理引擎:与GoogleDeepMind和DisneyResearch合作开发的开源物理引擎,搭载Newton平台的机器人能够进行声音和动作互动。
DeepSeek-R1推理速度:
全球最快推理速度:一台搭载8个BlackwellGPU的DGX系统,在运行6710亿参数的DeepSeek-R1模型时,实现每用户每秒超过250个token的速度,最高吞吐量每秒超过30000个token。
性能优化:英伟达的推理生态系统针对Blackwell架构进行了深度优化,整合TensorRT-LLM、TensorRTModelOptimizer等工具,支持PyTorch、JAX和TensorFlow等主流框架。
大会主要介绍了英伟达在AI芯片和推理技术领域的最新进展,并展示其在高性能计算、机器人技术
也可收藏 点赞及关注我们
