又一大算力AI芯片发布!比B200快3倍,刚融资24亿元

源自今日头条:芯东西

02-27 12:06

SambaNova推出其第五代AI芯片SN50,凭借创新的RDU架构,宣称在速度和吞吐量上远超同类产品,并能支撑高达10万亿参数的超大模型。英特尔对其进行战略投资并达成多年合作,双方将共同打造下一代AI数据中心解决方案,为AI推理市场带来新变局。

又一大算力AI芯片发布!比B200快3倍,刚融资24亿元智能速览

  • SambaNova发布第五代AI芯片SN50,算力达前代5倍。

  • SN50智能体推理吞吐量超英伟达B200三倍以上。

  • 芯片采用三层内存架构,实现毫秒级模型切换。

  • 英特尔战略投资超24亿元,与SambaNova达成深度合作。

  • 双方将整合技术,释放数十亿美元的推理市场机遇。

  • SN50预计于2026年下半年发货,软银成为日本首位客户。

又一大算力AI芯片发布!比B200快3倍,刚融资24亿元精华内容

面对日益复杂的AI智能体和超大模型需求,SambaNova推出的SN50芯片试图从架构层面突破GPU在推理环节的性能瓶颈。

算力性能飞跃

SambaNova最新发布的SN50芯片在性能上实现了显著提升。相较于第四代产品,其单芯片算力提高了5倍,网络带宽也增至4倍。与英伟达Blackwell B200 GPU相比,SN50的最大速度是其5倍,在处理Meta的Llama 3.3 70B等模型时,智能体推理的吞吐量提升超过3倍。通过多芯互连,SN50可支持单模型参数规模达10万亿、上下文长度1000万token的超大模型,为未来AI应用提供了强大的硬件基础。

架构底层创新

SN50的核心优势在于其可重构数据流单元(RDU)架构和三层内存设计。传统GPU在推理时需多次冗余调用片外内存,导致高延迟和高功耗,模型切换时间以秒计。SN50的RDU将计算图映射到最优数据路径,消除了冗余内存调用。其独特的片上SRAM、HBM和超高速SRAM三层内存架构,使芯片能承载更大模型,并将模型切换时间从秒级缩短至毫秒级,大幅提升了响应速度和能效。

联手英特尔

英特尔对SambaNova进行了超过3.5亿美元(约合24亿元人民币)的E轮战略投资,并宣布达成多年战略合作。双方计划在三个关键领域展开合作:扩展基于英特尔至强处理器的SambaNova AI云平台;将SambaNova系统与英特尔CPU、GPU和网络技术深度集成;通过英特尔全球渠道进行联合市场推广。此合作增强了英特尔在AI推理领域的实力,消息公布后,英特尔股价应声上涨超5%。

未来市场布局

SambaNova SN50预计将于2026年下半年开始发货,并已获得软银集团作为其在日本下一代AI数据中心的首家部署客户。其SambaRack SN50组合功耗平均仅需20kW,可在现有风冷数据中心运行,总拥有成本优势明显。通过与英特尔的合作,SambaNova能借助其全球影响力扩大规模,而英特尔也借此完善了AI产品线,为日益多元化的AI推理市场提供了一个有力的竞争选择。

SambaNova SN50的发布,是AI推理硬件领域一次有力的挑战。它通过架构创新直击GPU痛点,与英特尔的强强联合更预示着市场格局的潜在变化。当万亿参数模型成为常态,这样的技术组合能否真正打破现有壁垒,为AI应用的普及带来更高性价比的算力支持,值得持续关注。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章