SambaNova推出其第五代AI芯片SN50,凭借创新的RDU架构,宣称在速度和吞吐量上远超同类产品,并能支撑高达10万亿参数的超大模型。英特尔对其进行战略投资并达成多年合作,双方将共同打造下一代AI数据中心解决方案,为AI推理市场带来新变局。
智能速览
SambaNova发布第五代AI芯片SN50,算力达前代5倍。
SN50智能体推理吞吐量超英伟达B200三倍以上。
芯片采用三层内存架构,实现毫秒级模型切换。
英特尔战略投资超24亿元,与SambaNova达成深度合作。
双方将整合技术,释放数十亿美元的推理市场机遇。
SN50预计于2026年下半年发货,软银成为日本首位客户。
精华内容
面对日益复杂的AI智能体和超大模型需求,SambaNova推出的SN50芯片试图从架构层面突破GPU在推理环节的性能瓶颈。
算力性能飞跃
SambaNova最新发布的SN50芯片在性能上实现了显著提升。相较于第四代产品,其单芯片算力提高了5倍,网络带宽也增至4倍。与英伟达Blackwell B200 GPU相比,SN50的最大速度是其5倍,在处理Meta的Llama 3.3 70B等模型时,智能体推理的吞吐量提升超过3倍。通过多芯互连,SN50可支持单模型参数规模达10万亿、上下文长度1000万token的超大模型,为未来AI应用提供了强大的硬件基础。
架构底层创新
SN50的核心优势在于其可重构数据流单元(RDU)架构和三层内存设计。传统GPU在推理时需多次冗余调用片外内存,导致高延迟和高功耗,模型切换时间以秒计。SN50的RDU将计算图映射到最优数据路径,消除了冗余内存调用。其独特的片上SRAM、HBM和超高速SRAM三层内存架构,使芯片能承载更大模型,并将模型切换时间从秒级缩短至毫秒级,大幅提升了响应速度和能效。
联手英特尔
英特尔对SambaNova进行了超过3.5亿美元(约合24亿元人民币)的E轮战略投资,并宣布达成多年战略合作。双方计划在三个关键领域展开合作:扩展基于英特尔至强处理器的SambaNova AI云平台;将SambaNova系统与英特尔CPU、GPU和网络技术深度集成;通过英特尔全球渠道进行联合市场推广。此合作增强了英特尔在AI推理领域的实力,消息公布后,英特尔股价应声上涨超5%。
未来市场布局
SambaNova SN50预计将于2026年下半年开始发货,并已获得软银集团作为其在日本下一代AI数据中心的首家部署客户。其SambaRack SN50组合功耗平均仅需20kW,可在现有风冷数据中心运行,总拥有成本优势明显。通过与英特尔的合作,SambaNova能借助其全球影响力扩大规模,而英特尔也借此完善了AI产品线,为日益多元化的AI推理市场提供了一个有力的竞争选择。
SambaNova SN50的发布,是AI推理硬件领域一次有力的挑战。它通过架构创新直击GPU痛点,与英特尔的强强联合更预示着市场格局的潜在变化。当万亿参数模型成为常态,这样的技术组合能否真正打破现有壁垒,为AI应用的普及带来更高性价比的算力支持,值得持续关注。