张大妈

英特尔锐炫B60:用低成本大显存重塑AI推理方案

源自公众号:云体验师

01-14 17:33

本地部署生成式AI模型,显存容量是关键瓶颈。主流游戏卡显存有限,而专业显卡价格高昂,导致用户被迫转向二手市场。英特尔锐炫Pro B60专业显卡的出现,以24G显存和极具竞争力的价格,为个人与企业用户提供了兼顾成本与性能的本地推理新选择。

英特尔锐炫B60:用低成本大显存重塑AI推理方案智能速览

  • 本地AI推理的核心瓶颈在于显存容量,而非算力。

  • 锐炫Pro B60提供24G显存,售价约5000元,成为市场“价格屠夫”。

  • 单机8卡方案成本约4万元,提供192G总显存,远低于英伟达同级方案。

  • 双芯设计单卡占用1个x16插槽,实现了高密度部署。

  • 实测多卡并行效率高,4卡性能在100并发时接近单卡4倍。

  • 仅需约2万元(4卡)即可完成以往需20万元以上显卡处理的120B大模型推理。

英特尔锐炫B60:用低成本大显存重塑AI推理方案精华内容

这张被称作“显存价格屠夫”的显卡,究竟是如何通过创新架构和极致性价比,来解决本地AI推理的显存焦虑的呢?其背后的技术方案与真实性能表现,揭示了AI基础设施平民化的新路径。

显存焦虑与破局者

本地部署AI模型时,显存容量直接决定了能运行的模型规模与“智力”水平。面对游戏卡普遍8G显存的窘境,追求16G、24G甚至更大显存意味着成本成倍增长,许多用户不得不冒险选择二手旧旗舰显卡。英特尔锐炫Pro B60正是瞄准这一痛点,作为一款专业显卡,它以24G大显存和5000元级的售价切入市场,为数据主权、隐私合规以及成本敏感的企业与个人开发者,提供了一个极具吸引力的本地推理硬件基础。

成本与架构优势

性价比是锐炫Pro B60最锋利的武器。一套单机8卡方案(8个B60核心)总成本约为4万元人民币,即可获得192GB的宝贵显存。相比之下,使用8张RTX 5090(32G)实现同等显存需要16万余元,而8张RTX PRO 4000(24G)也需花费约10万元。其实现高密度部署的关键在于架构设计。B60采用PCIe x8配置,合作厂商推出的双芯版将两颗B60核心集成于一块PCB,单卡占用一个PCIe x16插槽,使得一台普通工作站仅用4个插槽即可容纳8颗核心,大幅降低了部署门槛。

实测性能与表现

性能测试显示,锐炫Pro B60的多卡扩展能力非常出色。在推理Llama-3.1-8B模型时,当并发数达到100,4卡方案的输出性能达到1595 Token/s,是单卡方案的近4倍,证明了其高效的并行效率。更具颠覆性的是,仅需4张B60(成本约2万元),就能成功推理120B参数的gpt-oss-120B模型,并在60-70并发时达到1000 Token/s的峰值性能。这项任务以往需要售价超20万元的H100或6万多元的RTX PRO 6000才能完成。在与售价相近的英伟达RTX PRO 2000对比中,2张B60的性能甚至超越了4张RTX PRO 2000。

核心规格解析

性能的支撑源于其第二代Battlemage(Xe2)架构。锐炫Pro B60拥有20个Xe-core计算单元,并配备了160个专为AI推理设计的XMX AI引擎,总AI算力达到197 TOPS。XMX引擎是关键,它在每个时钟周期可完成大量FP16或INT8运算,运行INT8推理效率比传统乘加运算方式最高可提升16倍。这种专用加速能力,确保了显卡在处理AI负载时既快又高效,是其能够以较低成本实现不俗推理表现的根本原因。

英特尔锐炫Pro B60并非追求极限算力的旗舰,但它凭借大显存、优秀的多卡扩展性和极具冲击力的价格,精准切入本地AI推理市场。它为中小企业和专业用户提供了一个务实、高性价比的解决方案,有效降低了构建本地AI能力的门槛。当推理成为AI应用的主流,这种让更多人能以更低成本参与创新的硬件,其价值将愈发凸显。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章