长江存储AI SSD首次亮相!16GB内存也能跑120B大模型

2026-08-13 18:05:22 0点赞 0收藏 0评论

长江存储AI SSD首次亮相!16GB内存也能跑120B大模型

图片图片

ChinaJoy 2026大展上,长江存储的展台面积不大,但却非常有料,一是首次露面的AI SSD加速方案,二是多款配备长江存储SSD的品牌合作整机。

图片图片

AI SSD可以原生支持KV缓存下放、ZNS分区命名空间、CXL/GPU Direct直通,尤其是KV缓存下放应用最为典型。

大语言模型持续对话会产生海量的KV缓存,可以很快填满昂贵的内存。

AI SSD方案就可以将KV Cache的数据再次分层处理:热数据保存在内存中,冷数据、超长上下文KV缓存则调度卸载至SSD并实时完成缓存量化、压缩,等到GPU需要冷数据时,就直接从AI SSD中快速调取。

这样一来,即便没有大容量的内存/显存,也可以支撑更长上下文、更多并发对话,从而大幅降低硬件成本。

在当前内存价格高高在上的形势下,AI SSD方案无疑是个非常好的思路,不但可以在本地以可接受的速度运行几十甚至上百B参数的大模型,还不需要大容量内存或显存,尽可能控制成本。

对于内存或显存容量偏小的笔记本,它更是堪称救星。

即便未来内存便宜了,它依然是个很好的补充方案,可以节省内存用量。

图片图片图片图片图片图片

长江存储的首款AI SSD型号为PC550i

现场演示机是一台笔记本,只有16GB内存、8GB显存,这在以往是不可能本地部署、运行大模型的,但是AI SSD的出现使之成为现实。

AI SSD运行的设备、本地API服务、运行时、存储等都可以自定义,并在本地配置多种大模型、知识库,方便调用。

模型规模方面,几十B的参数量毫无压力,目前最高可以稳定运行120B级别的大模型,理论上最高甚至可以跑300B。

图片图片

运行性能自然没法和内存相提并论,但完全达到了可用的程度。

实测开启AI SSD处理会议记录,首字延迟(TTFT)可以低至0.49秒,而不开启需要长达4秒以上,速度提升超过8倍。

图片图片

加载Qwen-3-Next 80B模型,输出速度超过了12 token/s,可以说相当流畅了。

图片图片

现场摆出的合作伙伴产品来自机械革命、雷神、零刻、七彩虹等,配备的长江存储SSD包括PC42Q、PC450、PC550,此外还有更多伙伴产品正在路上。

图片图片

机械革命耀世15 Air超薄电竞本用的是长江存储PC450,一款高性能低功耗的PCIe 4.0 SSD。

它搭载了长江存储晶栈 Xtacking 4.0 架构,第五代 3D TLC 闪存,I/O接口速率3.6Gbps,实测顺序读取可超过7.1GB/s,顺序写入超过6.3GB/s。

机械革命耀世16 Ultra旗舰游戏本配备的是长江存储PC550,首款商用PCIe 5.0 SSD。

它同样是晶栈4.0架构、第五代3D TLC闪存,四通道接口,满载功耗低于6W,标称顺序读写速度最高10.5GB/s、10GB/s,随机读写速度最高均为130万IOPS。

图片图片

雷神MIX迷你机同样搭载了长江存储PC550。

图片图片

零刻GTR9 Pro 395迷你机用的是PC42Q。

这可以说是QLC SSD的经典之作,广受采纳和好评,同样是晶栈4.0架构,接口速度3.6Gbps,标称顺序读写速度7GB/s、6.5GB/s。

图片图片

七彩虹MEOW橘猫R16 Ultra游戏本同样搭载了PC42Q。

当然,长江存储SSD的OEM合作伙伴并不止以上这些,还有更多敬请期待!

图片图片


展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松