Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

2026-10-01 23:18:14 0点赞 0收藏 0评论

快科技10月1日消息,Linux在7.4内核中引入了一项AMD PerfOpt优化,让Radeon核显在本地运行大语言模型时绕过IOMMU直接访问系统内存,Llama.cpp吞吐量最高提升23%。

该补丁由IOMMU维护者Joerg Roedel于9月24日合入,AMDGPU驱动会在检测到APU核显工作在Identity Domain时自动启用,独立显卡不受影响。

Netflix开发者Boqun Feng在邮件列表中公布的测试数据显示,核显访问动态分配的系统内存(GTT区域)的速度只有固定预留显存的二分之一到三分之一,PerfOpt开启后,GTT访问延迟降至预留显存的10%以内。

大语言模型无法完全装入入门笔记本的小容量预留显存时,大部分数据落在GTT区域,这正是PerfOpt在AI场景下效果明显的原因。

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

Phoronix基于Linux 7.3补丁构建测试内核,对三款APU进行了实测,锐龙AI 9 365的AI性能提升最高23%,同时提升了吞吐量和首Token响应速度。

此外预留显存越少,PerfOpt收益越大,锐龙AI 5 340搭载Radeon 840M,各项测试均有提升,增幅从18%起。

旗舰APU方面,锐龙AI Max+ 395在Framework Desktop上配备64GB LPDDR5-8000,典型提升仅2%至4%,个别测试中未开启PerfOpt反而更快。

目前测试仅覆盖Zen 5架构搭配RDNA 3.5核显的APU,老芯片如锐龙7040或Steam Deck的Van Gogh定制芯片是否具备该特性位尚无定论。

PerfOpt补丁共新增341行代码,涉及8个文件,最终以何种形式进入正式内核仍有待确认。

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

编辑:黑白

【本文结束】如需转载请务必注明出处:快科技

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松