公众号手机端

Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家

zhiyongz 2小时前 阅读数 9 #软件
文章标签 Linux 7.4
快科技10月1日消息,Linux在7.4内核中引入了一项AMD PerfOpt优化,让Radeon核显在本地运行大语言模型时绕过IOMMU直接访问系统内存,Llama.cpp吞吐量最高提升23%。该补丁由IOMMU维护者Joerg Roedel于9月24日合入,AMDGPU驱动会在检测到APU核显工作在Identity Domain时自动启用,独立显卡不受影响。
Netflix开发者Boqun Feng在邮件列表中公布的测试数据显示,核显访问动态分配的系统内存(GTT区域)的速度只有固定预留显存的二分之一到三分之一,PerfOpt开启后,GTT访问延迟降至预留显存的10%以内。大语言模型无法完全装入入门笔记本的小容量预留显存时,大部分数据落在GTT区域,这正是PerfOpt在AI场景下效果明显的原因。
Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家 7.4 第1张
Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家
Phoronix基于Linux 7.3补丁构建测试内核,对三款APU进行了实测,锐龙AI 9 365的AI性能提升最高23%,同时提升了吞吐量和首Token响应速度。此外预留显存越少,PerfOpt收益越大,锐龙AI 5 340搭载Radeon 840M,各项测试均有提升,增幅从18%起。旗舰APU方面,锐龙AI Max+ 395在Framework Desktop上配备64GB LPDDR5-8000,典型提升仅2%至4%,个别测试中未开启PerfOpt反而更快。
目前测试仅覆盖Zen 5架构搭配RDNA 3.5核显的APU,老芯片如锐龙7040或Steam Deck的Van Gogh定制芯片是否具备该特性位尚无定论。PerfOpt补丁共新增341行代码,涉及8个文件,最终以何种形式进入正式内核仍有待确认。
Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家 7.4 第2张
Linux 7.4新优化:AMD核显跑AI快23%!入门APU成大赢家
【本文结束】出处:快科技



版权声明

本站所有文章来源于本站原创或网络,如有侵权请联系删除。文章观点并不代表本站观点,请网友自行判断,如涉及投资、理财请谨慎应对!

发表评论:

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。

热门