资讯

ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

驱动之家·2026/9/3 03:19:00🔗 原文

📋总体概括

AMD开源本地AI服务器Lemonade发布11.9版本,引入实验性ROCm HRX后端。HRX是基于Loom编译器IR打造的新计算栈,为GPU/NPU/CPU提供统一加速底座,定位轻量级ROCm子集,专为客户端场景优化。AMD工程师承认ROCm最初面向数据中心,在客户端部署常遇阻力。性能上,HRX在Prefill阶段相比Vulkan和HIP后端可带来30%-50%的Token/s提升,非MTP解码任务约有10%增益。Lemonade支持三大平台,可完全本地运行AI模型,数据不上云。

关键信息

  • Lemonade 11.9正式发布,最大亮点是引入实验性ROCm HRX后端支持
  • HRX是ROCm生态新计算栈,基于Loom编译器IR,为GPU/NPU/CPU提供统一加速底座
  • AMD工程师Stella Laurenzo坦言ROCm最初面向数据中心,客户端系统集成常遇阻力
  • HRX后端Prefill阶段相比Vulkan和HIP后端提升30%-50% Token/s,非MTP解码约有10%增益
  • Lemonade支持Linux、Windows、macOS,AI模型100%本地运行,数据无需上传云端

🔥犀利点评

ROCm客户端体验烂是AMD社区喊了多年的老问题,这次AMD工程师终于公开承认病根:为数据中心生的东西硬塞进消费级场景。HRX走轻量子集路线方向是对的,30%-50%的Prefill提升听着也漂亮。但别急着欢呼——实验性后端、性能数据全是AMD自说自话,稳定性、模型兼容性、驱动装机成功率才是ROCm真正的劝退点,这些一个都没验证。补课而已,谈翻盘为时尚早。

快科技9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的ROCm HRX后端支持。

HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NPU/CPU提供统一的性能加速底座。

 ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windows和macOS三大平台,可在本地硬件(CPU、GPU、NPU)上100%运行AI模型,数据无需上传云端。

HRX后端的诞生源于AMD对ROCm在客户端系统部署痛点的回应。AMD工程师Stella Laurenzo在GGML社区讨论中坦言,ROCm最初面向数据中心开发,在客户端系统集成时常遇到阻力。

为此,AMD打造了HRX:一个轻量级、更聚焦的ROCm子集,为客户端使用场景专门优化。

性能方面,AMD表示HRX后端在Prefill阶段相比现有的Vulkan和HIP后端,可带来30%至50%的Token/s提升;在非MTP解码任务上,也可实现约10%的Token/s增益。

该后端目前已在AMD Radeon RX 7900系列RDNA3显卡和Strix Halo APU上完成初步验证。

值得一提的是,Lemonade 11.9版本是首次开放HRX对AMD GFX1100和GFX1151 GPU目标的支持。不过该功能目前仍处于实验阶段,GPU支持范围预计将在后续版本中快速扩展。

此外,新版本还带来了对Qwen3-Next模型的支持,并对Llama.cpp后端进行了多项改进。

对于AMD显卡用户和AI开发者而言,HRX意味着在不更换硬件的前提下,本地AI推理性能有望获得显著提升。

 ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

本文由本站自动聚合,以下为原始来源:原文 驱动之家 快讯 →