快科技 9 月 3 日消息,AMD 开源本地 AI 服务器 Lemonade 今日正式发布 11.9 版本,该版本最大的亮点是引入了实验性的 ROCm HRX 后端支持。
HRX 是 AMD ROCm 生态中一项全新的低延迟、高性能计算栈,基于 Loom 编译器 IR 技术打造,旨在为 AMD GPU/NPU/CPU 提供统一的性能加速底座。

Lemonade 是一款由 AMD 支持的免费开源本地 AI 服务器,支持 Linux、Windows 和 macOS 三大平台,可在本地硬件(CPU、GPU、NPU)上 100% 运行 AI 模型,数据无需上传云端。
ROCm 在客户端 AI 领域长期被诟病 " 装死 ",HRX 后端的诞生正是源于 AMD 对 ROCm 在客户端系统部署痛点的回应。AMD 工程师 Stella Laurenzo 此前坦言,ROCm 最初面向数据中心开发,在客户端系统集成时常遇到阻力。
为此,AMD 打造了 HRX:一个轻量级、更聚焦的 ROCm 子集,为客户端使用场景专门优化。
性能方面,AMD 表示 HRX 后端在 Prefill 阶段相比现有的 Vulkan 和 HIP 后端,可带来 30% 至 50% 的 Token/s 提升;在非 MTP 解码任务上,也可实现约 10% 的 Token/s 增益。
该后端目前已在 AMD Radeon RX 7900 系列 RDNA3 显卡和 Strix Halo APU 上完成初步验证。
值得一提的是,Lemonade 11.9 版本是首次开放 HRX 对 AMD GFX1100 和 GFX1151 GPU 目标的支持。不过该功能目前仍处于实验阶段,GPU 支持范围预计将在后续版本中快速扩展。
此外,新版本还带来了对 Qwen3-Next 模型的支持,并对 Llama.cpp 后端进行了多项改进。
对于 AMD 显卡用户和 AI 开发者而言,HRX 意味着在不更换硬件的前提下,本地 AI 推理性能有望获得显著提升。



登录后才可以发布评论哦
打开小程序可以发布评论哦