星途科讯 4小时前
AMD锐龙AI Max详解:本地跑3200亿参数模型
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

据媒体报道,AMD 详细阐述了其面向 Windows PC 的锐龙 AI Max 处理器平台的最新本地人工智能(AI)能力,这是该公司推进 " 代理式 PC"(Agentic PCs)战略的关键一步。该平台旨在让终端设备运行更大规模的 AI 模型,同时确保用户能无缝使用原生 Windows 应用及专业软件。AMD 透露,目前搭载其处理器的 " 代理式 PC" 出货量已超 50 万台,涵盖 50 多种机型设计。定义 " 代理式 PC"AMD 将 " 代理式 PC" 定义为融合 GPU、CPU 和 NPU 的系统,支持用户在本地运行 AI 智能体。最新的锐龙 AI Max 平台最高配备 16 个 Zen 5 CPU 核心、32 线程、高达 192GB LPDDR5x 统一内存,并采用 RDNA 3.5 图形架构及 XDNA 2 架构。该处理器支持在 Windows 和 Linux 上原生运行 x86 操作,无需模拟层,从而实现在本地并行处理 AI 工作负载与常规 PC 任务,而非完全依赖云服务。突破模型规模限制此次更新的核心在于提升本地硬件对大规模语言模型的支持能力。AMD 指出,搭载锐龙 AI Max+ PRO 495 的系统可在本地运行拥有 3200 亿参数的 GLM 5.3 Flash 模型;借助离散 KV 缓存技术,还能同时运行多个参数量分别为 1250 亿和 510 亿的 Qwen 3.8 Flash Next 模型。在 2026 年 9 月进行的内部测试中,配备 192GB 内存的 AMD 锐龙 AI Halo 开发平台,运行采用 IQ4 XS 量化技术的 GLM 5.3 Flash 320B 模型时,速度最高可达每秒 20 个 token;同一框架下,Qwen 3.8 Flash Next 的速度最高可达每秒 42 个 token。AMD 强调,实际性能可能因系统和具体工作负载而异。此外,128GB 配置版本的系统可在轻薄型 Windows 设备上本地运行高达 2000 亿参数的模型,使锐龙 AI Max 系列切入传统上由大型工作站或服务器主导的市场领域。赋能专业应用场景 AMD 还瞄准了超出消费级 AI 工具范围的专业软件用户群体。该平台支持计算流体力学、结构工程、3D 建模与动画、电气系统设计、注塑成型分析、PCB 设计、工业设计、CNC 加工及建筑工作流程等应用场景。其核心卖点在于,用户可在同一台机器上并行运行本地语言模型、AI 驱动工作流以及基于 Windows 的工程和设计应用。这反映了 PC 行业将设备端 AI 定位为云计算补充而非替代品的广泛趋势。构建软件生态系统除硬件升级外,AMD 还公布了围绕 " 代理式 PC" 战略的软件及生态系统合作进展。Perplexity 的 Portable Computer 功能将在基于锐龙 AI Max 的系统上推出,允许用户在不消耗云端积分的情况下运行本地 AI 任务和重复性工作流。微软已选择锐龙 AI Halo 作为其 " 就绪编码 " 开发者体验的首个平台。AMD 还与思科合作,协助企业将本地 AI 从开发测试阶段过渡到安全、受支持且易于管理的部署环境。这些合作表明,AMD 正试图超越单纯的模型规模和基准测试,为本地 AI 构建更广泛的商业案例,强调软件工具、部署控制及与现有桌面环境的兼容性对企业采用的重要性。产品组合与演进路线锐龙 AI Max 隶属于 AMD 更广泛的产品矩阵,涵盖消费级和商业级锐龙 AI 处理器、锐龙 AI PRO 芯片、锐龙 AI Max 系列及锐龙 AI Halo 开发平台。AMD 还提及 Radeon AI PRO 显卡和 Threadripper Halo 工作站,以满足处理更大模型和更重负载的需求。AMD 将此次更新置于其多代 AI 处理器开发脉络中:锐龙 7000 系列是首款配备专用 NPU 的代次,随后是面向 AI PC 的锐龙 AI 300 系列、面向代理式 PC 的锐龙 AI Max 系列,以及作为下一代平台的锐龙 AI Max 400 系列。AMD 重申,目前已有超过 50 万台搭载其处理器的 " 代理式 PC" 出货,涉及 50 多种设计机型。

【星途科讯 图文丨踢三脚 首发于 ZAKER 科技,转载请注明出处】

评论
大家都在看