AMD ROCm 7.14发布,首次支持Ryzen AI Max PRO 400系列处理器
近日,AMD正式发布了ROCm 7.14版本,这是其开源AI软件生态系统的一次重要升级。作为AMD面向人工智能与高性能计算场景的核心软件栈,ROCm此次更新不仅带来了全新的自动化构建系统TheRock...
近日,AMD正式发布了ROCm 7.14版本,这是其开源AI软件生态系统的一次重要升级。作为AMD面向人工智能与高性能计算场景的核心软件栈,ROCm此次更新不仅带来了全新的自动化构建系统TheRock,还首次官方支持了Ryzen AI Max PRO 400系列处理器,为AI开发者提供了更强大的硬件基础。
,AMD在ROCm 7.14中新增支持的Ryzen AI Max PRO 400系列处理器代号为Gorgon Halo,预计将在未来几周内发布。该系列处理器包括Ryzen AI Max+ PRO 495、Ryzen AI Max PRO 490和Ryzen AI Max PRO 485三款型号,均基于Zen 5架构CPU和RDNA 3.5架构GPU。与前代Strix Halo产品相比,Gorgon Halo系列的最大亮点在于其显著提升的内存配置,最高可支持192GB统一内存,并允许最多160GB作为显存使用,足以运行300B+参数的大型语言模型(LLM)。
在软件层面,ROCm 7.14版本带来了多项关键改进。首先,AMD推出了全新的自动化构建系统TheRock,这一系统将ROCm的构建、打包、验证和交付流程进行了现代化升级,显著提升了开发效率。其次,新版本扩展了对AMD最新AI硬件的支持,强化了通信和数学库,增强了开发工具,并简化了在客户端、企业、云和数据中心环境中的部署流程。
值得注意的是,ROCm Systems Profiler和ROCm Compute Profiler现在可以在Ryzen AI MAX PRO平台上运行,其中Compute Profiler还增加了与Strix Halo和Strix Point芯片的兼容层,为开发者提供了更全面的性能分析工具。这一改进对于需要进行复杂AI工作负载的开发者来说尤为重要,因为它能够帮助他们更好地优化和调试应用程序。
然而,ROCm 7.14的发布并非没有挑战。根据Ubuntu社区的报告,Linux 7.0.0-28.28内核版本中的AMDGPU驱动存在性能问题,可能导致ROCm计算负载的吞吐性能降至原来的1/42。以Stable Diffusion XL通过ComfyUI执行推理为例,原本约9秒完成的任务,在升级到受影响内核后,观测到最长需388秒。这一回归问题源自Linux 7.0稳定版系列的上游内核,其他发行版(例如CachyOS和Fedora)的用户也已报告过该问题。
尽管如此,AMD表示正在积极与Linux社区合作,解决这一性能问题。同时,AMD建议开发者在使用ROCm 7.14时,优先选择经过验证的稳定内核版本,以确保最佳的性能表现。对于需要立即部署AI应用的企业用户,AMD也提供了详细的兼容性指南,帮助他们在现有环境中顺利过渡到新版本。
总的来说,ROCm 7.14的发布标志着AMD在AI硬件和软件生态建设上的又一重要里程碑。通过引入全新的自动化构建系统、扩展对最新硬件的支持,以及提供更全面的开发工具,AMD正在为AI开发者打造一个更加高效、灵活的工作环境。虽然当前存在一些性能问题,但AMD的快速响应和持续优化,将有助于推动整个AI生态系统的健康发展。