Arm推出AIPortal平台,统一优化部署流程,加速多场景AI应用落地

Arm在2026年上海站Arm Create开发者大会上正式发布AI Portal平台。该平台旨在为开发者提供一个统一入口,帮助其在Arm计算平台上发现、优化和部署AI软件,覆盖云、边缘和物理AI场景...

人工智能

随着人工智能技术从云端向边缘侧和物理世界延伸,开发者面临的挑战日益复杂。过去两年,AI应用开发的重心已从单纯关注模型能力,转向如何在不同硬件平台(如手机、PC、汽车、IoT设备)上实现高效部署。这种转变催生了对统一开发工具的需求,而Arm最新推出的AI Portal正是为此而生。

Arm AI Portal的核心功能是提供一个面向开发者和智能体的统一入口,帮助其快速判断哪些模型适合特定硬件平台,并指导优化和部署流程。根据Arm开发者关系副总裁Shantu Roy的介绍,该平台首批支持语言、语音、视觉和神经图形等AI工作负载,预优化模型包括阿里巴巴通义千问、Google Gemma和Ultralytics YOLO,并兼容ExecuTorch、LiteRT和ONNX Runtime等运行时环境。

文章配图

"我们的主要目标是加快开发者的工作流程,减少他们在模型选择、目标平台选择、部署方式和模型优化上投入的时间。"Shantu Roy表示,Arm AI Portal将相关资源通过Hugging Face和developer.arm.com提供,后续还将登陆魔搭社区ModelScope。

与此前的KleidiAI相比,Arm AI Portal的覆盖范围更广。KleidiAI主要解决底层算子优化问题,而AI Portal则聚焦于开发者视角的完整工作流组织,包括模型选择、硬件适配、性能评估和部署指引。这种策略反映了Arm从芯片架构提供商向软硬件生态建设者的转型。

在实际应用中,Arm AI Portal已经展现出显著效果。例如,Qwen3-TTS在vivo X300上通过第二代Arm可伸缩矩阵扩展SME2加速,实现超过4倍的速度提升;Ultralytics YOLO在vivo X300上依托SME2,单线程FP16相较FP32性能提升超过40%;在树莓派5上,依托NEON技术,采用FP16与I8混合精度模式,显著降低了功耗和延迟。

Arm AI Portal的推出,不仅解决了开发者在多平台、多模型、多运行时环境下的适配难题,也为AI技术在更多应用场景中的落地提供了强有力的支持。未来,随着更多合作伙伴的加入,Arm AI Portal有望成为AI开发者的重要工具集,推动AI应用在各个领域的普及和发展。