后摩智能10瓦存算一体芯片M50发布,开启端侧AI新范式
在人工智能技术快速发展的今天,算力的分布方式正在发生深刻变革。不同于传统数据中心集中式计算模式,越来越多的应用场景需要将AI能力下沉到终端设备。这一趋势催生了一个全新的硬件品类:Agent Compu...
在人工智能技术快速发展的今天,算力的分布方式正在发生深刻变革。不同于传统数据中心集中式计算模式,越来越多的应用场景需要将AI能力下沉到终端设备。这一趋势催生了一个全新的硬件品类:Agent Computer(代理计算机),而其核心正是后摩智能最新发布的10瓦功耗存算一体芯片M50。
后摩智能创始人吴强表示,M50芯片的诞生是公司对AI产业未来趋势的精准预判。这款芯片采用存算一体架构,将计算单元直接嵌入存储器内部,彻底解决了传统冯·诺依曼架构中数据搬运带来的性能瓶颈。与英伟达GPU相比,M50在运行大模型时展现出更高的能效比,特别适合需要实时推理的边缘计算场景。
"我们看到,随着大模型参数规模的不断扩大,云端推理的成本和延迟问题日益突出。"吴强解释道,"M50的出现,让在本地运行千亿级参数模型成为可能,这不仅是技术上的突破,更是商业模式的创新。"
M50芯片的主要特性包括:10瓦功耗、160TOPS算力,支持数百亿至千亿参数的大模型运行。这种高性能低功耗的组合,使其成为联想AI主机P7、长城N90Pro等新一代AI PC的核心部件。同时,运营商通信AI RAN、陪伴机器人等领域也对这款芯片表现出浓厚兴趣,预计将在2026年下半年迎来大规模应用。
"M50的推出,标志着端侧AI计算进入一个新时代。"一位行业分析师指出,"它不仅降低了AI应用的门槛,更重要的是解决了数据隐私和实时性两大痛点。对于需要处理敏感信息或对响应速度要求极高的场景来说,这是革命性的解决方案。"
后摩智能的成功,还得益于其独特的技术路线选择。在中美科技脱钩背景下,当众多企业扎堆追逐GPU国产替代时,吴强带领团队选择了更具前瞻性的存算一体架构。尽管这一技术在早期面临诸多质疑,但随着大模型时代的到来,其优势逐渐显现。
"我们坚信,未来的AI计算将呈现‘云-边-端’协同的分布式架构。"吴强表示,"M50只是第一步,我们将继续深耕存算一体技术,为更多应用场景提供高效能的AI计算解决方案。"
随着M50芯片的量产上市,后摩智能正在构建一个全新的AI计算生态。在这个生态中,每一个终端设备都将成为独立的‘Token工厂’,为用户提供随时随地的AI服务。这不仅是技术的进步,更是AI商业范式的重大革新。