通过 AGI CPU 和 Neoverse CSS N4 扩展 AI 基础设施,迎接智能体时代

随着人工智能从推理阶段迈向行动阶段,AI 智能体不仅需要完成模型推理,还须实时检索数据、调用外部工具,并与数据库及其他智能体进行协同交互。这一趋势正显著推动数据中心对 CPU 算力的需求增长。然而,不同工作负载对基础设施的要求存在本质差异:横向扩展(scale-out)与数据面(data plane)场景侧重于最大化吞吐效率,而智能体及其他性能敏感型应用则对 CPU 的响应能力提出了更高要求。在此背景下,Arm 已在数据中心实现规模化部署。据 IDC 数据显示,基于 Arm 架构的机架级服务器市场规模已超越 x86,成为加速计算领域的主流平台。

在今日举办的 Arm Everywhere China 年度大会上,Arm 系统阐述了其推动这一变革的战略路径。鉴于 AI 基础设施不存在”一刀切”的通用方案,Arm 致力于为客户提供灵活多元的选择,使其能够针对不同工作负载特征匹配最优方案。其中,全新推出的 Neoverse 计算子系统(CSS)N4,可帮助客户打造面向最高吞吐效率优化的定制芯片;而 Arm AGI CPU 则为高响应智能体 AI 应用提供量产就绪的算力方案。二者均构建于统一的 Neoverse 平台与软件生态系统之上,在实现差异化定位的同时,确保架构层面的兼容性与协同性。

借助 Neoverse CSS N4 加速差异化芯片开发

随着 AI 基础设施持续向异构化方向演进,越来越多的部署场景要求针对特定系统架构或功能进行芯片定制,其应用范围涵盖定制化计算平台、数据处理单元(DPU)、网络芯片及其他专用设计。

Neoverse CSS 正是 Arm 将自身能力延伸至上述设计领域的关键载体,为微软(Microsoft)、云豹智能等合作伙伴提供经过生产验证的一体化计算底座。合作伙伴可依据不同应用场景进行灵活配置,在有效降低工程投入与集成风险的同时,显著缩短芯片开发周期。在此基础上,Neoverse CSS N4 将上述能力进一步推向新的高度,成为 Arm 迄今可配置性最高的 CSS 平台,为合作伙伴提供从 CSS 到芯片产品最为高效的开发路径。

在硬件规格方面,Neoverse CSS N4 单颗裸片(die)最高可搭载 128 个内核,支持 LPDDR6 内存与 PCIe Gen 7 互连标准。与上一代 Neoverse CSS N3 相比,其整体性能最高可提升至两倍,每瓦性能最高可达 1.25 倍,内存带宽最高可达 1.75 倍。当前,智能体 AI 正驱动系统内部更大规模的数据流转、加速器协同调度及高并发计算,上述性能提升恰为这一趋势提供了所必需的计算密度、高速内存访问及 I/O 吞吐能力。鸿钧微电子已成为首批采用 CSS N4 开发 Arm 架构差异化基础设施芯片的合作伙伴之一。

与此同时,Arm 全面设计(Arm Total Design)生态项目通过在更早期阶段完成 IP 验证与软件开发,进一步加速产品从设计到量产的进程。目前,Arm 正将这一协作模式拓展至物理 AI 领域,持续拓宽其平台化赋能的边界。

Arm CPU 驱动大规模智能体 AI 发展

并非所有客户均具备或需要自研芯片的条件。对于期望直接部署量产就绪算力的客户而言,Arm AGI CPU 同样能够提供 Neoverse 平台所具备的卓越性能与能效表现。

自发布以来,Arm AGI CPU 在 AI 生态系统中获得了广泛响应。OpenAI、Meta、Cloudflare、Oracle、SAP、联想、Supermicro 及 Verda 等企业均已围绕该平台开展相关解决方案的研发与部署。

联想集团副总裁、中国基础设施业务群总经理陈振宽表示:”联想与 Arm 对算力基础设施的未来发展方向持有共同愿景——构建 Token 驱动的 AI 基础设施。Arm AGI CPU 为下一代云计算与 AI 基础设施提供了坚实的技术底座,而联想在系统设计、制造、部署及客户合作领域积累了深厚经验。通过双方优势的充分协同,我们能够将技术创新切实转化为客户价值,以满足中国市场日益增长的 AI 算力需求。”

在更为广泛的云生态系统中,多家企业已着手依托 Arm 平台支撑智能体 AI 应用的落地。Google Cloud 在基于 Axion 处理器的 GKE 环境中部署了智能体沙箱;Microsoft Azure 借助 Cobalt 200 加速智能体沙箱内的工具调用与任务执行;NVIDIA Vera 则针对智能体工作负载进行了专项优化。

在国内市场,字节跳动旗下云计算业务火山引擎正基于 Arm 平台构建其下一代云服务体系,并率先将基于 Arm AGI CPU 的智能体沙箱解决方案推向市场,旨在为大规模智能体工作负载提供安全隔离、弹性可扩展的运行环境。

火山引擎云基础产品经理负责人李越渊表示:”基于对 Arm AGI CPU 的早期评估,其在主流云工作负载中展现出良好的性能潜力。伴随 AI 智能体的快速发展,市场对安全、隔离且具备弹性扩展能力的大规模执行环境的需求持续增长。我们认为,Arm AGI CPU 为下一代云服务及智能体沙箱场景奠定了坚实基础。我们期待与 Arm 保持紧密合作,共同推动面向 AI 时代的高效、可扩展且具备高性价比的基础设施建设。”

深化本土合作,筑牢下一代技术根基

与此同时,Arm 正与新紫光集团持续深化战略合作,携手推动中国下一代 AI 基础设施的发展进程。双方合作将涵盖 Arm AGI CPU 及 Arm 计算子系统(CSS)等核心技术。依托 Arm 在高能效计算及全球软件生态系统方面的领先优势,结合新紫光集团在芯片设计、系统开发及中国市场深耕多年的能力积淀,双方还计划在中国联合成立通用人工智能创新中心,围绕 AI 智能体编排、CXL 内存池化、机架级系统架构及边缘 AI 等前沿技术方向展开探索与创新,致力于打造面向中国市场、具备差异化竞争优势、覆盖多代演进路线图的 AI 基础设施解决方案体系。

面向未来,释放每一份算力的最大价值

智能体 AI 尚处于发展初期。随着智能体应用的规模化普及,基础设施将面临更为严苛的要求——需要处理更大规模的数据、协同调度更多加速器,并支撑更高密度的并发计算。在此趋势下,如何从每一瓦电力、每一个机架以及每一笔投资中释放最大价值,将变得愈发关键。

当前,整个行业正逐步将 Arm 确立为下一代智能体 AI 的通用计算平台。凭借 Arm AGI CPU 与 Neoverse CSS N4,客户既可依据自身基础设施需求灵活选择演进路径,又能共享统一的技术基础,在性能、能效与软件兼容性之间实现最优平衡。

上一篇
下一篇