9 月 8 日,在 Arm Everywhere China 年度大会上,Arm 发布新一代数据中心计算子系统 Neoverse CSS N4,并公布 Arm AGI CPU 的最新生态进展。与此同时,Arm 还宣布与新紫光集团深化合作,双方计划在中国成立联合通用人工智能创新中心。
随着 AI 应用从生成内容转向执行任务,一个智能体在完成推理之外,往往还要检索数据、访问数据库、调用外部工具,并与多个模型或其他智能体协同。这些操作不一定适合全部交给 GPU 处理,也由此增加了数据中心对通用 CPU、内存带宽和高速 I/O 的需求。
Arm 试 图通过两条产品路线覆盖这一市场:Neoverse CSS N4 面向希望自行开发基础设施芯片的企业;Arm AGI CPU 则是一款可以直接用于服务器系统的成品处理器。两者共享 Neoverse 平台和软件生态,但面向的客户和产品形态并不相同。
Neoverse CSS N4 发布,单裸片最高 128 核
在今天的发布会上,Arm 宣布正式发布新品 Neoverse CSS N4。
CSS 是 Compute Subsystem,即计算子系统。与单独授权 CPU 核心 IP 相比,CSS 会预先集成 CPU 核心、互连、内存系统和相关系统 IP,并完成部分验证工作。芯片企业可以在此基础上加入自己的加速器、网络模块或其他专用功能,减少从 IP 集成到芯片流片所需的工程工作。
因此,CSS N4 本身不是一颗可以直接装进服务器的 CPU,而是一套供芯片厂商进行二次开发的计算子系统。
Arm 将 CSS N4 定位为其目前可配置程度最高的 Neoverse CSS。
单颗裸片可以配置 8 至 128 个 CPU 核心,最高频率可达 3.8GHz,并首次在 Neoverse N 系列 CSS 中支持 LPDDR6 内存和 PCIe 7.0。
其中,PCIe 通道数量最高可达 128 条,可以用于连接高速以太网设备、GPU 和其他 AI 加速器。对于需要同时管理大量加速器、网络设备和存储资源的 AI 服务器而言,高速 I/O 能力的重要性正在上升。
按照 Arm 公布的数据,与上一代 Neoverse CSS N3 相比,CSS N4 的单插槽性能最高可提升至 2 倍,每瓦性能最高提升 25%,内存带宽最高提升 75%。这些数字均为 Arm 提供的代际比较结果,实际提升幅度仍将取决于芯片配置、制造工艺和具体工作负载。
CSS N4 主要面向横向扩展计算、数据面处理、DPU、网络芯片和其他定制基础设施芯片。Arm 还将 Agent 沙箱隔离、AI KV Cache 处理和控制面计算列为目标场景。
在智能体系统中,沙箱用于将 Agent 执行的代码和工具调用与宿主系统隔离;DPU 可以承接网络、安全和数据移动任务;KV Cache 则保存模型推理过程中产生的中间状态。
随着 Agent 数量和并发任务增加,这些此前位于 GPU 周边的计算负载,可能进一步推高 CPU、内存和网络资源的消耗。
鸿钧微电子是首批采用 CSS N4 开发基于 Arm 架构的差异化基础设施芯片的合作伙伴之一。
为什么智能体时代重新强调 CPU
过去几年,AI 基础设施建设的主要关注点集中在 GPU 和其他加速器上。但 GPU 主要承担模型训练和推理中的大规模并行计算,完整的 AI 系统还需要 CPU 处理调度、网络、存储、数据库访问、模型服务以及各种传统应用。
进入智能体阶段后,这部分负载可能进一步增加。
一个 AI Agent 完成任务,通常不只运行一次模型推理。它可能需要反复规划步骤、搜索资料、调用 API、执行代码、访问企业系统并验证结果。多个 Agent 同时运行时,还会产生大量并发执行、权限隔离和资源调度需求。
这也是 Arm 此次同时强调吞吐效率和响应性能的原因。大规模数据面和横向扩展任务更关注单位功耗下能够处理多少请求;工具调用、代码执行和交互式 Agent 则更依赖单线程性能、低延迟和稳定响应。
不过,这并不意味着 CPU 和 GPU 之间正在形成替代关系。更准确地说,Agent 工作负载正在增加 GPU 之外的系统开销,使 CPU、内存、网络和加速器之间的协同变得更加重要。
与 CSS N4 不同,Arm AGI CPU 不是在本次大会上首次推出。
Arm 于 2026 年 3 月正式发布 AGI CPU,这是 Arm 从授权 CPU 架构和 IP 进一步进入数据中心成品芯片市场后的首款产品。该处理器采用 Neoverse V3 核心,单颗最多配置 136 个核心,支持 12 通道 DDR5 内存、96 条 PCIe 6.0 通道和 CXL 3.0,TDP 为 300W。
这款“AGI CPU”它实际承担的是 AI 服务器中的通用计算和编排任务,例如协调加速器、处理数据移动、运行 Agent 工具以及承载传统云服务。
此外,在本次大会上,Arm 主要披露了 AGI CPU 在中国市场及全球生态中的后续进展。
Arm 称,OpenAI、Meta、Cloudflare、Oracle、SAP、联想、Supermicro 和 Verda 等公司正在围绕这款 CPU 开发相关系统或解决方案。
火山引擎将推出基于 AGI CPU 的 Agent 沙箱
在国内市场,火山引擎正在基于 Arm 平台建设下一代云服务,并计划推出首批采用 Arm AGI CPU 的智能体沙箱解决方案。
Agent 沙箱可以为 AI 生成的代码、工具调用和自动化任务提供相互隔离的运行环境。当企业同时运行大量 Agent 时,沙箱需要支持快速启动、权限控制、弹性扩容和故障隔离,因此会消耗较多 CPU 与内存资源。
火山引擎云基础产品经理负责人李越渊表示,其对 Arm AGI CPU 的早期评估显示,这款处理器在主流云工作负载中具有一定的性能潜力。这里的表述仍属于合作伙伴的早期评估,双方暂未公布具体测试方法、性能数据和产品上线时间。
类似的 Agent 基础设施也已经出现在其他云平台中。Google Cloud 在基于 Axion 处理器的 GKE 环境中部署了 Agentic Sandbox;微软 Azure 使用 Cobalt 200 处理器支持 Agent 沙箱中的工具调用和代码执行;NVIDIA Vera CPU 也将 Agent 编排和加速器协同作为目标负载之一。
这些进展说明,智能体基础设施的竞争已经不再局限于“哪颗 GPU 完成模型推理更快”,而是开始扩展到谁能更有效地承接模型周边的执行任务。
面向未来,筑就下一代技术根基
Arm 也正在与新紫光集团深化战略合作,共同推动中国下一代 AI 基础设施的发展。双方的合作将涵盖 Arm AGI CPU 和 Arm 计算子系统(CSS)等 Arm 技术。
结合 Arm 在高能效计算及全球软件生态系统方面的领先优势,以及新紫光集团在芯片设计、系统开发和中国市场方面的能力积累,双方还计划在中国成立联合通用人工智能创新中心,围绕 AI 智能体编排、CXL 内存池化、机架级系统架构以及边缘 AI 等技术方向开展探索与创新,致力于打造面向中国市场、具有差异化优势、覆盖多代演进路线图的 AI 基础设施解决方案体系。
智能体 AI 仍处于发展初期。随着智能体应用大量普及,基础设施需要处理更多数据、协同/调度更多加速器,并支持更大规模的并发计算。因此,如何从每一瓦电力、每个机架以及每一笔投资中释放最大价值,变得愈发重要。
整个行业正逐步将 Arm 作为下一代智能体 AI 的通用计算平台。借助 Arm AGI CPU 和 Neoverse CSS N4,客户既能根据自身基础设施需求灵活选择发展路径,又能共享统一的技术基础,兼顾性能、能效与软件兼容性。