Arm Everywhere China 2026:重塑云AI基础设施,全面布局智能体时代

随着计算产业从生成式人工智能迈向智能体(Agent)时代,未来的计算将不再局限于单一场景,而是横跨边缘、物理世界和云端,形成高度互联的计算连续体。

在9月8日于上海举办的以“赋能AI计算的未来”为主题的Arm Everywhere China年度大会上,Arm发布了多项针对云AI基础设施的重磅产品与解决方案,涵盖处理器平台、计算子系统及软件生态三大维度,旨在应对日益分布式、异构化和自主化的系统级挑战。

云AI基础设施的核心产品发布

本次大会,Arm推出了两款面向不同AI基础设施需求的核心产品。

1.Arm Neoverse CSS N4:可配置性最高的计算子系统

作为Arm迄今可配置性最高的计算子系统,CSS N4专为横向扩展和数据面场景优化。该平台支持单裸片最高128个核心,首次在N系列中引入LPDDR6内存支持,并配备PCIe Gen 7互连,面向横向扩展和数据面场景优化。与上一代CSS N3相比,CSS N4的插槽性能提升2倍,每瓦性能提升1.25倍,内存带宽提升1.75倍,可为合作伙伴提供从CSS到芯片最快的开发路径,实现13个月从项目启动到硅片流片,节省高达80个工程年的开发资源。

2. Arm AGI CPU:首款自研量产级AI数据中心芯片

Arm AGI CPU是Arm首款专为AI数据中心和智能体工作负载设计的自研量产级CPU芯片,其采用台积电3nm N3P工艺,集成超500亿颗晶体管,采用双Chiplet设计,最高可配置136个Arm Neoverse V3核心(每核独享2MB L2缓存),最高主频3.7GHz,TDP为300W,支持6TB DDR5-8800内存,配备96通道PCIe Gen 6与CXL 3.0互连,每核内存带宽超过6GB/s,内部延迟低于100ns。

Arm宣称,在标准风冷机架中,其单机架性能可达最新x86系统的两倍以上;每吉瓦AI数据中心容量可节省高达100亿美元的资本支出。

大会现场展示了多个云平台的实测案例:Google Cloud基于Axion运行的AI代理沙盒,相比其他云平台实现30%的性价比提升;微软Azure基于CSS平台推出Cobalt 100和Cobalt 200云处理器,专为规模化、云原生、Linux-based代理式AI工作负载优化,其中基于Cobalt 200的沙盒工具执行性能提升50%;NVIDIA Vera平台上的代理性能达到x86系统的1.8倍。

Arm vs. x86:性能、能效与生态的全面对标

Arm云AI业务拓展副总裁Eddie Ramirez在媒体沟通会上详细阐述了Arm与x86的差异化优势。

《Arm Everywhere China 2026:重塑云AI基础设施,全面布局智能体时代》

Arm云AI业务拓展副总裁Eddie Ramirez

在大多数云端工作负载中,Arm已展现优于x86的性能。以亚马逊云科技Graviton5(基于V3设计)为例,基准测试显示其较x86有两位数性能提升。Eddie指出,当x86开启多线程时,单个Arm核心的表现依然优于多线程核心。

在能效方面,Arm的差异化优势更加明显。以Arm AGI CPU为例,其TDP为300瓦,而同等性能的x86方案TDP通常为500瓦。这意味着在相同功耗预算下,Arm可部署更多节点,获得更高总算力。

在生态支持与用户选择方面,Arm同时提供IP授权和Arm AGI CPU成品,既支持定制也提供商用就绪方案。相比之下,x86生态目前仅剩两家公司提供方案,而Arm拥有更广泛的采用度和选择空间。

深耕中国市场与生态布局

在生态合作方面,Arm在中国市场形成了广泛的合作伙伴网络。

系统厂商层面,联想推出了基于Arm AGI CPU的HR650a V3系统,成为首批在中国市场部署的AI代理服务器;在云服务与互联网层面,字节跳动旗下火山引擎已将首批基于AGI CPU的智能体沙箱推向市场,支持企业级AI代理开发与部署,新紫光集团与Arm的战略合作涵盖Arm AGI CPU,双方计划联合成立通用人工智能创新中心;在芯片设计层面,鸿钧微电子成为首批采用CSS N4开发差异化Arm架构基础设施芯片的合作伙伴之一,云豹智能作为中国领先的DPU芯片设计公司,已基于CSS N2平台推出支持800Gbps吞吐量的全功能DPU,客户涵盖腾讯云、中国移动、中国联通等。

Eddie Ramirez指出,中国市场的独特之处在于存在专门针对本地热门工作负载而设计的方案,例如云游戏在中国的普及程度远高于西方市场,腾讯等企业专注于云游戏服务器领域。

针对中国云厂商自研芯片越来越多的现象,Eddie Ramirez表示,中国市场是一个非常充满活力的市场,云服务商的多样性也意味着工作负载的多样性。许多云服务商正在探索如何服务企业工作负载、云原生工作负载,以及如何应对智能体AI的服务需求。不同的工作负载需要多种CPU类型,Arm有机会为中国大型云客户提供多种数据中心选择。

最新数据显示,Arm全球合作伙伴以累计出货超过3500亿颗基于Arm技术的芯片异军突起,而中国创新者始终是这一全球创新历程中的重要力量。

为下一代AI体验和智能应用构建坚实计算底座

AI基础设施正在加速向Arm架构迁移。目前,所有主要超大规模云服务提供商均已采用Arm架构。IDC数据显示,2026年第一季度,基于Arm架构的机架级服务器市场规模已超越x86,成为加速计算主流平台。

Eddie Ramirez在采访中透露,Arm正在打造Arm AGI CPU的多代产品路线图,已经拥有一份备受合作伙伴关注的非常强劲的产品路线图。在芯片迭代速度方面,Arm架构展现出显著优势:微软能够在18个月内迭代两代产品,AWS在七年内迭代了五代的Graviton,这是x86架构方案无法实现的产品迭代节奏。这种速度与灵活性,正好为客户提供了定义最合适方案所需的能力。

在生态层面,Arm构建了从底层IP到上层应用的完整技术栈,覆盖芯片设计、云原生部署、AI推理优化及开发者社区等多个环节。其Neoverse平台已整合阿里云、AWS、富士通、谷歌云、鸿钧微电子、云豹智能、微软、NVIDIA等合作伙伴的全系列处理器,覆盖边缘、云及物理AI三大场景。面向全球,Linux/OS方面,OpenAnolis、Alibaba Cloud Linux、CentOS、TencentOS等主流发行版均已完成Arm64深度优化;云原生方面,Kubernetes、Docker、Rancher、Envoy等均原生支持Arm架构;AI/ML框架方面,PyTorch、TensorFlow、ONNX、Hugging Face等均提供Arm优化版本。

Arm执行副总裁兼首席商务官Will Abbey在大会致辞中表示,Arm正依托覆盖云、边缘和物理应用的统一计算平台,以及不断壮大的软件生态系统,携手中国合作伙伴加速创新成果落地,为下一代AI体验和智能应用构建坚实计算底座。

 

点赞

发表评论

邮箱地址不会被公开。 必填项已用*标注