据外媒CNBC报道,NVIDIA计划在3月16日开幕的年度GTC大会上公布其针对AI代理优化的CPU新细节,并可能展示一款纯CPU机架。这一动态表明,随着AI代理应用的兴起,CPU正重新成为数据中心的重要组成部分。
NVIDIA AI基础设施主管Dion Harris表示,当前CPU已成为扩展AI和代理工作流程的瓶颈,但这也为CPU的复兴提供了机会。他强调,NVIDIA的CPU设计与英特尔和AMD的通用型CPU有根本区别,更适合数据处理和AI代理工作负载。例如,NVIDIA Grace CPU仅拥有72个核心,而AMD EPYC和英特尔Xeon系列服务器CPU通常配备128个核心。Harris解释称,NVIDIA的设计更注重单线程性能,而非核心数量,以确保其GPU不会因等待数据而闲置。
NVIDIA于2021年推出了首款数据中心CPU Grace,而下一代产品CPU Vera目前已投入生产。这些CPU通常与NVIDIA的Hopper、Blackwell或Rubin GPU共同部署在完整的机架级系统中。此外,NVIDIA与Meta达成了一项多年期供货协议,计划在2027年大规模部署Grace和Vera CPU。这一合作标志着NVIDIA芯片战略的重大转变。
与此同时,亚马逊、谷歌和微软等科技巨头也在研发基于ARM架构的自研CPU。例如,亚马逊早在2018年推出了Graviton处理器,谷歌于2024年发布了Axion处理器,而微软则在2025年推出了第二代Cobalt处理器。
CPU的复兴得益于AI应用场景的转变。从问答型聊天机器人到任务导向型AI代理,AI系统需要处理大量通用计算任务,并在多个代理之间进行协同调度。尽管GPU擅长并行计算,但CPU的高效能核心更适合处理连续的通用任务,成为AI代理系统的重要支撑。
NVIDIA CEO黄仁勋在财报会议上多次提到AI代理的重要性,并指出每瓦性能是硬件需求转变的关键。他强调,AI代理系统正在生成指数级增长的tokens,需要更高的推理速度和更高效的调度能力。
据Creative Strategies芯片分析师Ben Bajarin透露,NVIDIA此次可能推出的纯CPU机架将专注于运行AI代理,而软件和加速器将分别负责调度和处理tokens。这一全新基础设施有望进一步推动AI代理技术的发展。