据外媒HPCwire报道,英伟达(NVIDIA)近期正式向客户交付了其首款自研Vera CPU。Anthropic、OpenAI、xAI以及Oracle Cloud Infrastructure(OCI)等顶尖AI企业已率先收到首批系统,标志着这款专为代理AI设计的处理器从发布阶段迈向实际部署。
英伟达表示,Vera CPU专为代理式AI工作负载打造,这类模型不仅需要“回答”,还需执行工具调用、协调流程、处理长上下文及实时任务,对CPU性能要求远高于传统推理场景。据悉,Vera CPU采用88颗英伟达自研Olympus核心,具备1.2 TB/s内存带宽,每核心性能提升约50%,旨在高负载、并行且实时的工作中提升AI工厂效率与响应速度。
5月15日,Vera CPU已送达三家顶尖客户的AI实验室,包括Anthropic位于旧金山SoMa的办公室、OpenAI的Mission Bay总部,以及xAI在帕罗奥图(Palo Alto)的据点。5月18日,设备又送至圣塔克拉拉(Santa Clara)的Oracle AI Customer Excellence Center。
Anthropic计算负责人James Bradbury表示,扩充算力是模型成长的重要加速器;OpenAI的计算基础设施负责人萨钦·卡蒂(Sachin Katti)则在现场查看了Vera CPU的内部结构。xAI创始人马斯克(Elon Musk)亲自听取了关于核心数、内存配置与散热设计的说明,并评估将其用于强化学习与代理式模拟流程。
Oracle Cloud Infrastructure主管Karan Batta透露,公司计划从今年起部署数十万颗Vera CPU,以满足代理式AI在大规模场景下持续高性能的需求。英伟达指出,OCI是首家在超大规模(hyperscale)部署Vera的云服务商,这将为企业客户提供更接近生产级的代理式AI基础设施。