据华尔街日报(WSJ)和Wccftech综合报道,NVIDIA计划在2026年GTC大会上推出一款全新的AI推论芯片,该芯片整合了Groq的语言处理单元(LPU)技术。这一消息由NVIDIA CEO黄仁勋透露,外界猜测这款芯片可能是针对高效推论处理优化的新产品。法新社指出,新芯片已获得新创公司OpenAI的青睐,承诺采用3 GW的新推论运算能力,成为该平台的重要客户之一。
近年来,全球人工智能(AI)产业逐渐从大型语言模型(LLM)训练转向推论应用。NVIDIA通过Hopper、Blackwell以及即将推出的Rubin架构GPU,已在训练市场占据超过90%的份额。然而,随着企业对代理式AI(Agentic AI)、自动化编码和订阅型AI服务的广泛部署,算力需求正快速向推论端转移。传统GPU在成本和功耗上并非推论运算的最佳选择,因此开发专用架构成为行业趋势。
Groq的LPU架构以高效推论处理为核心,与NVIDIA现有的GPU逻辑存在显著差异。2025年底,NVIDIA以约200亿美元的价格取得Groq关键技术授权,并延揽其核心团队,进一步巩固其在推论领域的主导地位。这一战略布局显示出NVIDIA对AI算力竞赛新阶段的高度重视。
值得注意的是,OpenAI曾积极寻求NVIDIA芯片的替代方案,与Cerebras、Groq等新创公司洽谈推论合作。但最终仍选择与NVIDIA扩大合作,显示出对新一代混合运算架构的高度期待。据透露,OpenAI近期完成了由NVIDIA、软银(SoftBank)和亚马逊(Amazon)领衔的1100亿美元融资,并与亚马逊签署了Trainium芯片合作协议。这种多供应商算力布局策略不仅分散了供给风险,还确保了在不同工作负载场景下实现最佳效能与成本结构。
面对超微(AMD)、英特尔(Intel)以及Google、亚马逊、Meta Platforms等云端巨头的自研芯片挑战,NVIDIA的新平台具有防御与进攻的双重意义。一方面,它帮助NVIDIA保住OpenAI这样的大客户;另一方面,通过专用推论架构切入新市场,避免高端GPU在推论场景中被边缘化。
分析认为,未来数据中心将呈现“训练用高端GPU+推论专用处理器+CPU优化代理负载”的多层架构,这将为AI算力的进一步发展奠定基础。