据华为官方消息,昇腾950PR处理器已正式发布,并搭载于Atlas 350 AI加速卡中。在2026年华为中国合作伙伴大会上,华为展示了这款芯片的性能亮点。数据显示,Atlas 350单卡算力最高可达NVIDIA H20的约2.87倍,尤其在FP4低精度推理场景中表现出色。
昇腾950PR是华为按计划于2026年第一季度推出的核心AI芯片,采用SIMD架构设计。在FP8和FP4精度下,其算力分别可达1PFLOPS和2PFLOPS,同时支持FP32、BF16等多种数据格式。存储器配置方面,该芯片搭载128GB容量,带宽达1.6TB/s,互联带宽为2TB/s,较前代产品在低精度运算、互联效率及存储器存取能力上均有显著提升。
华为表示,Atlas 350在FP4精度下可提供1.56PFLOPS算力,带宽达1.4TB/s,但功耗提升至600W,约为H20的1.5倍。通过FP4低精度运算,模型对显存的需求大幅降低,例如70B参数模型可在单卡运行,显著减少推理延迟并提高吞吐效率,适用于推荐系统、短视频及电商广告等场景。
从市场定位来看,昇腾950PR主要面向推理与Prefill场景,并采用华为自研HBM(HiBL 1.0)技术以降低成本。相较于高端HBM3e/4e方案,其价格更具优势。在多模态生成任务中,其性能已接近国际竞品水平,表明国产AI芯片在特定应用场景中逐步缩小与国际竞争对手的差距。
生态合作方面,华为携手昆仑、华鲲振宇、神州鲲泰、宝德及软通动力等七家合作伙伴,同步推出搭载Atlas 350的整机产品。其中,软通动力推出的A860 A5 AI服务器支持8张Atlas 350卡,瞄准大模型训练与推理市场。此外,科大讯飞也宣布其新一代星火大模型将全面适配昇腾910与950系列算力底座。
华为在2026年中国合作伙伴大会上联合逾20家伙伴发布了AI应用方案,覆盖政务、医疗、客服及企业办公等场景,主打“轻量部署、快速落地”。随着开源AI Agent项目OpenClaw推动“一体机”需求增长,华为透露已与合作伙伴打造超过400款AI一体机,服务超过2700家企业客户。
昇腾950系列于2025年全联接大会首次公开,分为950PR(推理)与950DT(训练)两大版本。其中,950PR已于2026年第一季度完成发布并导入Atlas 350商用产品。而定位训练场景的950DT预计将在2026年下半年至2027年间逐步落地,搭配Atlas 950超节点架构,支持最高8192卡规模的集群部署,对标NVIDIA大型算力系统。
在美国高端AI芯片出口限制持续的背景下,华为通过昇腾950系列加速填补国内AI算力缺口。尽管在高精度训练与能效表现上仍与国际领先产品存在差距,但凭借FP4低精度路线及上下游垂直整合,华为已在推理市场逐步建立差异化竞争力。