智算多多
官方邮箱:sw@zsdodo.com

公司地址:北京市丰台区南四环西路188号总部基地三区国联股份数字经济总部(邮 编:100070)


京公网安备11010602202532号 在华为中国合作伙伴大会2026的人工智能伙伴峰会上,华为正式揭开了新一代AI算力芯片的神秘面纱,这款名为昇腾950PR(Ascend 950PR)的全新芯片重磅登场,同步推出的还有搭载该芯片的Atlas 350 AI训练推理加速卡,标志着国产高端AI推理算力正式迈入规模化商用的全新阶段,也为国产算力产业的自主可控发展注入了强劲动力。
作为华为AI算力战略的核心载体,昇腾系列芯片自2018年推出首款昇腾310芯片以来,不断迭代升级,2019年发布昇腾910芯片,2025年昇腾910C芯片随Atlas900超节点规模部署逐渐被业界熟知,而此次昇腾950PR的发布,更是华为在算力领域深耕多年的又一里程碑式成果,早在2025年9月的华为全联接大会上,华为轮值董事长徐直军就已公布昇腾950PR的规划,明确其将于2026年第一季度上市,如今如期亮相,不负行业期待。
昇腾950PR聚焦大模型推理Prefill阶段与推荐业务场景,同时兼顾训练辅助,采用中芯国际N+3工艺(等效5nm级)打造,通过四芯片合封方案实现高性能集成,芯片国产化率超90%,封装与核心组件基本实现国产供应链全覆盖,彻底摆脱了对海外技术的依赖,筑牢了国产算力的自主底座。
在核心性能上,这款芯片实现了全方位的跨越式提升,作为国内唯一支持原生FP4(MXFP4)商用推理的芯片,它同时兼容FP8、MXFP8等多种低精度数据格式,其中FP4算力达1.56P,FP8算力1PFLOPS,向量算力较前代昇腾910C提升2倍,更值得关注的是,搭载该芯片的Atlas 350单卡推理性能达到了英伟达H20的2.87倍,多模态生成速度提升60%,大幅超越了同类海外产品。
为了适配高端AI推理的需求,昇腾950PR搭载了华为自研的HiBL 1.0 HBM高带宽内存,标配128GB容量、1.6TB/s带宽,同时将内存访问粒度从512字节降至128字节,让小算子访存效率提升4倍,有效解决了推理场景中内存访问的痛点;片间互联带宽较前代提升2.5倍,达到2TB/s,支持灵衢2.0协议及多种通信模式,可实现4卡直连协同,为小型超节点构建与多卡算力池化提供了有力支撑。
在功耗控制方面,该芯片功耗控制在600W,适配液冷散热方案,在保证高性能的同时兼顾了优秀的能效比,有效降低了AI规模化部署的能耗成本。此外,昇腾950PR基于第三代DaVinciCore架构,兼容昇腾CANN异构计算架构与主流深度学习框架,支持训练推理一体,可独立部署或作为超节点服务器核心计算单元,兼容性与实用性大幅提升。
此次发布会上,昆仑、华鲲振宇、神州鲲泰等7家华为核心伙伴同步发布了基于Atlas 350的服务器整机产品,标志着昇腾950代际推理算力正式进入商用阶段,而昇腾950PR的应用场景也十分广泛,可高效适配大模型推理、文生图/视频、对话式AI等多模态场景,同时满足短视频、电商、广告等高并发智能推荐需求,在智慧城市、智能制造、政务数据处理等行业场景中也能发挥重要作用,显著降低AI规模化部署的成本与时延门槛。
据华为昇腾计算业务总裁张迪煊介绍,基于Atlas 350等产品,华为将打造大、中、小三大核心算力场景,助力伙伴满足差异化场景需求,共同深耕行业智能化,目前昇腾已联合20家行业头部伙伴,发布了2026昇腾AI应用场景解决方案,覆盖辅助办公、AI实训、电子病历等多个行业核心场景,破解行业智能化部署复杂、周期长的痛点。
昇腾950PR的正式发布,不仅是华为算力布局的重要一步,更是国产算力产业摆脱海外垄断、实现自主突围的关键突破,它补齐了国产低精度推理的关键短板,进一步强化了国产自主可控的算力底座,让国产算力首次跻身全球第一梯队。
据悉,华为并未停下迭代的脚步,后续还将推出面向高强度训练的昇腾950DT(预计2026年四季度)与Atlas 950超节点方案,构建覆盖从推理到训练的全栈算力体系,同时持续完善生态布局,联合更多合作伙伴打造多样化产品,推动算力技术与千行百业深度融合。从追赶到领跑,华为用持续的自主研发,改写了全球高端算力市场的格局,也为我国数字经济高质量发展、科技自立自强提供了坚实的算力支撑,未来,随着昇腾系列芯片的不断迭代和生态的持续完善,国产算力将迎来更广阔的发展空间,赋能更多行业实现智能化转型。
