智算多多
官方邮箱:sw@zsdodo.com

公司地址:北京市丰台区南四环西路188号总部基地三区国联股份数字经济总部(邮 编:100070)


京公网安备11010602202532号 在刚刚结束的华为中国合作伙伴大会2026上,华为重磅发布并展出了搭载全新昇腾950PR®(Ascend 950PR)处理器的AI训练推理加速卡Atlas 350。
昆仑、华鲲振宇、神州鲲泰、长江计算、宝德、软通华方、百信7家华为核心伙伴在会上发布了基于Atlas 350的服务器整机产品,标志着昇腾950代际推理算力正式进入商用阶段。
科大讯飞集团副总裁、星火企业军团总裁刘江在会上表示,讯飞新一代星火大模型也将与昇腾910/950系列算力底座进行充分适配,为用户提供“懂行业、能干活、守规矩、会进化”的整体AI解决方案。
算力的基础是芯片,昇腾芯片是华为AI算力战略的基础。华为2018年发布的昇腾310芯片,是昇腾系列芯片首款产品。2019年,华为发布昇腾910芯片;2025年,昇腾910C芯片随着Atlas900超节点规模部署,昇腾芯片逐渐为外界所熟悉。
去年9月,华为副董事长、轮值董事长徐直军在华为全联接大会2025上首次介绍了昇腾950系列芯片,并官宣了昇腾950系列芯片的发布时间——昇腾950PR将在2026年第一季度推出,首先支持的产品形态是标卡和超节点服务器。
在本次华为中国合作伙伴大会上,昇腾950PR随标卡Atlas 350如约亮相,受到业界的广泛关注。
与前一代昇腾芯片相比,昇腾950PR在低精度数据格式、向量算力、互联带宽及自研HBM®等方面实现大幅提升。
据华为昇腾计算业务总裁张迪煊介绍,Atlas 350的单卡算力达到了英伟达H20的2.87倍,是目前国内唯一支持FP4低精度的推理产品;HBM(高带宽内存)容量是H20的1.16倍,达到了112GB,多模态生成速度可以提升60%;内存访问颗粒度从512字节减少到128字节,小算子访存效率提升4倍。
展台工作人员告诉记者,Atlas 350除了支持FP16、FP8外,还支持更低精度的FP4。这意味着,集成Atlas 350板块的服务器能够支持更大的模型以及时延更低的推理,精度小了,计算速度就会更快,寄存器效率也会更高。目前Atlas 350在互联网推荐场景的实测数据显示,该卡的时延更低、响应更快,特别适合短视频、电商、广告推荐等高并发场景。在大模型推理、文生图、文生视频等多模态场景,其性能也和英伟达的L20相当。
张迪煊表示,基于Atlas 350等产品,结合AI发展趋势与客户需求,昇腾将打造大、中、小三大核心算力场景,助力伙伴满足差异化场景需求,共同深耕行业智能化。
会上,昇腾联合20家行业头部伙伴,发布了2026昇腾AI应用场景解决方案,覆盖辅助办公、AI实训、电子病历、智能客服、政务办公等多个行业核心场景,以“轻量部署、快速落地、可规模复制”的特点,破解行业智能化部署复杂、周期长的痛点。
此外,“养虾”热潮再度激起了一体机的需求,华为副总裁、ICT产品组合管理与解决方案部总裁马海旭在会上透露,过去一个多月已有十几家合作伙伴推出了基于昇腾的OpenClaw一体机。截至目前,昇腾已联合伙伴打造400多款行业一体机,服务客户逾2700家,占据国内一体机市场80%以上份额。
