情报
AI 生成的结构化厂商动态简报
华为昇腾950DT芯片计划8月发布,算力翻倍且原生支持FP8
华为宣布将于8月推出下一代AI芯片昇腾950DT,相比前代算力翻倍,原生支持FP8低精度计算,并显著提升内存带宽和芯片间互联性能。华为云已在贵州、芜湖、内蒙古等地构建大规模AI集群,超过10万颗昇腾加速器用于自动驾驶模型训练,旨在构建替代NVIDIA的自主AI生态系统。
DeepSeek联手华为:Ascend 950对标GB200,自研Tile Language破CUDA垄断
DeepSeek创始人梁文锋宣称一年内中国将摆脱NVIDIA,华为Ascend 950超节点性能对标GB200/GB300。DeepSeek自研推理芯片及Tile Language编程语言以减少对CUDA依赖,标志着中国AI产业从国产替代向自主技术体系演进的关键转折。
NVIDIA Vera Rubin NVL72量产交付,能效比10倍跃迁改写AI算力基础设施规则
NVIDIA宣布Vera Rubin NVL72平台全面量产,首批交付CoreWeave、Microsoft、Amazon、Oracle等云厂商。每机架集成72颗Rubin GPU和36颗Vera CPU,在Agent AI工作负载上每单位能耗吞吐量较Blackwell提升10倍,推理成本降低10倍,标志着AI算力进入系统级集成的新阶段。
美批准NVIDIA H200对华出口并征25%税,AI芯片分级市场成型
美国商务部批准NVIDIA向中国出口H200 AI芯片,但征收25%销售税,同时维持Blackwell系列禁运。此举标志着AI芯片地缘分级市场正式形成,H200成为中国市场可获得的最高性能进口AI芯片,但性能代差和税负将显著增加中国AI基础设施的部署成本与复杂度。
AMD发布Zen 6 Venice与MI455X,Helios机架级设计挑战NVIDIA
AMD在Advancing AI 2026大会发布基于TSMC 2nm的Zen 6 EPYC Venice(最高256核)和CDNA5架构MI455X(432GB HBM4,40 PFLOPS FP4),推出Helios机架级参考设计(单rack 2.9 exaFLOPS FP4),宣称四年AI性能提升1000倍,获Meta、OpenAI等大客户长期合同。
华为昇腾950超节点亮相WAIC 2026,单柜64卡支持8192卡高速互联
...
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
华为昇腾950超节点:自研HCCS互联打造AI算力自主生态
华为在WAIC展示昇腾950超节点,集成32颗自研昇腾950 AI处理器,通过自研HCCS高速互联实现芯片间超低延迟通信,算力密度较上一代提升2.5倍,支持万亿参数模型训练,旨在提供不依赖海外供应链的AI算力选择。
华为WAIC亮出昇腾950超节点:1024卡共享256TB内存,AI算力走向系统级统一
华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),基于昇腾950DT芯片,单柜64卡,单系统支持1024卡高速互联,实现256TB统一内存编址,专为万亿参数大模型训练与Agentic AI推理设计,标志着AI基础设施从芯片堆叠转向系统级统一架构。
华为Atlas 950 SuperPoD与灵衢2.0:中国AI算力生态从单卡到集群的系统级重构
华为在WAIC 2026首次公开展示Atlas 950 SuperPoD真机,采用1024张昇腾NPU卡,并发布“灵衢2.0”高速互联协议。该产品标志着中国AI基础设施从单卡追赶转向集群系统级领先,通过开放协议构建国产AI算力生态闭环,直接对标NVIDIA NVL系列。
华为昇腾950超节点真机首秀:1024卡统一内存编址,系统级算力成竞争新标尺
华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),单柜集成1024张NPU,实现256TB统一内存编址和3微秒级时延。通过系统级架构创新弥补先进制程受限,集群可扩展至50万卡,瞄准十万亿参数大模型训练,标志着算力竞争从单卡转向系统有效算力。
NVIDIA+Nokia联盟打破RAN生态:GPU加速AI RAN 2027年商用
NVIDIA与Nokia联合开发AI RAN技术,利用NVIDIA GPU加速基带处理,通过AI优化波束赋形和频谱管理,目标2028年频谱效率翻倍。该合作标志着电信RAN从专用硬件向GPU通用计算和AI软件定义的重大转型,预计2027年商用部署。
华为昇腾万卡集群上线韶关,灵衢协议统一池化引领国产AI算力
华为在粤港澳大湾区韶关上线昇腾万卡智算集群,部署超万张昇腾AI加速卡。同时发布Atlas 950 SuperPoD,采用自研灵衢(UnifiedBus)互联协议,支持8192张NPU卡互联,带宽16.3 PB/s。华为云入选Gartner 2026云AI基础设施领导者象限,进一步强化国产算力生态布局。
华为联合湖北移动验证AI推理加速:外置存储KV Cache提升吞吐372%
华为与湖北移动完成全国首个运营商AI推理加速方案现网测试,基于OceanStor A800存储与昇腾A3超节点,通过UCM技术将KV Cache外置至PB级存储,实现长序列推理TPS最高提升372%。该方案针对GLM-5.1和MiniMax M2.5模型在8K-190K序列场景验证。
华为韬定律:逻辑折叠绕开光刻限制,固定制程密度跃升55%
华为何庭波在ISCAS 2026提出韬定律,以特征时间常数tau为统一优化目标,替代传统几何缩放。核心技术逻辑折叠通过垂直堆叠有源层缩短关键路径,在固定制程(如N+2)下实现晶体管密度+55%、能效+41%的实测收益。麒麟2026首次突破3GHz,昇腾系列将引入逻辑折叠。该路线图预计到2031年等效1.4nm制程密度,从根本上挑战摩尔定律的物理极限。
华为与Linewell联合发布公共服务AI智能体解决方案
华为与Linewell合作推出基于盘古大模型和昇腾AI云服务的公共服务AI智能体解决方案,集成智能问答、多轮对话和任务自动化能力,实现从咨询到办理的全流程政务自动化。
华为发布AI教育中心解决方案聚焦基础教育市场
华为推出面向基础教育领域的AI教育中心解决方案,整合教学平台、实训室和体验中心三大模块。方案采用昇腾AI硬件与自研软硬件平台,提供全栈式AI教学与实践支持。该方案主要针对教育资源分散和实践环境缺乏的痛点。
华为发布AI数据平台采用存算分离架构
华为发布专为AI工作负载设计的数据平台,采用存算分离架构提升数据流动效率。平台集成高性能文件系统支持EB级数据,内置加速引擎可缩短AI训练数据准备时间30%。提供统一数据管理视图,无缝对接主流AI框架和昇腾计算硬件。
华为发布矿山冶金行业数字化解决方案,强化垂直行业战略
华为推出针对矿山与冶金行业的数字化解决方案,集成5G专网、F5G全光工业网、AI算力和云边端协同架构。该方案通过行业定制化的ICT技术整合,旨在解决生产安全、效率瓶颈和自动化需求。
华为昇腾910C完成1.6万亿参数训练:国产算力首次突破MoE全流程
华为联合河套学院等机构,基于昇腾910C集群完成DeepSeek-V4-Pro(1.6万亿参数MoE架构)全参数后训练。核心数据:千卡集群稳定1500步,算力利用率30%,算子效率提升14%,全程无海外GPU依赖,标志着国产算力首次实现万亿级大模型完整训练闭环。