情报
AI 生成的结构化厂商动态简报
NVIDIA Vera Rubin NVL72量产交付,能效比10倍跃迁改写AI算力基础设施规则
NVIDIA宣布Vera Rubin NVL72平台全面量产,首批交付CoreWeave、Microsoft、Amazon、Oracle等云厂商。每机架集成72颗Rubin GPU和36颗Vera CPU,在Agent AI工作负载上每单位能耗吞吐量较Blackwell提升10倍,推理成本降低10倍,标志着AI算力进入系统级集成的新阶段。
美批准NVIDIA H200对华出口并征25%税,AI芯片分级市场成型
美国商务部批准NVIDIA向中国出口H200 AI芯片,但征收25%销售税,同时维持Blackwell系列禁运。此举标志着AI芯片地缘分级市场正式形成,H200成为中国市场可获得的最高性能进口AI芯片,但性能代差和税负将显著增加中国AI基础设施的部署成本与复杂度。
华为昇腾950超节点亮相WAIC 2026,单柜64卡支持8192卡高速互联
...
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
华为昇腾950超节点:自研HCCS互联打造AI算力自主生态
华为在WAIC展示昇腾950超节点,集成32颗自研昇腾950 AI处理器,通过自研HCCS高速互联实现芯片间超低延迟通信,算力密度较上一代提升2.5倍,支持万亿参数模型训练,旨在提供不依赖海外供应链的AI算力选择。
华为WAIC亮出昇腾950超节点:1024卡共享256TB内存,AI算力走向系统级统一
华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),基于昇腾950DT芯片,单柜64卡,单系统支持1024卡高速互联,实现256TB统一内存编址,专为万亿参数大模型训练与Agentic AI推理设计,标志着AI基础设施从芯片堆叠转向系统级统一架构。
华为Atlas 950 SuperPoD与灵衢2.0:中国AI算力生态从单卡到集群的系统级重构
华为在WAIC 2026首次公开展示Atlas 950 SuperPoD真机,采用1024张昇腾NPU卡,并发布“灵衢2.0”高速互联协议。该产品标志着中国AI基础设施从单卡追赶转向集群系统级领先,通过开放协议构建国产AI算力生态闭环,直接对标NVIDIA NVL系列。
华为昇腾910C完成1.6万亿参数训练:国产算力首次突破MoE全流程
华为联合河套学院等机构,基于昇腾910C集群完成DeepSeek-V4-Pro(1.6万亿参数MoE架构)全参数后训练。核心数据:千卡集群稳定1500步,算力利用率30%,算子效率提升14%,全程无海外GPU依赖,标志着国产算力首次实现万亿级大模型完整训练闭环。