情报
AI 生成的结构化厂商动态简报
NVIDIA员工涉B300芯片走私被查,出口管制执法首次触及原厂
台湾检方调查NVIDIA员工涉嫌伪造文件,协助将搭载**GB300**芯片的**Super Micro**服务器走私至中国大陆。7人被羁押,涉案价值约2100万美元。此案是出口管制执法首次直接涉及芯片原厂,标志合规风险向供应链上游转移。
DeepSeek联手华为:Ascend 950对标GB200,自研Tile Language破CUDA垄断
DeepSeek创始人梁文锋宣称一年内中国将摆脱NVIDIA,华为Ascend 950超节点性能对标GB200/GB300。DeepSeek自研推理芯片及Tile Language编程语言以减少对CUDA依赖,标志着中国AI产业从国产替代向自主技术体系演进的关键转折。
NVIDIA Vera Rubin NVL72量产交付,能效比10倍跃迁改写AI算力基础设施规则
NVIDIA宣布Vera Rubin NVL72平台全面量产,首批交付CoreWeave、Microsoft、Amazon、Oracle等云厂商。每机架集成72颗Rubin GPU和36颗Vera CPU,在Agent AI工作负载上每单位能耗吞吐量较Blackwell提升10倍,推理成本降低10倍,标志着AI算力进入系统级集成的新阶段。
NVIDIA联合纬创美国首产GB300,AI制造生态重心转移至德州
NVIDIA携手纬创在德州开设D1工厂,实现GB300 Grace Blackwell Ultra的L6级美国本土集成制造。该工厂投资7亿美元,首台系统含150万零件、重2吨、单价400万美元,并规划Vera Rubin量产。此举标志着美国AI Capex本土化率从5%向30%跃升的关键转折,重塑全球AI供应链格局。
美批准NVIDIA H200对华出口并征25%税,AI芯片分级市场成型
美国商务部批准NVIDIA向中国出口H200 AI芯片,但征收25%销售税,同时维持Blackwell系列禁运。此举标志着AI芯片地缘分级市场正式形成,H200成为中国市场可获得的最高性能进口AI芯片,但性能代差和税负将显著增加中国AI基础设施的部署成本与复杂度。
NVIDIA DGX GB300超级计算机在海军研究生院上线
...
NVIDIA千亿投资OpenAI共建10GW AI工厂,Vera Rubin平台深度绑定
NVIDIA与OpenAI签署战略合作,部署至少10GW基于Vera Rubin平台(Rubin GPU、Vera CPU、HBM4、NVLink 6)的AI算力设施,NVIDIA投资最多$1000亿。首批设施2026下半年上线,支撑OpenAI下一代模型训练推理,标志AI算力进入超GW时代。
AMD发布Zen 6 Venice与MI455X,Helios机架级设计挑战NVIDIA
AMD在Advancing AI 2026大会发布基于TSMC 2nm的Zen 6 EPYC Venice(最高256核)和CDNA5架构MI455X(432GB HBM4,40 PFLOPS FP4),推出Helios机架级参考设计(单rack 2.9 exaFLOPS FP4),宣称四年AI性能提升1000倍,获Meta、OpenAI等大客户长期合同。
NVIDIA公开Rubin GPU架构细节:3360亿晶体管,智能体AI性能较Blackwell提升10倍
...
NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍
NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。
NVIDIA美国制造启航:纬创工厂量产GB300与Vera Rubin,重构AI供应链
纬创在德克萨斯州沃斯堡开设首座美国制造工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该工厂投资7亿美元,计划月产数万块板,标志着NVIDIA供应链本土化的重大转折。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
NVIDIA推Agent Toolkit全栈锁定本地Agent,控制点从云端转向DGX Station
NVIDIA发布Agent Toolkit,包含NemoClaw、Nemotron 3 Ultra、Omniverse Libraries和OpenShell四大组件,使开发者可在DGX Station GB300上30分钟完成本地AI Agent部署。此举旨在将Agent开发生态锁定在NVIDIA硬件与软件栈,推动控制点从云服务向本地硬件转移。
测试来源:36氪
...
AMD与OpenAI达成6GW算力供应历史性协议 1.6亿认股权证可获10%股权 股价盘前涨35%
...
NVIDIA推AI计算合伙人计划:用信用兜底+收入分成锁定云厂商,转型算力央行
NVIDIA推出AI计算合伙人计划,通过收入分成与信用兜底机制,从硬件销售转向持续性服务收益。首批项目包括澳洲Sharon AI的4万张GB300芯片和印尼Firmus的17万张GPU,总规模二十万级高端芯片。NVIDIA正成为AI算力的“中央银行”,压缩云中间商空间。
Anthropic Claude独家登陆Azure,微软借GB300锁定AI模型分销权
Anthropic的Claude模型正式在Azure Foundry全面可用,基于NVIDIA GB300 NVL72集群(4600+ Blackwell Ultra GPU)。首批上线Opus 4.8和Haiku 4.5,支持提示缓存与扩展思考。微软获得独家企业分销渠道,强化对AWS/谷歌云的竞争地位。
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。