情报
AI 生成的结构化厂商动态简报
NVIDIA发布Agent Toolkit扩展Omniverse库,使AI代理具备物理仿真构建能力
NVIDIA在SIGGRAPH 2026发布Agent Toolkit扩展,新增Omniverse库作为软件组件,使AI代理能够构建和仿真3D世界。同时开源Cosmos 3 Edge(4B参数世界动作模型),完善从训练到边缘部署的物理AI生态。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
英伟达Vera Rubin七芯片堆栈与Dynamo解耦,推高推理智能成本效率
英伟达发布Vera Rubin平台,包含七芯片堆栈(Vera CPU、Rubin GPU、NVLink 6等)和Dynamo 1.0推理解耦架构,将预填充与解码分离。单个NVL72机架集成72 GPU/36 CPU,提供1.6 PB/s带宽,推理性能提升7倍,并引入‘每美元智能’指标,标志AI算力从训练转向推理成本竞争。
NVIDIA推AI计算合伙人计划:用信用兜底+收入分成锁定云厂商,转型算力央行
NVIDIA推出AI计算合伙人计划,通过收入分成与信用兜底机制,从硬件销售转向持续性服务收益。首批项目包括澳洲Sharon AI的4万张GB300芯片和印尼Firmus的17万张GPU,总规模二十万级高端芯片。NVIDIA正成为AI算力的“中央银行”,压缩云中间商空间。
Meta转向对外出售AI算力:为巨额CapEx购买保险,重构云市场生态
Meta正式搭建云计算业务,向外部客户出售AI算力,以对冲其1250-1450亿美元CapEx风险。通过采购AMD Instinct GPU、CoreWeave、Nebius等巨额合同,Meta意图将“赌输全赔”转为“赌输收租”,直接挑战AWS、Azure、GCP的AI云生态。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
HPE ProLiant DL394 Gen12搭载NVIDIA Vera CPU,AI计算架构迎来ARM颠覆
HPE在Computex 2026展示基于NVIDIA Vera CPU的ProLiant DL394 Gen12服务器,2026年秋上市。Vera为NVIDIA首款数据中心CPU,百万级量产,AI性能较x86提升1.8倍。首批客户包括OpenAI、Anthropic、xAI等。HPE继续推进GreenLake即服务战略,同时保留Intel至强6+选项。
NVIDIA发布Arm CPU颠覆x86:RTX Spark与Vera重塑AI计算控制权
NVIDIA在Computex发布面向PC的RTX Spark超级芯片(20核Arm+6144 CUDA+128GB LPDDR5X)和百万级量产的数据中心CPU Vera,专为AI负载设计,性能是x86的1.8倍。此举标志NVIDIA从GPU巨头正式跨入CPU领域,通过统一Arm+GPU架构争夺AI计算控制权。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。
NVIDIA推出Vera CPU:从GPU加速迈向AI Agent控制平面自主化
NVIDIA发布专为AI Agent设计的Vera CPU,基于88核Olympus架构,配备1.2TB/s LPDDR5X内存,声称比x86 CPU任务完成速度提升1.8倍。客户包括Anthropic、OpenAI等,意在将AI工作负载的控制平面从传统CPU转移到NVIDIA定制平台。
NVIDIA 借英国主权AI基金,从芯片商跃升为国家AI基础设施的幕后控制者
NVIDIA 与英国政府合作,通过 Isambard-AI(搭载 5,400 颗 GH200)及 Sovereign AI Fund,扶持本地初创(Cosine, Cursive, Doubleword)。此举表面是技术部署,实则是 NVIDIA 构建主权AI控制平面,将国家算力锁入其生态系统,削弱AWS/Azure等传统云厂商的地位。
NVIDIA Nemotron 3 Ultra:以MoE与MOPD重构AI Agent控制平面,锁定企业推理成本
NVIDIA发布**Nemotron 3 Ultra**,一个550B参数MoE模型(55B活跃),专为AI Agent编排而设计。通过**多教师在线策略蒸馏(MOPD)** 与**Hybrid Mamba-Transformer**架构,其在**SWE-bench**等任务中实现5倍吞吐量提升与30%成本节省,标志着推理控制权从单一模型向分层Agent系统的转移。
NVIDIA DSX OS:以开源软件夺取AI工厂控制平面,锁定生态
NVIDIA发布DSX OS,一套开源模块化软件,用于运营AI工厂。包含DSX Exchange、MaxLPS、NICo、NVSentinel等组件,统一IT/OT通信、电源优化、生命周期管理。声称可在固定功率下多运行40% GPU,但核心依赖NVIDIA专有硬件,旨在锁定用户至其生态。
NVIDIA三线并发:Vera CPU交付、N1X笔记本芯片与硅光子学投资,重构AI基础设施控制层
NVIDIA交付首款Agent专用Vera CPU(88核Arm v9.2, 1.2TB/s内存带宽),预告消费级N1X笔记本处理器,并累计投资65亿美元于硅光子学。此举将AI编排控制点从x86转向NVIDIA Arm生态,同时通过CPO技术解决内存墙问题,但量产挑战持续至2028年后。
英伟达推动AI基础设施评估指标从FLOPS转向每token成本
英伟达提出应将“每token成本”而非“每美元FLOPS”作为评估AI基础设施的核心经济指标。这标志着从衡量计算输入转向衡量商业输出,涉及硬件、软件、网络的全栈优化,以降低企业AI推理的总拥有成本。