情报
AI 生成的结构化厂商动态简报
NVIDIA全栈统治超算TOP500:Grace CPU与InfiniBand锁定AI基础设施生态
NVIDIA宣布其技术驱动了81%的TOP500超算,其中Grace CPU部署增至26台,Quantum InfiniBand连接376台。全栈策略(GPU+CPU+网络)正在将超算采购从开放组件转向单一供应商锁定,Green500前八名均使用NVIDIA GPU。
AMD MI430X以200+ TFLOPS原生FP64性能,重新定义HPC与AI融合算力基线
AMD在TOP500榜单中驱动4台前十超算,并预览MI430X GPU,承诺超过200 TFLOPS原生FP64性能。此举直接针对AI for Science场景,将双精度计算作为下一代HPC与AI融合基础设施的核心指标,对NVIDIA和Intel形成直接竞争压力。
NVIDIA借AI代理与数字孪生重塑电信网络控制平面
NVIDIA在DTW Ignite 2026展示其AI代理平台,集成NeMo合成数据、NemoClaw安全运行时、OpenShell沙箱及RTX PRO 6000加速的数字孪生,旨在实现电信网络自主运营。合作伙伴包括SoftBank、Amdocs、NTT DATA等,共同推动从任务自动化向自主网络转型。
AWS Lambda推出MicroVMs:用Firecracker快照打破无服务器有状态隔离困局
AWS发布Lambda MicroVMs,基于Firecracker提供虚拟机级隔离、近即时启动/恢复、有状态执行。用户通过Dockerfile和S3构建镜像,从快照启动,支持自动挂起/恢复,适合多租户AI代码执行、交互式分析等场景。
Arm服务器收入占比超45%,AI驱动下x86生态面临重构
IDC数据显示,2026年Q1全球服务器市场收入创纪录达1226亿美元,其中Arm架构服务器收入占比超过45%,x86降至52%。加速服务器(GPU/ASIC/FPGA)贡献超70%收入。Nvidia Grace CPU(NVL72)及超大规模厂商自研Arm芯片是主要驱动力,x86在出货量上仍占优但受供应限制。
ASML CEO认可马斯克Terafab可行性,AI芯片供应链面临生态重构
ASML CEO公开表示正在跟踪马斯克计划中的太瓦级AI超级计算机Terafab,并将其与韩国DRAM巨型项目类比。这标志着全球唯一EUV光刻机供应商已为该巨型项目预留产能,可能彻底改变AI芯片的垂直整合与供应链格局。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
OpenAI GPT-5.6激进定价与150万上下文窗口,加速Agent化转型
OpenAI传闻发布GPT-5.6,上下文扩展至150万token,定价仅为Claude Fable 5的三分之一,并强化Agent可靠性。此举意在利用Anthropic被下线窗口期抢占市场,同时修复reward hacking事故。
英特尔Computex 2026:以CPU编排Agentic AI,x86重夺推理控制权
英特尔在Computex 2026发布基于18A制程的288核至强6+处理器与第三代酷睿Ultra,强调Agentic AI工作负载使CPU:GPU配比从1:8跃升至1:1,并联合SambaNova、富士康推出机架级推理系统,试图将CPU重新定义为AI推理的编排核心。
美光与Anthropic战略合作:内存与AI模型深度绑定,重构供应链生态
美光与Anthropic达成战略协议,涵盖AI内存/存储架构联合设计、长期供应合同、内部采用Claude以及H轮投资。此举将前沿AI模型需求直接映射到基础设施设计,旨在优化token经济学与能效,但实质是供应锁定与生态重构。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
Cloudflare AI网关2.0:边缘控制平面夺取AI推理路由与安全主导权
Cloudflare推出AI Gateway 2.0,通过智能路由跨越50+模型提供商,宣称降低成本30%;同时推出Workers AI边缘推理(延迟<10ms),与NVIDIA合作部署GPU加速服务,并扩展AI防火墙。此举将AI流量控制平面从云巨头转移至边缘网络。
HPE ProLiant DL394 Gen12搭载NVIDIA Vera CPU,AI计算架构迎来ARM颠覆
HPE在Computex 2026展示基于NVIDIA Vera CPU的ProLiant DL394 Gen12服务器,2026年秋上市。Vera为NVIDIA首款数据中心CPU,百万级量产,AI性能较x86提升1.8倍。首批客户包括OpenAI、Anthropic、xAI等。HPE继续推进GreenLake即服务战略,同时保留Intel至强6+选项。
Arm自研AGI CPU联合Meta,生态位从授权商转向芯片供应商
Arm发布首款自研数据中心CPU——136核、3纳米AGI CPU,专为AI推理设计,Meta作为联合开发者将全面部署。该芯片基于Neoverse V3平台,声称比x86机架性能高2倍,降低数据中心AI资本支出。Arm生态从IP授权转向直接芯片销售,重新定义与超大规模客户的协作模式。
Apple打破封闭:Private Cloud Compute扩展至Google Cloud,采用NVIDIA机密GPU
Apple在WWDC 2026宣布将其Private Cloud Compute(PCC)扩展至Google Cloud,利用NVIDIA GPU的Confidential Computing能力进行安全AI推理。这标志着Apple AI基础设施从自有数据中心向第三方云的策略性转变,同时M6 Neural Engine性能提升。
NVIDIA发布Arm CPU颠覆x86:RTX Spark与Vera重塑AI计算控制权
NVIDIA在Computex发布面向PC的RTX Spark超级芯片(20核Arm+6144 CUDA+128GB LPDDR5X)和百万级量产的数据中心CPU Vera,专为AI负载设计,性能是x86的1.8倍。此举标志NVIDIA从GPU巨头正式跨入CPU领域,通过统一Arm+GPU架构争夺AI计算控制权。
Google发布第八代TPU:训练性能3倍跃升,推理SRAM暴增3倍,锁定AI算力新拐点
Google Cloud Next 2026推出第八代TPU,分为训练专用TPU 8t(单Pod 9600颗,2PB共享内存)和推理专用TPU 8i(1152颗,片上SRAM增3倍)。同时发布Gemini Enterprise Agent Platform,整合AI代理构建、治理与安全,并推出N4 Axion ARM实例(性价比2倍于x86)。
Google发布Antigravity 2.0,用AI智能体取代传统IDE并强制迁移
Google发布Antigravity 2.0,包含桌面应用、CLI、SDK和Managed Agents API,强制关闭Gemini CLI并迁移到Antigravity CLI。同时推出Gemini Spark个人AI智能体运行在Google Cloud专用VM上,通过MCP连接第三方工具。此举将编码辅助从编辑器功能升级为软件劳动操作系统。
Arm自研AGI CPU需求翻倍,直指AI推理控制权争夺,x86阵营面临架构级威胁
Arm将其首款自研数据中心CPU——AGI CPU的需求预期翻倍,预计2027-2028财年收入超20亿美元。该芯片基于136核Neoverse V3平台,采用3nm工艺,专为智能体AI推理设计,声称每机架性能比x86高2倍以上。Meta为主要合作客户,OpenAI、Cloudflare等已确认采用。这标志着ARM从IP授权商向直接芯片供应商的战略转折。