情报
AI 生成的结构化厂商动态简报
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
中国LineShine超算登顶TOP500:纯CPU架构突破2 ExaFLOPS,ARMv9+HBM成新范式
LineShine超级计算机基于13.79百万个ARMv9核心、20480节点,实现2.198 ExaFLOPS FP64持续性能,成为全球首个突破2 ExaFLOPS的系统。它完全依赖CPU(无GPU加速),每个节点配备双LX2 CPU(304核)和32GB HBM,展示了CPU+HBM架构在HPC领域的潜力。
Nokia, Amazon Web Services expand collaboration to deliver autonomous networks built for the AI era
...
微软推出Azure Copilot可观测性代理,将运维控制点锁定在自家平台
微软宣布Azure Copilot可观测性代理正式商用,基于Azure Monitor构建,可跨代理、应用、基础设施和服务关联信号,提供统一运维视图。此举旨在将AI驱动的故障诊断与修复工作流深度绑定在Azure生态内。
NVIDIA发布45°C高温液冷系统,Rubin芯片承诺减少100%水耗
NVIDIA为Rubin GPU推出高温液冷系统,冷却液温度45°C(高于热水浴缸),利用室外干冷却器实现闭环运行,宣称可减少电耗并消除水蒸发(水耗减少100%)。但系统在炎热气候下仍需冷水机组备用,且电力来源和芯片寿命影响未明确。
NVIDIA发布Agent Toolkit:以Nemotron模型和OpenShell运行时构建专用AI Agent生态
NVIDIA推出Agent Toolkit,包含Nemotron开源模型、NemoClaw安全蓝图和OpenShell运行时,为企业构建可定制、安全、低成本的专用AI Agent提供开放模块化基础。该工具包已应用于生命科学、网络安全、工业等领域,旨在将通用模型转化为领域专属的数字同事。
Arm服务器市占突破45%:NVIDIA捆绑策略重塑AI基础设施架构
IDC数据显示,基于Arm架构的服务器已占据全球服务器市场超45%份额,主要驱动力来自NVIDIA将其Arm架构Vera CPU与NVL72、Rubin等GPU系统捆绑销售。x86阵营份额萎缩至52%,而加速系统贡献了70%以上营收。ODM直销占比50.2%,戴尔营收同比增长244.1%。
美光与Anthropic合作:用稀缺叙事锁定AI内存需求,但股价已透支预期
美光与Anthropic签署长期供应合同,涵盖HBM、DRAM和SSD全产品线,并联合分析AI工作负载的内存子系统。同时,美光参与Anthropic H轮融资。此举旨在将内存从商品转化为AI基础设施资产,但股价已大幅上涨,市场需验证稀缺溢价能否持续。
NVIDIA全栈统治超算TOP500:Grace CPU与InfiniBand锁定AI基础设施生态
NVIDIA宣布其技术驱动了81%的TOP500超算,其中Grace CPU部署增至26台,Quantum InfiniBand连接376台。全栈策略(GPU+CPU+网络)正在将超算采购从开放组件转向单一供应商锁定,Green500前八名均使用NVIDIA GPU。
AMD MI430X以200+ TFLOPS原生FP64性能,重新定义HPC与AI融合算力基线
AMD在TOP500榜单中驱动4台前十超算,并预览MI430X GPU,承诺超过200 TFLOPS原生FP64性能。此举直接针对AI for Science场景,将双精度计算作为下一代HPC与AI融合基础设施的核心指标,对NVIDIA和Intel形成直接竞争压力。
NVIDIA借AI代理与数字孪生重塑电信网络控制平面
NVIDIA在DTW Ignite 2026展示其AI代理平台,集成NeMo合成数据、NemoClaw安全运行时、OpenShell沙箱及RTX PRO 6000加速的数字孪生,旨在实现电信网络自主运营。合作伙伴包括SoftBank、Amdocs、NTT DATA等,共同推动从任务自动化向自主网络转型。
AWS Lambda推出MicroVMs:用Firecracker快照打破无服务器有状态隔离困局
AWS发布Lambda MicroVMs,基于Firecracker提供虚拟机级隔离、近即时启动/恢复、有状态执行。用户通过Dockerfile和S3构建镜像,从快照启动,支持自动挂起/恢复,适合多租户AI代码执行、交互式分析等场景。
Arm服务器收入占比超45%,AI驱动下x86生态面临重构
IDC数据显示,2026年Q1全球服务器市场收入创纪录达1226亿美元,其中Arm架构服务器收入占比超过45%,x86降至52%。加速服务器(GPU/ASIC/FPGA)贡献超70%收入。Nvidia Grace CPU(NVL72)及超大规模厂商自研Arm芯片是主要驱动力,x86在出货量上仍占优但受供应限制。
ASML CEO认可马斯克Terafab可行性,AI芯片供应链面临生态重构
ASML CEO公开表示正在跟踪马斯克计划中的太瓦级AI超级计算机Terafab,并将其与韩国DRAM巨型项目类比。这标志着全球唯一EUV光刻机供应商已为该巨型项目预留产能,可能彻底改变AI芯片的垂直整合与供应链格局。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
英特尔Computex 2026:以CPU编排Agentic AI,x86重夺推理控制权
英特尔在Computex 2026发布基于18A制程的288核至强6+处理器与第三代酷睿Ultra,强调Agentic AI工作负载使CPU:GPU配比从1:8跃升至1:1,并联合SambaNova、富士康推出机架级推理系统,试图将CPU重新定义为AI推理的编排核心。
美光与Anthropic战略合作:内存与AI模型深度绑定,重构供应链生态
美光与Anthropic达成战略协议,涵盖AI内存/存储架构联合设计、长期供应合同、内部采用Claude以及H轮投资。此举将前沿AI模型需求直接映射到基础设施设计,旨在优化token经济学与能效,但实质是供应锁定与生态重构。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
Cloudflare AI网关2.0:边缘控制平面夺取AI推理路由与安全主导权
Cloudflare推出AI Gateway 2.0,通过智能路由跨越50+模型提供商,宣称降低成本30%;同时推出Workers AI边缘推理(延迟<10ms),与NVIDIA合作部署GPU加速服务,并扩展AI防火墙。此举将AI流量控制平面从云巨头转移至边缘网络。