情报
AI 生成的结构化厂商动态简报
AMD Helios投产:12层HBM4容量制胜,开放UALoE挑战NVLink封闭生态
AMD第二代Helios机架AI服务器全面投产,搭载72张MI455X GPU和Samsung独家12层HBM4内存,单机柜31TB。相比NVIDIA Rubin 8层设计,容量提升50%,成本降低30%。微软Azure规模部署,标志Hyperscaler双供应商策略落地。
Databricks全面Azure化并采用Cobalt 200 ARM,Microsoft锁定AI Agent控制平面
Databricks将全面迁移至Azure,采用Microsoft Cobalt 200 ARM芯片处理数据与AI工作负载,同时深度集成Genie和Unity AI Gateway至Microsoft产品线,形成长期锁定。Databricks完成188亿美元估值融资。
Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛
Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。
AMD Helios机架全栈出击,以开放网络UALoE挑战NVIDIA NVLink生态锁死
AMD在Advancing AI 2026发布Helios机架级方案,集成72颗MI455X GPU、18颗Venice EPYC CPU及Pensando网络,推理token/$比NVIDIA NVL72高30%,并推出UALoE开放标准。与Cerebras、Cisco等合作,构建全栈AI基础设施对抗NVIDIA。
AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink
AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。
HPE扩展Private Cloud AI产品线,集成NVIDIA Vera Rubin NVL72平台
...
NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍
NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。
ARM自产AGI CPU登顶超算,性能功耗比3倍于x86改写HPC格局
ARM在ISC 2026宣布,基于Armv9的LineShine超算以超2 exaflops性能登顶TOP500。同时发布自研AGI CPU(136个Neoverse V3核心)专为千兆瓦级AI数据中心,Neoverse系统在Green500包揽前四,性能功耗比达x86的3倍。
华为WAIC亮出昇腾950超节点:1024卡共享256TB内存,AI算力走向系统级统一
华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),基于昇腾950DT芯片,单柜64卡,单系统支持1024卡高速互联,实现256TB统一内存编址,专为万亿参数大模型训练与Agentic AI推理设计,标志着AI基础设施从芯片堆叠转向系统级统一架构。
Google BigQuery深度集成Gemini Enterprise,重塑AI治理控制权
Google Cloud推出方案,将Gemini Enterprise应用的遥测数据(用户提示、模型响应、活动日志)实时路由到BigQuery。利用BigQuery的AI分析能力(Conversational Analytics、自动Schema生成),实现大规模AI部署的自动化审计、合规治理和业务洞察,强化数据驱动的AI可观测性。
Microsoft发布Agent Framework Go SDK,与Google争夺Go开发者生态
2026年7月,Microsoft发布Agent Framework的Go SDK公开预览版,支持MCP和多Agent协调。此举使Microsoft与Google成为仅有的两家为Go语言提供原生Agent框架的一线云厂商,而OpenAI和Anthropic仍仅支持Python,面临开发者生态流失风险。
NVIDIA发布Rigel CPU核心:单线程性能成Agentic AI新控制点
NVIDIA首次披露Rosa CPU架构,采用自研Rigel核心(Arm v9.2),专为Agentic AI工作负载优化单线程性能,配套Feynman GPU(1.6nm,50 PFLOPS)于2028年推出。该战略将CPU从核心数量竞赛转向串行延迟优化,直接威胁AMD EPYC和Intel至强数据中心基本盘。
NVIDIA发布Vera CPU:以最大单线程性能重构AI Agent生态
NVIDIA推出Vera CPU,专为AI Agent工作负载设计,采用Olympus核心,提供比x86高1.8倍的持续每核心性能。该CPU与NVIDIA GPU和BlueField统一架构,旨在构建AI工厂的统一计算平台,挑战现有x86 CPU生态。
AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters
...
华为MWC上海2026力推Token计费:从字节管道转向AI价值交付,运营商需重构网络架构
华为在MWC上海2026提出运营商应从基于字节的计费转向基于AI Token的计费,并展示了AI推理加速方案,将长序列推理吞吐量提升372%。同时强调U6 GHz频段对AI可穿戴设备上行链路的关键作用,推动5G-A网络成为AI计算交付基础设施。
Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式
Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。
高通发布Dragonfly数据中心CPU与HBC内存,以推理优先架构挑战NVIDIA霸权
高通在投资者日公布完整数据中心路线图,包括250核Oryon CPU(Dragonfly C1000)、近内存计算HBC(声称133TB/s带宽)、AI300推理加速器(54x带宽提升),以及800G/1.6T互联。与Meta签署多年CPU供应协议,2028年商用,旨在以低功耗高带宽颠覆AI推理市场。
OpenAI联手Broadcom推出Jalapeno推理芯片,重塑AI硬件生态
OpenAI与Broadcom合作开发了名为Jalapeno的LLM推理加速芯片,采用多芯片模块、HBM3E内存,9个月完成流片。该芯片专为OpenAI模型栈优化,旨在降低推理成本并减少对NVIDIA GPU的依赖,计划2026年底部署。
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
Nokia, Amazon Web Services expand collaboration to deliver autonomous networks built for the AI era
...