情报
AI 生成的结构化厂商动态简报
NVIDIA Vera Rubin全球部署:每兆瓦Token吞吐量10倍提升,锁定AI工厂标准
NVIDIA宣布Vera Rubin平台全面量产交付,CoreWeave等云厂商已部署NVL72系统。该平台采用Vera CPU和Rubin GPU,每兆瓦Token吞吐量较Blackwell提升10倍,支持千兆瓦级AI工厂,全球超350站点部署。
Microsoft Azure Updates: GenAI Telemetry Protection in Application Insights, DDoS Protection Custom Policy, IPv6 VPN Gateway GA
...
NVIDIA Rubin GPU:3nm双die 336B晶体管,HBM4与NVLink 6带宽翻倍
NVIDIA在SIGGRAPH 2026公布Rubin GPU完整规格:采用TSMC 3nm工艺双die封装,总计3360亿晶体管,配备288GB HBM4内存和22 TB/s带宽。NVLink 6提供3600 GB/s双向带宽,较上代翻倍。NVL72机架集成72颗Rubin GPU,功耗超1000W,需全液冷散热。
NVIDIA投资SSI 50亿美元,开放Vera Rubin平台锁定AI安全研究生态
NVIDIA对Ilya Sutskever创办的AI安全公司SSI进行重大股权投资,并开放下一代Vera Rubin GPU平台访问权限。合作超越硬件销售,NVIDIA获得SSI保密研究访问权,研究洞察将反馈至NVIDIA平台路线图,标志着NVIDIA从硬件供应商向深度研究合作伙伴的战略转变。
阿里云WAIC 2026发布Agent-Native全栈,开源SAIL软件栈挑战CUDA生态
阿里云在WAIC 2026发布Agent-Native云套件(AgentLoop/AgentTeams/AgentRun/TokenWorks),开源T-Head SAIL AI软件栈,推出2.4T参数模型Qwen 3.8-Max-Preview及Zhenwu M890超节点,全面布局Agent-Native云与开源AI生态,意图构建从硬件到平台的全栈竞争力。
微软Azure引入AMD Helios机架级平台,正式打破NVIDIA AI GPU垄断格局
微软Azure宣布将在2026下半年部署AMD Helios机架级AI平台。该平台集成72颗MI455X GPU、18颗Venice CPU及液冷系统,单机架提供2.9 Exaflops FP4推理算力。此举标志着全球第二大云厂商正式摆脱对NVIDIA单一GPU供应商的依赖,开启AI基础设施多架构时代。
Anthropic Claude Opus 5登陆AWS Bedrock,0%注入率挑战OpenAI安全论断
Anthropic发布Claude Opus 5,在AWS Bedrock四个区域GA,同时上线Claude Platform。Auto Mode在129个浏览器代理测试中实现0% prompt injection,反驳OpenAI'无法解决'论。定价$5/$25 per M token,性能领先,半价对标Fable 5。
OpenAI 200亿美元自建数据中心:AI算力从租赁走向自有控制
OpenAI宣布在佐治亚州启动Project Camellia,投资200亿美元建设3.2GW自建数据中心,从依赖云算力转向自主控制。同时从xAI挖来Colossus核心团队,算力CTO晋升,算力支出预期上调至7500亿美元。
AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink
AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。
微软Azure部署AMD Helios机架平台,推出三款AI/HPC虚拟机
微软Azure确认部署AMD Helios机架级AI平台,每机架配备72颗Instinct MI455X GPU、31TB HBM4内存及1.4PB/s聚合带宽。同时推出面向AI推理、数据工程和HPC的三款新VM,采用第六代EPYC Venice CPU和Pensando DPU。
AMD反向投资Anthropic 50亿美元,绑定2GW MI450部署,重构AI算力生态
AMD与Anthropic达成战略合作,Anthropic将部署最多2GW AMD Instinct MI450系列GPU,AMD反向投资$50亿。双方将联合优化ROCm软件栈,并利用Claude优化Instinct负载。此举标志着AMD从芯片供应商升级为AI生态投资者,加速AI算力多元化,直接挑战NVIDIA的垄断地位。
AMD发布Zen 6 Venice与MI455X,Helios机架级设计挑战NVIDIA
AMD在Advancing AI 2026大会发布基于TSMC 2nm的Zen 6 EPYC Venice(最高256核)和CDNA5架构MI455X(432GB HBM4,40 PFLOPS FP4),推出Helios机架级参考设计(单rack 2.9 exaFLOPS FP4),宣称四年AI性能提升1000倍,获Meta、OpenAI等大客户长期合同。
NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍
NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。
Microsoft与Mistral合作打造欧洲主权AI基础设施,应对EU AI Act合规
Microsoft与Mistral扩展数十亿美元合作,Mistral引入数千张NVIDIA Vera Rubin GPU,其Medium 3.5和OCR 4模型集成到Microsoft Foundry和Copilot Studio,提供云端、连接和离线三种部署模式,专为欧洲受监管行业设计,满足EU AI Act合规要求。
微软战略投资Mistral AI,Azure Foundry集成其模型以锁定欧洲主权AI市场
微软与法国AI公司Mistral达成数十亿美元合作,投资其欧洲数据中心算力,并将Mistral的Medium 3.5和OCR 4模型集成至Azure Foundry平台。此举直接响应美国对Anthropic的出口管制,旨在为欧洲受监管行业提供替代美国控制基础设施的AI选项,标志着主权AI需求从政策呼吁转向实际部署。
微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态
微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。
英伟达Vera Rubin七芯片堆栈与Dynamo解耦,推高推理智能成本效率
英伟达发布Vera Rubin平台,包含七芯片堆栈(Vera CPU、Rubin GPU、NVLink 6等)和Dynamo 1.0推理解耦架构,将预填充与解码分离。单个NVL72机架集成72 GPU/36 CPU,提供1.6 PB/s带宽,推理性能提升7倍,并引入‘每美元智能’指标,标志AI算力从训练转向推理成本竞争。
微软Azure在华裁员200-400人,云增长下重组地缘合规布局
微软Azure尽管全球云业务增长40%,仍在中国裁员200-400人,并提供部分员工转移至加拿大。此举显示微软正在地缘政治敏感市场重新配置运营资源,将合规与风险控制移出中国,影响企业多云与数据主权策略。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。
微软Azure发布“Brain”AI系统:云可靠性控制平面从人工转向算法
微软Azure官方发布名为“Brain”的AI系统,用于监控、诊断并自动修复Azure基础设施故障。该系统已全面部署,通过整合遥测数据与AI模型,实现从被动响应到主动预测与自愈的范式转变,旨在提升SLA达标率并降低人工运维成本。