情报
AI 生成的结构化厂商动态简报
Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛
Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。
OpenAI 200亿美元自建数据中心:AI算力从租赁走向自有控制
OpenAI宣布在佐治亚州启动Project Camellia,投资200亿美元建设3.2GW自建数据中心,从依赖云算力转向自主控制。同时从xAI挖来Colossus核心团队,算力CTO晋升,算力支出预期上调至7500亿美元。
AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink
AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。
微软发布自研MAI图像与语音模型,加速产品生态闭环
微软发布MAI-Image-2.5-Pro和MAI-Voice-2-Flash自研模型,已集成至Bing、PowerPoint、OneDrive、Dynamics 365等产品。声称在质量、延迟和成本上优于竞品,GPU成本最高降低89%,标志微软AI战略转向内部闭环。
微软Azure部署AMD Helios机架平台,推出三款AI/HPC虚拟机
微软Azure确认部署AMD Helios机架级AI平台,每机架配备72颗Instinct MI455X GPU、31TB HBM4内存及1.4PB/s聚合带宽。同时推出面向AI推理、数据工程和HPC的三款新VM,采用第六代EPYC Venice CPU和Pensando DPU。
AMD反向投资Anthropic 50亿美元,绑定2GW MI450部署,重构AI算力生态
AMD与Anthropic达成战略合作,Anthropic将部署最多2GW AMD Instinct MI450系列GPU,AMD反向投资$50亿。双方将联合优化ROCm软件栈,并利用Claude优化Instinct负载。此举标志着AMD从芯片供应商升级为AI生态投资者,加速AI算力多元化,直接挑战NVIDIA的垄断地位。
AMD发布Zen 6 Venice与MI455X,Helios机架级设计挑战NVIDIA
AMD在Advancing AI 2026大会发布基于TSMC 2nm的Zen 6 EPYC Venice(最高256核)和CDNA5架构MI455X(432GB HBM4,40 PFLOPS FP4),推出Helios机架级参考设计(单rack 2.9 exaFLOPS FP4),宣称四年AI性能提升1000倍,获Meta、OpenAI等大客户长期合同。
NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍
NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。
Microsoft与Mistral合作打造欧洲主权AI基础设施,应对EU AI Act合规
Microsoft与Mistral扩展数十亿美元合作,Mistral引入数千张NVIDIA Vera Rubin GPU,其Medium 3.5和OCR 4模型集成到Microsoft Foundry和Copilot Studio,提供云端、连接和离线三种部署模式,专为欧洲受监管行业设计,满足EU AI Act合规要求。
NVIDIA Vera Rubin Driving Performance Per Watt, Lowest Token Cost for Partners Worldwide
...
微软战略投资Mistral AI,Azure Foundry集成其模型以锁定欧洲主权AI市场
微软与法国AI公司Mistral达成数十亿美元合作,投资其欧洲数据中心算力,并将Mistral的Medium 3.5和OCR 4模型集成至Azure Foundry平台。此举直接响应美国对Anthropic的出口管制,旨在为欧洲受监管行业提供替代美国控制基础设施的AI选项,标志着主权AI需求从政策呼吁转向实际部署。
Project Perception:多模型AI编排漏洞修复,控制权转移
Microsoft正在开发代号Project Perception的AI安全产品,通过编排多个AI模型自动化完成漏洞发现、分类、补丁生成、验证与部署全流程。这标志着安全运营从人工驱动向自愈系统转型,控制权从安全分析师转移到AI编排平台。
微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态
微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
Anthropic Claude Cowork统一界面扩展Web/Mobile,审计盲区成企业部署障碍
Anthropic将Claude Cowork统一界面扩展至Web/Mobile Beta,面向Max用户,合并Chat与Cowork模式,支持本地文件访问和跨设备任务持续执行。但Cowork活动未纳入审计日志,形成合规盲区,与Microsoft Copilot的成熟治理形成对比。
微软7月补丁日622个CVE创纪录,AI基础设施漏洞成新攻击面
微软2026年7月补丁日发布622个CVE,创历史新高,其中3个AI关键漏洞:Copilot RCE(CVSS 9.6)、Azure OpenAI EoP(CVSS 9.9)、M365 Copilot EoP(CVSS 9.3)。攻击面从操作系统扩展到AI服务基础设施,标志着AI驱动的漏洞通胀时代来临。
Azure Arc统一控制平面再下一城:SQL Server迁移至Azure VM的隐性锁定
微软通过Azure Arc将SQL Server迁移至Azure虚拟机的功能正式上线,提供从评估到切换的完整引导式工作流。该功能基于备份还原与日志传送技术,以Azure Blob为暂存区,但存在区域绑定、不迁移代理作业及SSIS包等关键限制,旨在强化Azure管理平面的统一性与用户粘性。
英伟达Vera Rubin七芯片堆栈与Dynamo解耦,推高推理智能成本效率
英伟达发布Vera Rubin平台,包含七芯片堆栈(Vera CPU、Rubin GPU、NVLink 6等)和Dynamo 1.0推理解耦架构,将预填充与解码分离。单个NVL72机架集成72 GPU/36 CPU,提供1.6 PB/s带宽,推理性能提升7倍,并引入‘每美元智能’指标,标志AI算力从训练转向推理成本竞争。
微软Azure在华裁员200-400人,云增长下重组地缘合规布局
微软Azure尽管全球云业务增长40%,仍在中国裁员200-400人,并提供部分员工转移至加拿大。此举显示微软正在地缘政治敏感市场重新配置运营资源,将合规与风险控制移出中国,影响企业多云与数据主权策略。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。