情报
AI 生成的结构化厂商动态简报
诺基亚与英伟达推出首个商用AI-RAN平台,控制层转向AI原生
诺基亚推出业界首个商用AI-RAN平台,融合其AI原生anyRAN软件与英伟达Aerial平台,支持4G/5G并演进6G。MantaRay SMO新增非实时RIC和AI应用,Doksuri无线设备AI就绪。与Telia合作推动AI-RAN用例。
Zscaler主权SASE绑定STACKIT:监管合规驱动下的生态锁定
Zscaler与Schwarz Digits合作,将其**Zero Trust Exchange**平台部署在德国主权云**STACKIT**上,推出主权**SASE**服务。该平台面向欧洲高度监管行业,满足**NIS2**、**DORA**及**EU AI Act**,由德国数据中心托管,提供完整管理与支持。
微软Azure引入AMD Helios机架级平台,正式打破NVIDIA AI GPU垄断格局
微软Azure宣布将在2026下半年部署AMD Helios机架级AI平台。该平台集成72颗MI455X GPU、18颗Venice CPU及液冷系统,单机架提供2.9 Exaflops FP4推理算力。此举标志着全球第二大云厂商正式摆脱对NVIDIA单一GPU供应商的依赖,开启AI基础设施多架构时代。
NVIDIA联手SK集团锁定HBM4供应链,主权AI工厂模式开启国家级投资
NVIDIA与SK集团宣布超5000亿美元AI合作,涵盖SK Telecom 2GW AI工厂(采用Vera Rubin+HBM4,2027年投运)、SK Hynix HBM4长期供应锁定,以及NVIDIA投资Naver 10亿美元(Brookfield追加90亿美元)。三星与博通另签2000亿美元协议。此举标志着AI基础设施投资进入国家级规模,并深度绑定供应链。
Databricks全面Azure化并采用Cobalt 200 ARM,Microsoft锁定AI Agent控制平面
Databricks将全面迁移至Azure,采用Microsoft Cobalt 200 ARM芯片处理数据与AI工作负载,同时深度集成Genie和Unity AI Gateway至Microsoft产品线,形成长期锁定。Databricks完成188亿美元估值融资。
AMD Helios机架全栈出击,以开放网络UALoE挑战NVIDIA NVLink生态锁死
AMD在Advancing AI 2026发布Helios机架级方案,集成72颗MI455X GPU、18颗Venice EPYC CPU及Pensando网络,推理token/$比NVIDIA NVL72高30%,并推出UALoE开放标准。与Cerebras、Cisco等合作,构建全栈AI基础设施对抗NVIDIA。
AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink
AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。
微软发布自研MAI图像与语音模型,加速产品生态闭环
微软发布MAI-Image-2.5-Pro和MAI-Voice-2-Flash自研模型,已集成至Bing、PowerPoint、OneDrive、Dynamics 365等产品。声称在质量、延迟和成本上优于竞品,GPU成本最高降低89%,标志微软AI战略转向内部闭环。
AMD反向投资Anthropic 50亿美元,绑定2GW MI450部署,重构AI算力生态
AMD与Anthropic达成战略合作,Anthropic将部署最多2GW AMD Instinct MI450系列GPU,AMD反向投资$50亿。双方将联合优化ROCm软件栈,并利用Claude优化Instinct负载。此举标志着AMD从芯片供应商升级为AI生态投资者,加速AI算力多元化,直接挑战NVIDIA的垄断地位。
NVIDIA千亿投资OpenAI共建10GW AI工厂,Vera Rubin平台深度绑定
NVIDIA与OpenAI签署战略合作,部署至少10GW基于Vera Rubin平台(Rubin GPU、Vera CPU、HBM4、NVLink 6)的AI算力设施,NVIDIA投资最多$1000亿。首批设施2026下半年上线,支撑OpenAI下一代模型训练推理,标志AI算力进入超GW时代。
AMD与HPE发布Helios开放平台,挑战NVIDIA AI生态
AMD与HPE宣布深化合作,推出基于Helios架构的AI基础设施平台。该平台集成AMD EPYC处理器、Instinct MI455X GPU、Pensando网络和ROCm软件,单机架提供2.9 exaFLOPS FP4性能,基于Open Compute Project原则设计,旨在简化大规模AI集群部署并提升能效。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。
NVIDIA推AI计算合伙人计划:用信用兜底+收入分成锁定云厂商,转型算力央行
NVIDIA推出AI计算合伙人计划,通过收入分成与信用兜底机制,从硬件销售转向持续性服务收益。首批项目包括澳洲Sharon AI的4万张GB300芯片和印尼Firmus的17万张GPU,总规模二十万级高端芯片。NVIDIA正成为AI算力的“中央银行”,压缩云中间商空间。
OpenAI引入华尔街与数字银行巨头入局董事会,金融合规壁垒从客户侧转向模型侧
OpenAI任命数字银行Nubank创始人David Vélez及全球最大托管银行BNY CEO Robin Vince加入基金会及集团董事会。此举将金融业的最高合规与风控标准直接嵌入OpenAI的治理顶层,标志着AI在受监管行业的部署范式从'企业自行审计'转向'厂商原生合规'。
Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式
Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。
Google Cloud推多代理自主运维,控制点从人类转向AI验证架构
Google Cloud提出“agent-scale data management”,通过多代理验证架构减少人工监督,并与Nokia部署6个Gemini代理实现网络自治。同时Amazon计划商业化Trainium芯片,加剧AI硬件竞争,挑战Google TPU和Nvidia GPU。
OpenAI联手Broadcom推出Jalapeno推理芯片,重塑AI硬件生态
OpenAI与Broadcom合作开发了名为Jalapeno的LLM推理加速芯片,采用多芯片模块、HBM3E内存,9个月完成流片。该芯片专为OpenAI模型栈优化,旨在降低推理成本并减少对NVIDIA GPU的依赖,计划2026年底部署。
Mandiant曝光Cisco SD-WAN Manager零日漏洞,控制平面成高级威胁突破口
Mandiant发现攻击者利用Cisco Catalyst SD-WAN Manager的CVE-2026-20245零日漏洞,通过恶意CSV上传实现权限提升至root。攻击链包括未授权对等连接、默认账户密码篡改及反取证清理。事件凸显SD-WAN集中控制平面作为高级持续性威胁的新攻击面。
美光与Anthropic合作:用稀缺叙事锁定AI内存需求,但股价已透支预期
美光与Anthropic签署长期供应合同,涵盖HBM、DRAM和SSD全产品线,并联合分析AI工作负载的内存子系统。同时,美光参与Anthropic H轮融资。此举旨在将内存从商品转化为AI基础设施资产,但股价已大幅上涨,市场需验证稀缺溢价能否持续。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。