情报
AI 生成的结构化厂商动态简报
NVIDIA Rubin平台强制100%液冷:温水冷却颠覆数据中心散热范式
NVIDIA披露Rubin平台全面液冷细节,采用45°C温水冷却实现100%无风扇、无冷水机组设计,彻底淘汰混合散热。该平台将于2026下半年量产,并要求所有数据中心必须完成液冷转型,标志着AI计算散热进入全液冷时代。
OpenAI联合博通发布推理ASIC Jalapeño,摆脱NVIDIA GPU依赖
OpenAI与博通合作推出首款定制AI推理芯片Jalapeño,9个月完成流片,专为大模型推理优化。OpenAI负责架构,博通负责网络硬件,Celestica集成。计划2026年底大规模部署,配套千兆瓦级数据中心,旨在降低推理成本并减少对NVIDIA的依赖。
Google Cloud与诺基亚联手,用Gemini AI智能体夺取网络运维控制权
Google Cloud与诺基亚合作,将Gemini AI智能体(含路由器智能体、事件分级智能体等)嵌入Nokia Assurance Center,以SaaS模式于2026年9月上线。此举旨在将故障排查时间缩短50-80%,标志着电信运维从人工规则向AI驱动的根本性转变。
Cloudflare全球故障暴露单点依赖风险,加速多CDN架构转型
Cloudflare于2026年6月22日发生重大服务中断,影响全球超20%网站。故障原因未明,但事件凸显了互联网基础设施单点故障风险,可能促使企业加速采用多云/多CDN架构以分散风险。
Check Point押注GPT-5.5特权接入,安全控制权从防火墙转向大模型API
Check Point加入OpenAI网络安全可信接入计划,获得GPT-5.5高阶特权级接入权限,用于威胁分析等防御场景。这标志着安全竞争核心从自研最优防火墙转向获取顶尖大模型的可靠接入权限,但接入权限完全由OpenAI掌控。
诺基亚联合谷歌云,用Gemini重塑网络运维范式
诺基亚将谷歌Gemini集成至其网络保障中心,打造6款AI智能体,覆盖事件分诊、异常检测等场景,宣称将故障排查时间缩短50%-80%。系统基于谷歌云平台,计划以SaaS形式于2026年9月推出。
Cloudflare AI网关2.0:边缘控制平面夺取AI推理路由与安全主导权
Cloudflare推出AI Gateway 2.0,通过智能路由跨越50+模型提供商,宣称降低成本30%;同时推出Workers AI边缘推理(延迟<10ms),与NVIDIA合作部署GPU加速服务,并扩展AI防火墙。此举将AI流量控制平面从云巨头转移至边缘网络。
Google发布第八代TPU:训练性能3倍跃升,推理SRAM暴增3倍,锁定AI算力新拐点
Google Cloud Next 2026推出第八代TPU,分为训练专用TPU 8t(单Pod 9600颗,2PB共享内存)和推理专用TPU 8i(1152颗,片上SRAM增3倍)。同时发布Gemini Enterprise Agent Platform,整合AI代理构建、治理与安全,并推出N4 Axion ARM实例(性价比2倍于x86)。
Intel推至强6+及AI战略:CPU重掌AI基础设施控制平面
Intel在Computex 2026发布基于18A制程的至强6+处理器(288能效核,576MB L3缓存)、以太网800系列E835控制器(200GbE)及下一代GPU Crescent Island,并宣布与SambaNova、富士康合作机架级AI基础设施。战略核心是让至强CPU成为智能体AI的控制平面。
谷歌Trillium TPU:4.7倍训练性能提升背后的算力锁定与生态陷阱
谷歌云发布第六代TPU Trillium,采用3纳米工艺,AI训练性能提升4.7倍,推理性能提升2.5倍,能效比H100高2倍。但Trillium仅限Google Cloud TPU v6p实例,深度绑定AI Hypercomputer架构,形成从芯片到网络的全栈锁定。
Trend Micro Vision One 2.0:AI原生安全平台,但控制点争夺战加剧
Trend Micro发布Vision One 2.0统一安全平台,采用AI原生架构,集成50+工具,支持三大云。引入AI安全分析师**Companion**,将响应时间从小时级缩短至分钟级。该平台核心是行为AI模型,旨在预测并阻断勒索软件加密行为。
思科Cloud Control AI平台:控制平面从域工具转向统一代理编排
思科在Cisco Live 2026推出Cisco Cloud Control,一个统一平台,让人类和AI代理协同管理网络、安全、计算等IT基础设施。核心组件包括AI Canvas协作空间、Cloud Control Studio代理构建器(支持50+第三方集成)和Live Protect运行时防护,意图将分散的运维控制点集中到一个智能编排层。
Zscaler推ZAgent框架与零信任浏览器:控制点从网络转向AI编排与终端
Zscaler在Zenith Live 2026发布ZAgent Framework,通过自然语言编排代理;同时推出Zero Trust浏览器扩展和企业浏览器,替代VDI/VPN;并扩展多云工作负载安全至GCP。此举将SASE控制点从传统网络硬件转向AI驱动的终端管理和浏览器安全层。
Fortinet联手NVIDIA推出FortiAIGate,AI安全控制点从边界转向GPU加速内联
Fortinet发布FortiAIGate,集成NVIDIA Blackwell GPU与Dynamo推理框架,以内联模式实时保护数据中心和云端AI工作负载、数据与自主代理。声称极低延迟、多租户扩展,支持地端、云端、混合云及边缘部署。
CrowdStrike推AI代理持续身份授权:SPIFFE动态身份重构安全控制平面
CrowdStrike在Falcon平台推出Continuous Identity for AI Agents,采用SPIFFE标准为AI代理分配加密身份,替代静态API密钥,实现实时授权与即时撤销。整合SGNL技术,并通过AI Detection and Response组件检查提示意图,防止权限滥用与模型越权。
NVIDIA 4亿美元收购Kumo AI:从GPU算力到结构化数据预测的生态扩张
NVIDIA以超4亿美元收购企业预测AI公司Kumo AI,强化其在客户流失、库存优化等领域的图神经网络与时序分析能力。此举将NVIDIA从GPU加速计算延伸至企业数据智能层,与HPE等伙伴合作构建AI工厂解决方案,展示Vera CPU架构与代理式AI验证设计。
美国政府勒令Anthropic封锁海外访问,AI模型出口管制进入强制时代
美国政府以国家安全为由,命令Anthropic阻止任何外国国民访问其最新模型Fable 5和Mythos 5,导致全球禁用。此举由亚马逊安全研究人员举报触发,并涉及中国团体曾获取Mythos访问权限的传闻。Anthropic被迫配合,IPO前遭遇重大合规冲击。
美国政府出口管制强制下线Claude Fable 5,AI监管进入地缘政治硬约束时代
Anthropic最新Claude Fable 5模型因美国政府出口管制仅上线4天下线,起因是亚马逊担忧其被用于网络攻击。Anthropic拒绝修复越狱漏洞,政府直接干预。中国智谱AI同日发布开源模型GLM-5.2,预示AI部署范式转向开源与主权化。
AMD投建全栈Instinct GPU云:TensorWave B轮融资暴露NVIDIA生态破局战略
TensorWave完成3.5亿美元B轮融资,AMD Ventures联合领投,估值达15.5亿美元。该云平台完全基于AMD Instinct GPU(MI300X至MI455X)构建,主攻记忆密集型AI工作负载,旨在提供绕过NVIDIA CUDA锁定的替代算力路径,并验证ROCm软件栈的商业化成熟度。
OpenAI押注Codex:从聊天机器人到智能体控制平台的战略跃迁
OpenAI计划对ChatGPT进行史上最大改版,核心是将Codex编程工具、AI智能体和第三方应用整合为超级应用。此举标志着产品定位从问答聊天机器人,转向以Codex为控制平面的智能体执行平台,旨在提升企业变现能力并应对Anthropic的竞争压力。