情报
AI 生成的结构化厂商动态简报
Nokia升级自主网络产品组合,推进AI-RAN平台
...
HPE扩展Private Cloud AI产品线,集成NVIDIA Vera Rubin NVL72平台
...
Cloudflare紧急部署WAF规则拦截WordPress核心零日漏洞wp2shell攻击
...
Check Point推出Agentic Network Security Orchestration Platform,自主代理执行网络安全运营
...
NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍
NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。
Meta开发AI模型路由器Switchboard,意图控制推理成本与生态
Meta内部孵化器AAI Labs开发AI模型路由器Switchboard,可自动分析任务难度并分配至最适模型,以降低推理成本。项目初期用于内部AI编程Agent,后续可能面向企业客户,意图构建AI推理分配控制层。
NVIDIA美国制造启航:纬创工厂量产GB300与Vera Rubin,重构AI供应链
纬创在德克萨斯州沃斯堡开设首座美国制造工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该工厂投资7亿美元,计划月产数万块板,标志着NVIDIA供应链本土化的重大转折。
Palo Alto收购Embrace推Synthetics,构建AI数字体验监控闭环
Palo Alto Networks宣布收购RUM厂商Embrace并推出自研Synthetics主动测试,整合现有Observability平台与Cortex AgentiX,形成从真实用户体验到基础设施健康的闭环数字体验监控。此举标志着Palo Alto从网络安全向AI Agent驱动的全栈可观测性提供商转型,直接挑战Datadog和New Relic。
OpenAI发布GPT-5.6:三层模型路由控制权转移,多Agent并行锁定AI工作流
OpenAI发布GPT-5.6系列,核心架构为Soul/Terra/Luna三层模型路由,系统自动选择模型与工具;同步推出ChatGPT Work任务入口、Ultra Mode多Agent并行处理,以及四层安全框架,标志着从单一问答向自主任务执行的范式转变,强化了OpenAI在AI工作流编排中的控制地位。
NVIDIA开源Cosmos 3 Edge 4B世界模型,Jetson Thor实现15Hz实时机器人控制
NVIDIA开源Cosmos 3 Edge(4B参数)世界动作模型,专为边缘机器人控制设计,在Jetson Thor平台实现15Hz实时推理和32个动作生成。此举将物理AI栈从数据中心扩展到边缘,推动机器人从感知到动作的端到端部署。
Project Perception:多模型AI编排漏洞修复,控制权转移
Microsoft正在开发代号Project Perception的AI安全产品,通过编排多个AI模型自动化完成漏洞发现、分类、补丁生成、验证与部署全流程。这标志着安全运营从人工驱动向自愈系统转型,控制权从安全分析师转移到AI编排平台。
NVIDIA发布Agent Toolkit扩展Omniverse库,使AI代理具备物理仿真构建能力
NVIDIA在SIGGRAPH 2026发布Agent Toolkit扩展,新增Omniverse库作为软件组件,使AI代理能够构建和仿真3D世界。同时开源Cosmos 3 Edge(4B参数世界动作模型),完善从训练到边缘部署的物理AI生态。
NVIDIA Vera Rubin部署BMS:Mission Control与BioNeMo构筑AI工厂控制层
BMS部署基于NVIDIA Vera CPU和Rubin GPU的DGX SuperPOD,并采用Mission Control管理及BioNeMo Agent Toolkit,构建统一AI平台。此举标志NVIDIA从硬件供应商向AI工厂控制平台提供商战略转移。
微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态
微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
Meta发布Muse Spark 1.1及API,低价策略转向闭源商业化
Meta正式发布Muse Spark 1.1多模态推理模型,并首次推出付费API,终结Llama开源传统。API定价仅为竞品25%,支持1M上下文窗口和Agent任务,标志着Meta从开源转向闭源商业化,意图通过低价抢占市场份额。
Anthropic Claude Cowork统一界面扩展Web/Mobile,审计盲区成企业部署障碍
Anthropic将Claude Cowork统一界面扩展至Web/Mobile Beta,面向Max用户,合并Chat与Cowork模式,支持本地文件访问和跨设备任务持续执行。但Cowork活动未纳入审计日志,形成合规盲区,与Microsoft Copilot的成熟治理形成对比。
微软7月补丁日622个CVE创纪录,AI基础设施漏洞成新攻击面
微软2026年7月补丁日发布622个CVE,创历史新高,其中3个AI关键漏洞:Copilot RCE(CVSS 9.6)、Azure OpenAI EoP(CVSS 9.9)、M365 Copilot EoP(CVSS 9.3)。攻击面从操作系统扩展到AI服务基础设施,标志着AI驱动的漏洞通胀时代来临。
AlphaEvolve GA:Google DeepMind AI自我进化优化数据中心效率
2026年7月19日,Google DeepMind宣布基于Gemini的多智能体进化系统AlphaEvolve正式GA。该系统能够自主设计算法、进行数学发现并优化数据中心效率,已应用于Borg调度器和Orca推理基础设施,旨在通过AI自我改进显著降低超大规模AI算力投入的Capex。
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。