情报
AI 生成的结构化厂商动态简报
NVIDIA美国制造启航:纬创工厂量产GB300与Vera Rubin,重构AI供应链
纬创在德克萨斯州沃斯堡开设首座美国制造工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该工厂投资7亿美元,计划月产数万块板,标志着NVIDIA供应链本土化的重大转折。
NVIDIA Vera Rubin平台规格披露:单片CPU+GPU集成,每瓦token数提升10倍
NVIDIA正式披露Vera Rubin平台详细规格,采用单片化设计,每2个Rubin GPU搭配1个Vera CPU,旗舰NVL72集成36CPU+72GPU。宣称每瓦处理token数较Grace Blackwell提升10倍,内存带宽提升3倍。Vera CPU将独立销售,首批客户包括Microsoft、OpenAI、Oracle,预计2026年下半年量产。性能数据来自内部测试,独立验证待确认。
微软战略投资Mistral AI,Azure Foundry集成其模型以锁定欧洲主权AI市场
微软与法国AI公司Mistral达成数十亿美元合作,投资其欧洲数据中心算力,并将Mistral的Medium 3.5和OCR 4模型集成至Azure Foundry平台。此举直接响应美国对Anthropic的出口管制,旨在为欧洲受监管行业提供替代美国控制基础设施的AI选项,标志着主权AI需求从政策呼吁转向实际部署。
NVIDIA Spectrum-6 102.4Tbps交换机商用,Cisco确认搭载,AI网络带宽拐点到来
NVIDIA发布Spectrum-6 102.4Tbps以太网交换机,带宽翻倍,支持CPO和液冷,作为Vera Rubin平台核心组件。Cisco N9100系列独立确认采用该芯片,Broadcom发布同类Tomahawk 6,AI网络正式进入102.4Tbps时代。
Cloudflare Precursor GA:持续行为验证取代CAPTCHA,Bot防御转向全会话分析
Cloudflare正式商用Precursor行为验证引擎,构建于全球边缘网络,通过实时监控整个用户会话的交互行为(如鼠标移动、键盘节奏)来检测高级Bot,取代传统单点CAPTCHA。该引擎零代码部署,隐私优先,每天保护数十亿次交互,应对Bot流量占比57%的新常态。
OpenAI发布GPT-5.6:三层模型路由控制权转移,多Agent并行锁定AI工作流
OpenAI发布GPT-5.6系列,核心架构为Soul/Terra/Luna三层模型路由,系统自动选择模型与工具;同步推出ChatGPT Work任务入口、Ultra Mode多Agent并行处理,以及四层安全框架,标志着从单一问答向自主任务执行的范式转变,强化了OpenAI在AI工作流编排中的控制地位。
NVIDIA开源Cosmos 3 Edge 4B世界模型,Jetson Thor实现15Hz实时机器人控制
NVIDIA开源Cosmos 3 Edge(4B参数)世界动作模型,专为边缘机器人控制设计,在Jetson Thor平台实现15Hz实时推理和32个动作生成。此举将物理AI栈从数据中心扩展到边缘,推动机器人从感知到动作的端到端部署。
Project Perception:多模型AI编排漏洞修复,控制权转移
Microsoft正在开发代号Project Perception的AI安全产品,通过编排多个AI模型自动化完成漏洞发现、分类、补丁生成、验证与部署全流程。这标志着安全运营从人工驱动向自愈系统转型,控制权从安全分析师转移到AI编排平台。
NVIDIA发布Agent Toolkit扩展Omniverse库,使AI代理具备物理仿真构建能力
NVIDIA在SIGGRAPH 2026发布Agent Toolkit扩展,新增Omniverse库作为软件组件,使AI代理能够构建和仿真3D世界。同时开源Cosmos 3 Edge(4B参数世界动作模型),完善从训练到边缘部署的物理AI生态。
苹果接触PrismML,1-bit量化技术或重塑设备端AI推理格局
苹果正在评估AI初创公司PrismML的原生1-bit模型压缩技术,可将模型体积压缩至1/14,内存占用降低90%,推理速度提升8倍。Bonsai 27B模型已可在iPhone 15上运行,标志着设备端AI推理的重大突破,可能改变移动AI生态。
NVIDIA Vera Rubin部署BMS:Mission Control与BioNeMo构筑AI工厂控制层
BMS部署基于NVIDIA Vera CPU和Rubin GPU的DGX SuperPOD,并采用Mission Control管理及BioNeMo Agent Toolkit,构建统一AI平台。此举标志NVIDIA从硬件供应商向AI工厂控制平台提供商战略转移。
Google研发Frozen v2专用AI芯片:固化Gemini架构能效达TPU 6-10倍,计划2028年投产
Google正在研发代号Frozen v2的专用AI芯片,将Gemini大模型底层架构直接固化在硅基硬件中,按单位功耗Token数计算能效可达现有TPU的6-10倍。该芯片开辟新自研产品线,计划2028年投产,保留模型权重更新能力。
微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态
微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
Beyond the Model: Harnessing Frontier AI for Stronger Defense
...
Intel 18A良率单季跃升20个百分点至85%+,先进封装EMIB良率达98%逼近TSMC N2
Intel Foundry 18A良率从65%提升至85%+,单季跃升20个百分点,逼近TSMC N2的90%。同时EMIB先进封装良率达90-98%,使Intel从封装瓶颈转为卖点。NVIDIA、AMD、Apple等已签约,但多为次级供应。
Meta发布Muse Spark 1.1及API,低价策略转向闭源商业化
Meta正式发布Muse Spark 1.1多模态推理模型,并首次推出付费API,终结Llama开源传统。API定价仅为竞品25%,支持1M上下文窗口和Agent任务,标志着Meta从开源转向闭源商业化,意图通过低价抢占市场份额。
Anthropic Claude Cowork统一界面扩展Web/Mobile,审计盲区成企业部署障碍
Anthropic将Claude Cowork统一界面扩展至Web/Mobile Beta,面向Max用户,合并Chat与Cowork模式,支持本地文件访问和跨设备任务持续执行。但Cowork活动未纳入审计日志,形成合规盲区,与Microsoft Copilot的成熟治理形成对比。
微软7月补丁日622个CVE创纪录,AI基础设施漏洞成新攻击面
微软2026年7月补丁日发布622个CVE,创历史新高,其中3个AI关键漏洞:Copilot RCE(CVSS 9.6)、Azure OpenAI EoP(CVSS 9.9)、M365 Copilot EoP(CVSS 9.3)。攻击面从操作系统扩展到AI服务基础设施,标志着AI驱动的漏洞通胀时代来临。
AlphaEvolve GA:Google DeepMind AI自我进化优化数据中心效率
2026年7月19日,Google DeepMind宣布基于Gemini的多智能体进化系统AlphaEvolve正式GA。该系统能够自主设计算法、进行数学发现并优化数据中心效率,已应用于Borg调度器和Orca推理基础设施,旨在通过AI自我改进显著降低超大规模AI算力投入的Capex。