情报
AI 生成的结构化厂商动态简报
NVIDIA开源Cosmos 3 Edge 4B世界模型,Jetson Thor实现15Hz实时机器人控制
NVIDIA开源Cosmos 3 Edge(4B参数)世界动作模型,专为边缘机器人控制设计,在Jetson Thor平台实现15Hz实时推理和32个动作生成。此举将物理AI栈从数据中心扩展到边缘,推动机器人从感知到动作的端到端部署。
Project Perception:多模型AI编排漏洞修复,控制权转移
Microsoft正在开发代号Project Perception的AI安全产品,通过编排多个AI模型自动化完成漏洞发现、分类、补丁生成、验证与部署全流程。这标志着安全运营从人工驱动向自愈系统转型,控制权从安全分析师转移到AI编排平台。
NVIDIA发布Agent Toolkit扩展Omniverse库,使AI代理具备物理仿真构建能力
NVIDIA在SIGGRAPH 2026发布Agent Toolkit扩展,新增Omniverse库作为软件组件,使AI代理能够构建和仿真3D世界。同时开源Cosmos 3 Edge(4B参数世界动作模型),完善从训练到边缘部署的物理AI生态。
苹果接触PrismML,1-bit量化技术或重塑设备端AI推理格局
苹果正在评估AI初创公司PrismML的原生1-bit模型压缩技术,可将模型体积压缩至1/14,内存占用降低90%,推理速度提升8倍。Bonsai 27B模型已可在iPhone 15上运行,标志着设备端AI推理的重大突破,可能改变移动AI生态。
NVIDIA Vera Rubin部署BMS:Mission Control与BioNeMo构筑AI工厂控制层
BMS部署基于NVIDIA Vera CPU和Rubin GPU的DGX SuperPOD,并采用Mission Control管理及BioNeMo Agent Toolkit,构建统一AI平台。此举标志NVIDIA从硬件供应商向AI工厂控制平台提供商战略转移。
Google研发Frozen v2专用AI芯片:固化Gemini架构能效达TPU 6-10倍,计划2028年投产
Google正在研发代号Frozen v2的专用AI芯片,将Gemini大模型底层架构直接固化在硅基硬件中,按单位功耗Token数计算能效可达现有TPU的6-10倍。该芯片开辟新自研产品线,计划2028年投产,保留模型权重更新能力。
微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态
微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。
NVIDIA 20亿投资CoreWeave,以‘算力央行’模式重构AI云生态
NVIDIA对CoreWeave进行20亿美元战略投资,并推出‘AI计算合伙人计划’,通过信用增级、收入分成和GPU回购三重机制,从GPU供应商转型为算力生态的‘央行’,压缩中间商利润,巩固对AI算力供应链的控制。
Beyond the Model: Harnessing Frontier AI for Stronger Defense
...
Intel 18A良率单季跃升20个百分点至85%+,先进封装EMIB良率达98%逼近TSMC N2
Intel Foundry 18A良率从65%提升至85%+,单季跃升20个百分点,逼近TSMC N2的90%。同时EMIB先进封装良率达90-98%,使Intel从封装瓶颈转为卖点。NVIDIA、AMD、Apple等已签约,但多为次级供应。
Meta发布Muse Spark 1.1及API,低价策略转向闭源商业化
Meta正式发布Muse Spark 1.1多模态推理模型,并首次推出付费API,终结Llama开源传统。API定价仅为竞品25%,支持1M上下文窗口和Agent任务,标志着Meta从开源转向闭源商业化,意图通过低价抢占市场份额。
Anthropic Claude Cowork统一界面扩展Web/Mobile,审计盲区成企业部署障碍
Anthropic将Claude Cowork统一界面扩展至Web/Mobile Beta,面向Max用户,合并Chat与Cowork模式,支持本地文件访问和跨设备任务持续执行。但Cowork活动未纳入审计日志,形成合规盲区,与Microsoft Copilot的成熟治理形成对比。
微软7月补丁日622个CVE创纪录,AI基础设施漏洞成新攻击面
微软2026年7月补丁日发布622个CVE,创历史新高,其中3个AI关键漏洞:Copilot RCE(CVSS 9.6)、Azure OpenAI EoP(CVSS 9.9)、M365 Copilot EoP(CVSS 9.3)。攻击面从操作系统扩展到AI服务基础设施,标志着AI驱动的漏洞通胀时代来临。
AlphaEvolve GA:Google DeepMind AI自我进化优化数据中心效率
2026年7月19日,Google DeepMind宣布基于Gemini的多智能体进化系统AlphaEvolve正式GA。该系统能够自主设计算法、进行数学发现并优化数据中心效率,已应用于Borg调度器和Orca推理基础设施,旨在通过AI自我改进显著降低超大规模AI算力投入的Capex。
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
HPE Private Cloud AI集成Vera Rubin NVL72,推动AI工厂与Agent原生部署
HPE宣布扩展Private Cloud AI产品线,集成NVIDIA Vera Rubin NVL72及HGX Rubin NVL8平台,推出Compute XD700和Cray GX240 blade(搭载Vera CPU)。同时引入Agent Toolkit和NemoClaw,实现Agent原生基础设施,计划Q4 2026推出Alletra Storage MP X10000。
NVIDIA推Agent Toolkit全栈锁定本地Agent,控制点从云端转向DGX Station
NVIDIA发布Agent Toolkit,包含NemoClaw、Nemotron 3 Ultra、Omniverse Libraries和OpenShell四大组件,使开发者可在DGX Station GB300上30分钟完成本地AI Agent部署。此举旨在将Agent开发生态锁定在NVIDIA硬件与软件栈,推动控制点从云服务向本地硬件转移。
测试来源:36氪
...
华为昇腾950超节点:自研HCCS互联打造AI算力自主生态
华为在WAIC展示昇腾950超节点,集成32颗自研昇腾950 AI处理器,通过自研HCCS高速互联实现芯片间超低延迟通信,算力密度较上一代提升2.5倍,支持万亿参数模型训练,旨在提供不依赖海外供应链的AI算力选择。
Cisco部署AgenticOps自主网络,AI智能体接管运维控制权
Cisco宣布在全球网络全面部署AgenticOps自主架构,基于AI原生网络引擎实现自动检测与自我修复。超过9万名员工使用AI智能体,将故障修复时间从小时级压缩至分钟级,目标降低40%运营成本。同时发布第三方开发框架扩展生态。