情报
AI 生成的结构化厂商动态简报
Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式
Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。
华为推AI原生网络架构:从字节计费转向Token货币化,UCM缓存突破长上下文瓶颈
华为在MWC上海2026发布AI原生网络架构,集成服务-网络-计算,实现从流量中心到智能中心的转变。核心是Unified Cache Manager(UCM)将KV缓存扩展至PB级外存,在GLM-5.1模型128K序列长度下实现372% token吞吐量提升。同时推出token货币化框架,允许运营商按AI推理容量计费,并引入agentic运营模式。
台积电全先进制程涨价5-10%,AI芯片成本压力加剧
台积电通知客户将对7nm及以上所有先进制程涨价5-10%,覆盖其74%的晶圆营收。苹果、英伟达、AMD等厂商面临更高制造成本,可能传导至终端AI基础设施价格。
Cisco Live US & InfoComm 2026 : la collaboration entre dans l’ère agentique
...
NVIDIA发布45°C高温液冷系统,Rubin芯片承诺减少100%水耗
NVIDIA为Rubin GPU推出高温液冷系统,冷却液温度45°C(高于热水浴缸),利用室外干冷却器实现闭环运行,宣称可减少电耗并消除水蒸发(水耗减少100%)。但系统在炎热气候下仍需冷水机组备用,且电力来源和芯片寿命影响未明确。
AMD MI430X以200+ TFLOPS原生FP64性能,重新定义HPC与AI融合算力基线
AMD在TOP500榜单中驱动4台前十超算,并预览MI430X GPU,承诺超过200 TFLOPS原生FP64性能。此举直接针对AI for Science场景,将双精度计算作为下一代HPC与AI融合基础设施的核心指标,对NVIDIA和Intel形成直接竞争压力。
NVIDIA借AI代理与数字孪生重塑电信网络控制平面
NVIDIA在DTW Ignite 2026展示其AI代理平台,集成NeMo合成数据、NemoClaw安全运行时、OpenShell沙箱及RTX PRO 6000加速的数字孪生,旨在实现电信网络自主运营。合作伙伴包括SoftBank、Amdocs、NTT DATA等,共同推动从任务自动化向自主网络转型。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
诺基亚MantaRay AutoPilot: 公有云AI控制面接管移动网络优化,15分钟闭环
NTT DOCOMO首次在日本部署诺基亚MantaRay AutoPilot,将AI驱动的网络优化系统运行在公有云上,实现从每日手动参数设计到15分钟全自动闭环的跃迁。系统通过意图驱动(Intent)自动分析基站性能并下发优化指令,目标达到TM Forum Level 4完全自主网络。
思科借NVIDIA Spectrum硅片与Nexus One统一管理,重塑AI网络控制层
思科发布N9100系列交换机,采用NVIDIA Spectrum-6/4硅片,支持102.4T吞吐量。同时推出Nexus One统一管理平面,整合NX-OS与SONiC,并通过BlueField DPU将安全策略下沉,实现AI工厂的端到端控制与安全卸载。
AMD收购MEXT实现NAND闪存模拟DRAM,AI推理内存成本腰斩
AMD完成对MEXT的收购,其技术使廉价NAND闪存模拟DRAM行为,将可用内存容量提升2-4倍同时成本减半。该能力被直接瞄准AI推理和代理型AI市场,解决内存带宽瓶颈。同时AMD与Rackspace签署30MW AI计算部署协议,2026-2028年落地。
AMD Threadripper 'Mustang Peak' 曝光:144核、PCIe 6.0、新TR6插槽,但功耗内存瓶颈暗藏
AMD Zen 6 Threadripper Pro 'Mustang Peak' 确认采用2nm工艺、DDR5、PCIe 6.0及全新TR6插槽。基于Powderhorn CCD,核心数最高可达144核(288线程),频率超6GHz。但功耗巨大,内存带宽可能依赖MRDIMM,平台升级成本高昂。
NVIDIA RTX Remix 1.5:用RTX IO压缩和AI Agent重塑游戏MOD生态,强化GPU锁定
NVIDIA发布RTX Remix 1.5更新,核心亮点是引入RTX IO技术,将《半条命2 RTX》文件大小从80GB压缩至50GB,并降低CPU开销。同时,新增AI Agent集成(RTX Remix Skills),允许AI编码代理自动执行复杂的MOD制作步骤,降低非程序员用户的入门门槛。
NVIDIA联合Coherent扩建6英寸磷化铟晶圆厂,光互连成AI基础设施新瓶颈突破口
NVIDIA投资20亿美元并与Coherent签订数十亿美元采购协议,扩建全球首座6英寸磷化铟晶圆厂,规模化生产AI光互连所需的激光器和光模块。此举旨在解决大规模GPU集群(如Vera Rubin Ultra NVL576)中铜缆无法满足距离与功耗的问题,推动共封装光学从实验室走向量产。
AMD MLPerf 6.0:MI350系列用MXFP4实现3.5倍代际提升,多节点训练首秀
AMD在MLPerf Training 6.0中提交了最全面的结果,包括首次多节点训练(FLUX.1在512 GPU上)和MXFP4训练配方。MI355X相比MI300X在Llama 2-70B上实现3.5倍性能提升,且与NVIDIA B200的差距缩小至5%以内。10家生态伙伴验证了可复现性。
NVIDIA联手HPE扩展AI Factory:Vera CPU专为代理AI设计,全栈集成锁定企业基础设施
NVIDIA与HPE宣布扩展AI Factory方案,推出首款代理AI专用CPU Vera(集成于HPE ProLiant DL394 Gen12),以及NVIDIA Agent Toolkit、Confidential Computing和全栈NVIDIA集成(Spectrum-X、BlueField、ConnectX)。该方案旨在将代理AI从概念验证推向生产,提供从训练到部署的完整基础设施。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。
HPE整合Juniper推自驱动网络:AI控制平面统一,锁定用户管理栈
HPE宣布将Juniper网络产品深度整合进其AI数据中心解决方案,扩展自驱动网络策略。新功能包括Mist平台支持CX交换机、Marvis AIOps引入Aruba Central、以及针对推理和扩展架构优化的QFX交换机。统一SASE平台强化零信任安全,旨在通过AI自动化简化跨边缘、园区、数据中心和AI工厂的运维。
AMD与Rackspace共建30MW受管AI算力:从硅层到结果的生态重构
AMD与Rackspace签署协议,分阶段部署30MW基于AMD Instinct GPU(MI355X等)和EPYC CPU的AI计算,构建面向受监管企业的“受管AI堆栈”,提供从裸金属到推理的单一责任方服务,旨在替代传统多厂商集成模式。