情报
AI 生成的结构化厂商动态简报
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
中国LineShine超算登顶TOP500:纯CPU架构突破2 ExaFLOPS,ARMv9+HBM成新范式
LineShine超级计算机基于13.79百万个ARMv9核心、20480节点,实现2.198 ExaFLOPS FP64持续性能,成为全球首个突破2 ExaFLOPS的系统。它完全依赖CPU(无GPU加速),每个节点配备双LX2 CPU(304核)和32GB HBM,展示了CPU+HBM架构在HPC领域的潜力。
Nokia, Amazon Web Services expand collaboration to deliver autonomous networks built for the AI era
...
NVIDIA发布45°C高温液冷系统,Rubin芯片承诺减少100%水耗
NVIDIA为Rubin GPU推出高温液冷系统,冷却液温度45°C(高于热水浴缸),利用室外干冷却器实现闭环运行,宣称可减少电耗并消除水蒸发(水耗减少100%)。但系统在炎热气候下仍需冷水机组备用,且电力来源和芯片寿命影响未明确。
NVIDIA发布Agent Toolkit:以Nemotron模型和OpenShell运行时构建专用AI Agent生态
NVIDIA推出Agent Toolkit,包含Nemotron开源模型、NemoClaw安全蓝图和OpenShell运行时,为企业构建可定制、安全、低成本的专用AI Agent提供开放模块化基础。该工具包已应用于生命科学、网络安全、工业等领域,旨在将通用模型转化为领域专属的数字同事。
OpenAI GPT-5.6:150万Token上下文与数字员工定位,低价合围Anthropic
OpenAI计划发布GPT-5.6,上下文窗口扩展至150万Token,Token效率提升10-15%,价格仅为Claude Fable 5的三分之一。模型定位从对话助手转向数字员工,支持agentic workflows、代码生成与Playwright自动化。此举旨在合围Anthropic并抢占停服的Fable 5市场。
美光与Anthropic合作:用稀缺叙事锁定AI内存需求,但股价已透支预期
美光与Anthropic签署长期供应合同,涵盖HBM、DRAM和SSD全产品线,并联合分析AI工作负载的内存子系统。同时,美光参与Anthropic H轮融资。此举旨在将内存从商品转化为AI基础设施资产,但股价已大幅上涨,市场需验证稀缺溢价能否持续。
AMD MI430X以200+ TFLOPS原生FP64性能,重新定义HPC与AI融合算力基线
AMD在TOP500榜单中驱动4台前十超算,并预览MI430X GPU,承诺超过200 TFLOPS原生FP64性能。此举直接针对AI for Science场景,将双精度计算作为下一代HPC与AI融合基础设施的核心指标,对NVIDIA和Intel形成直接竞争压力。
NVIDIA借AI代理与数字孪生重塑电信网络控制平面
NVIDIA在DTW Ignite 2026展示其AI代理平台,集成NeMo合成数据、NemoClaw安全运行时、OpenShell沙箱及RTX PRO 6000加速的数字孪生,旨在实现电信网络自主运营。合作伙伴包括SoftBank、Amdocs、NTT DATA等,共同推动从任务自动化向自主网络转型。
AWS Lambda推出MicroVMs:用Firecracker快照打破无服务器有状态隔离困局
AWS发布Lambda MicroVMs,基于Firecracker提供虚拟机级隔离、近即时启动/恢复、有状态执行。用户通过Dockerfile和S3构建镜像,从快照启动,支持自动挂起/恢复,适合多租户AI代码执行、交互式分析等场景。
Arm服务器收入占比超45%,AI驱动下x86生态面临重构
IDC数据显示,2026年Q1全球服务器市场收入创纪录达1226亿美元,其中Arm架构服务器收入占比超过45%,x86降至52%。加速服务器(GPU/ASIC/FPGA)贡献超70%收入。Nvidia Grace CPU(NVL72)及超大规模厂商自研Arm芯片是主要驱动力,x86在出货量上仍占优但受供应限制。
ASML CEO认可马斯克Terafab可行性,AI芯片供应链面临生态重构
ASML CEO公开表示正在跟踪马斯克计划中的太瓦级AI超级计算机Terafab,并将其与韩国DRAM巨型项目类比。这标志着全球唯一EUV光刻机供应商已为该巨型项目预留产能,可能彻底改变AI芯片的垂直整合与供应链格局。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
OpenAI GPT-5.6激进定价与150万上下文窗口,加速Agent化转型
OpenAI传闻发布GPT-5.6,上下文扩展至150万token,定价仅为Claude Fable 5的三分之一,并强化Agent可靠性。此举意在利用Anthropic被下线窗口期抢占市场,同时修复reward hacking事故。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
NVIDIA Rubin全液冷突破45°C,冷却能耗骤降40%
NVIDIA Rubin代AI服务器实现100%液冷,冷却液温度高达45°C,无风扇、无冷热通道。DSX参考设计采用封闭循环干冷器,零水消耗,冷却能耗降低约40%。该架构使机架密度提升3倍,推动AI工厂冷却范式根本转变。
AWS 推出 AgentCore 与 MCP 网关,夺取企业 AI 代理控制平面
AWS 发布 Bedrock AgentCore 托管 Web 搜索、Amazon Quick 自主代理、LangChain 子代理编排及 MCP 网关,将企业 AI 代理从实验原型转向可治理基础设施,核心控制点从模型转向云原生控制平面与执行隔离。
思科收购WideField:将身份会话智能注入Splunk Agentic SOC,争夺AI代理安全控制平面
思科宣布收购WideField Security,将其身份与会话智能能力整合进Splunk的Agentic SOC。此举旨在解决AI代理、非人类身份等机器速度活动带来的新型安全风险,通过确定性数据管道和会话级信号,实现证据驱动的自主响应,强化Cisco Data Fabric中的信任层。
思科借NVIDIA Spectrum硅片与Nexus One统一管理,重塑AI网络控制层
思科发布N9100系列交换机,采用NVIDIA Spectrum-6/4硅片,支持102.4T吞吐量。同时推出Nexus One统一管理平面,整合NX-OS与SONiC,并通过BlueField DPU将安全策略下沉,实现AI工厂的端到端控制与安全卸载。