情报
AI 生成的结构化厂商动态简报
台积电全先进制程涨价5-10%,AI芯片成本压力加剧
台积电通知客户将对7nm及以上所有先进制程涨价5-10%,覆盖其74%的晶圆营收。苹果、英伟达、AMD等厂商面临更高制造成本,可能传导至终端AI基础设施价格。
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
中国LineShine超算登顶TOP500:纯CPU架构突破2 ExaFLOPS,ARMv9+HBM成新范式
LineShine超级计算机基于13.79百万个ARMv9核心、20480节点,实现2.198 ExaFLOPS FP64持续性能,成为全球首个突破2 ExaFLOPS的系统。它完全依赖CPU(无GPU加速),每个节点配备双LX2 CPU(304核)和32GB HBM,展示了CPU+HBM架构在HPC领域的潜力。
NVIDIA发布45°C高温液冷系统,Rubin芯片承诺减少100%水耗
NVIDIA为Rubin GPU推出高温液冷系统,冷却液温度45°C(高于热水浴缸),利用室外干冷却器实现闭环运行,宣称可减少电耗并消除水蒸发(水耗减少100%)。但系统在炎热气候下仍需冷水机组备用,且电力来源和芯片寿命影响未明确。
美光与Anthropic合作:用稀缺叙事锁定AI内存需求,但股价已透支预期
美光与Anthropic签署长期供应合同,涵盖HBM、DRAM和SSD全产品线,并联合分析AI工作负载的内存子系统。同时,美光参与Anthropic H轮融资。此举旨在将内存从商品转化为AI基础设施资产,但股价已大幅上涨,市场需验证稀缺溢价能否持续。
NVIDIA全栈统治超算TOP500:Grace CPU与InfiniBand锁定AI基础设施生态
NVIDIA宣布其技术驱动了81%的TOP500超算,其中Grace CPU部署增至26台,Quantum InfiniBand连接376台。全栈策略(GPU+CPU+网络)正在将超算采购从开放组件转向单一供应商锁定,Green500前八名均使用NVIDIA GPU。
AMD MI430X以200+ TFLOPS原生FP64性能,重新定义HPC与AI融合算力基线
AMD在TOP500榜单中驱动4台前十超算,并预览MI430X GPU,承诺超过200 TFLOPS原生FP64性能。此举直接针对AI for Science场景,将双精度计算作为下一代HPC与AI融合基础设施的核心指标,对NVIDIA和Intel形成直接竞争压力。
AWS Lambda推出MicroVMs:用Firecracker快照打破无服务器有状态隔离困局
AWS发布Lambda MicroVMs,基于Firecracker提供虚拟机级隔离、近即时启动/恢复、有状态执行。用户通过Dockerfile和S3构建镜像,从快照启动,支持自动挂起/恢复,适合多租户AI代码执行、交互式分析等场景。
Arm服务器收入占比超45%,AI驱动下x86生态面临重构
IDC数据显示,2026年Q1全球服务器市场收入创纪录达1226亿美元,其中Arm架构服务器收入占比超过45%,x86降至52%。加速服务器(GPU/ASIC/FPGA)贡献超70%收入。Nvidia Grace CPU(NVL72)及超大规模厂商自研Arm芯片是主要驱动力,x86在出货量上仍占优但受供应限制。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
美光与Anthropic战略合作:内存与AI模型深度绑定,重构供应链生态
美光与Anthropic达成战略协议,涵盖AI内存/存储架构联合设计、长期供应合同、内部采用Claude以及H轮投资。此举将前沿AI模型需求直接映射到基础设施设计,旨在优化token经济学与能效,但实质是供应锁定与生态重构。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
AMD收购MEXT实现NAND闪存模拟DRAM,AI推理内存成本腰斩
AMD完成对MEXT的收购,其技术使廉价NAND闪存模拟DRAM行为,将可用内存容量提升2-4倍同时成本减半。该能力被直接瞄准AI推理和代理型AI市场,解决内存带宽瓶颈。同时AMD与Rackspace签署30MW AI计算部署协议,2026-2028年落地。
AMD悄然移除消费级Ryzen TSME:安全功能分化锁定企业客户
AMD在未公开声明的情况下,从基于Zen 5的消费级Ryzen处理器中移除了Transparent Secure Memory Encryption (TSME)功能,仅保留给Ryzen PRO系列。该变化始于AGESA 1.2.7.0固件,用户难以在Windows上察觉,但Linux系统可检测到缺失。此举旨在通过安全功能差异化,推动企业用户转向更高价格的PRO产品线。
AMD Threadripper 'Mustang Peak' 曝光:144核、PCIe 6.0、新TR6插槽,但功耗内存瓶颈暗藏
AMD Zen 6 Threadripper Pro 'Mustang Peak' 确认采用2nm工艺、DDR5、PCIe 6.0及全新TR6插槽。基于Powderhorn CCD,核心数最高可达144核(288线程),频率超6GHz。但功耗巨大,内存带宽可能依赖MRDIMM,平台升级成本高昂。
NVIDIA RTX Remix 1.5:用RTX IO压缩和AI Agent重塑游戏MOD生态,强化GPU锁定
NVIDIA发布RTX Remix 1.5更新,核心亮点是引入RTX IO技术,将《半条命2 RTX》文件大小从80GB压缩至50GB,并降低CPU开销。同时,新增AI Agent集成(RTX Remix Skills),允许AI编码代理自动执行复杂的MOD制作步骤,降低非程序员用户的入门门槛。
ASUS联手NVIDIA推出桌面级AI超算,企业AI控制权从云端向本地急剧转移
ASUS发布基于NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip的ExpertCenter Pro ET900N G3桌面系统,提供20 PFLOPS AI算力与748GB一致内存,可运行近万亿参数模型。同时,Coherent在德州扩建磷化铟工厂保障光互联供应,NVIDIA计划发行200-250亿美元债券筹资。
Google Cloud 为 AI Agent 嵌入法律可验证身份,监管驱动架构重构
Google Cloud 为 Gemini Enterprise 和 Vertex AI Agent Engine 引入基于 SPIFFE 的 Agent Identity,并集成 Kakunin 的合规层,将内部 SPIFFE 标识映射为 AWS KMS 生成的 X.509 证书,所有状态变更写入 WORM 审计日志。此举将运行时安全升级为法律可审计的市场参与者身份,以应对 EU AI Act 和 MiCA 的问责要求。
Cisco AI Defense推出Agent Harness专项红队测试,填补Agent安全评估空白
Cisco在AI Defense: Explorer Edition中引入Agent Validation功能,专门针对Agent Harness的独特攻击面(工具路由、间接内容通道、跨会话持久状态)进行自动化红队测试。该功能通过自主侦察、结构化攻击与独立验证,填补了传统对话式安全评估在Agent场景下的空白。