情报
AI 生成的结构化厂商动态简报
AWS 推出 AgentCore 与 MCP 网关,夺取企业 AI 代理控制平面
AWS 发布 Bedrock AgentCore 托管 Web 搜索、Amazon Quick 自主代理、LangChain 子代理编排及 MCP 网关,将企业 AI 代理从实验原型转向可治理基础设施,核心控制点从模型转向云原生控制平面与执行隔离。
Google AI Studio Starter Tier:预配置无服务器堆栈,以生态锁定换取零门槛部署
Google推出AI Studio Starter Tier,提供预配置的Cloud Run、Firestore、Cloud SQL for PostgreSQL和Firebase Authentication堆栈,无需支付方式即可从原型到上线。该层锁定单区域、有限API和共享配额,但支持无缝升级到完整GCP项目,旨在降低AI应用部署门槛并强化生态绑定。
AMD收购MEXT实现NAND闪存模拟DRAM,AI推理内存成本腰斩
AMD完成对MEXT的收购,其技术使廉价NAND闪存模拟DRAM行为,将可用内存容量提升2-4倍同时成本减半。该能力被直接瞄准AI推理和代理型AI市场,解决内存带宽瓶颈。同时AMD与Rackspace签署30MW AI计算部署协议,2026-2028年落地。
NVIDIA 4亿美元收购Kumo AI:从GPU算力到结构化数据预测的生态扩张
NVIDIA以超4亿美元收购企业预测AI公司Kumo AI,强化其在客户流失、库存优化等领域的图神经网络与时序分析能力。此举将NVIDIA从GPU加速计算延伸至企业数据智能层,与HPE等伙伴合作构建AI工厂解决方案,展示Vera CPU架构与代理式AI验证设计。
Tesco百亿英镑诉讼撕开Broadcom VMware订阅锁链,企业虚拟化生态面临重构
Tesco因Broadcom收购VMware后取消永久许可并涨价237%起诉,涉及约4万工作负载。此案动摇了企业软件许可信任,可能引发大规模迁移潮,Nutanix、Red Hat等替代方案迎来历史性机遇。
NVIDIA借法国AI基建合围欧洲:开放模型Nemotron背后的硬件锁定
NVIDIA联合法国政府、Mistral、Scaleway等部署GB200、Blackwell B300及Vera Rubin NVL72硬件,并通过Nemotron开放模型联盟吸引LINAGORA、H Company等,构建以NVIDIA为中心的AI基础设施生态,表面开放实则强化硬件依赖。
Introducing Amazon Bedrock Managed Knowledge Base for faster, more accurate enterprise AI applications
...
AMD Threadripper 'Mustang Peak' 曝光:144核、PCIe 6.0、新TR6插槽,但功耗内存瓶颈暗藏
AMD Zen 6 Threadripper Pro 'Mustang Peak' 确认采用2nm工艺、DDR5、PCIe 6.0及全新TR6插槽。基于Powderhorn CCD,核心数最高可达144核(288线程),频率超6GHz。但功耗巨大,内存带宽可能依赖MRDIMM,平台升级成本高昂。
HPE整合Morpheus与GreenLake,打造统一代理控制平面锁定混合云与AI
HPE宣布将Morpheus软件深度集成至GreenLake平台,提供统一代理编排与控制平面,覆盖AI工厂和传统工作负载。同时推出GreenLake Intelligence代理AIOps,并与ServiceNow、Citrix深化合作,旨在以单一运营模型降低虚拟化成本、简化混合云复杂性。
AWS Trainium 以 80% MFU 突破世界模型训练性价比拐点
AWS 宣称其自研 AI 芯片 Trainium 在训练世界模型(world models)时达到 80% 模型算力利用率(MFU),近乎行业平均的两倍。通过通用指令集设计和持续高负载散热能力,Trainium 正在吸引 Odyssey、DeCart AI 等初创公司,挑战 Nvidia GPU 在 AI 训练领域的主导地位。
ASUS联手NVIDIA推出桌面级AI超算,企业AI控制权从云端向本地急剧转移
ASUS发布基于NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip的ExpertCenter Pro ET900N G3桌面系统,提供20 PFLOPS AI算力与748GB一致内存,可运行近万亿参数模型。同时,Coherent在德州扩建磷化铟工厂保障光互联供应,NVIDIA计划发行200-250亿美元债券筹资。
NVIDIA联合Coherent扩建6英寸InP晶圆厂,锁定AI光学互连供应链
Coherent在德州扩建全球首座6英寸磷化铟晶圆厂,NVIDIA投资20亿美元并承诺数十亿美元采购。该厂生产激光器、收发器和可插拔光学模块,支撑NVIDIA Vera Rubin Ultra NVL576等576-GPU集群的硅光子互连,标志着AI数据中心从铜缆向光通信的规模化转折。
华为LogicFolding架构:以3D堆叠绕过制程封锁,重塑AI芯片竞争格局
华为提出Tau Scaling Law和LogicFolding架构,通过垂直堆叠逻辑单元实现晶体管密度提升55%、能效提升41%,并宣称2031年可达1.4nm等效。同时Ascend 920/910C芯片已用于训练DeepSeek V4-Pro模型,证明其AI芯片从理论走向实战,威胁Nvidia在华市场。
Cisco AI Defense推出Agent Harness专项红队测试,填补Agent安全评估空白
Cisco在AI Defense: Explorer Edition中引入Agent Validation功能,专门针对Agent Harness的独特攻击面(工具路由、间接内容通道、跨会话持久状态)进行自动化红队测试。该功能通过自主侦察、结构化攻击与独立验证,填补了传统对话式安全评估在Agent场景下的空白。
AWS S3推出Annotations:1GB可变元数据直接嵌入对象,重塑AI数据湖元数据范式
AWS发布S3 Annotations,允许为每个对象附加最多1,000个、每个1MB的注解,总计1GB,支持JSON/XML/YAML,可随时修改。注解自动索引到Apache Iceberg表,可通过Athena查询,无需恢复对象或支付检索费。此举将元数据管理从外部数据库内嵌到存储层,彻底改变AI代理和数据湖的元数据架构。
NVIDIA联合Coherent扩建6英寸磷化铟晶圆厂,光互连成AI基础设施新瓶颈突破口
NVIDIA投资20亿美元并与Coherent签订数十亿美元采购协议,扩建全球首座6英寸磷化铟晶圆厂,规模化生产AI光互连所需的激光器和光模块。此举旨在解决大规模GPU集群(如Vera Rubin Ultra NVL576)中铜缆无法满足距离与功耗的问题,推动共封装光学从实验室走向量产。
高通豪赌RISC-V:收购Tenstorrent,力推边缘AI与数据中心自主架构
高通宣布从ARM转向开源RISC-V架构,已收购Ventana Micro并计划以80-100亿美元收购Tenstorrent,打造基于RISC-V的AI加速器。同时推出‘Dragonfly’品牌,目标2031年数据中心收入超350亿美元,全面押注边缘AI和AI代理。
AMD MLPerf 6.0:MI350系列用MXFP4实现3.5倍代际提升,多节点训练首秀
AMD在MLPerf Training 6.0中提交了最全面的结果,包括首次多节点训练(FLUX.1在512 GPU上)和MXFP4训练配方。MI355X相比MI300X在Llama 2-70B上实现3.5倍性能提升,且与NVIDIA B200的差距缩小至5%以内。10家生态伙伴验证了可复现性。
NVIDIA联手HPE扩展AI Factory:Vera CPU专为代理AI设计,全栈集成锁定企业基础设施
NVIDIA与HPE宣布扩展AI Factory方案,推出首款代理AI专用CPU Vera(集成于HPE ProLiant DL394 Gen12),以及NVIDIA Agent Toolkit、Confidential Computing和全栈NVIDIA集成(Spectrum-X、BlueField、ConnectX)。该方案旨在将代理AI从概念验证推向生产,提供从训练到部署的完整基础设施。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。