情报
AI 生成的结构化厂商动态简报
诺基亚MantaRay AutoPilot: 公有云AI控制面接管移动网络优化,15分钟闭环
NTT DOCOMO首次在日本部署诺基亚MantaRay AutoPilot,将AI驱动的网络优化系统运行在公有云上,实现从每日手动参数设计到15分钟全自动闭环的跃迁。系统通过意图驱动(Intent)自动分析基站性能并下发优化指令,目标达到TM Forum Level 4完全自主网络。
AWS 推出 AgentCore 与 MCP 网关,夺取企业 AI 代理控制平面
AWS 发布 Bedrock AgentCore 托管 Web 搜索、Amazon Quick 自主代理、LangChain 子代理编排及 MCP 网关,将企业 AI 代理从实验原型转向可治理基础设施,核心控制点从模型转向云原生控制平面与执行隔离。
Cisco Global Overview:将Catalyst Center控制权转移至Meraki云管理平台
Cisco推出Global Overview,将Catalyst Center本地管理数据整合至Meraki云仪表板,实现统一可见性、全局搜索和跨环境故障排除。该功能强制Catalyst Center升级至2.3.7.10 SMU 100版本,并作为Cisco Cloud Control跨域AI管理平台的前奏,推动用户从本地管理向云订阅迁移。
Google AI Studio Starter Tier:预配置无服务器堆栈,以生态锁定换取零门槛部署
Google推出AI Studio Starter Tier,提供预配置的Cloud Run、Firestore、Cloud SQL for PostgreSQL和Firebase Authentication堆栈,无需支付方式即可从原型到上线。该层锁定单区域、有限API和共享配额,但支持无缝升级到完整GCP项目,旨在降低AI应用部署门槛并强化生态绑定。
AMD收购MEXT实现NAND闪存模拟DRAM,AI推理内存成本腰斩
AMD完成对MEXT的收购,其技术使廉价NAND闪存模拟DRAM行为,将可用内存容量提升2-4倍同时成本减半。该能力被直接瞄准AI推理和代理型AI市场,解决内存带宽瓶颈。同时AMD与Rackspace签署30MW AI计算部署协议,2026-2028年落地。
AWS Agentic AI平台化:Bedrock AgentCore整合知识、安全与运维
AWS在2026年峰会上推出以Bedrock AgentCore为核心的Agentic AI平台,提供托管知识库、机器速度安全(Continuum)、持续现代化(Transform)及DevOps Agent等服务,将知识连接、安全治理、代码维护直接嵌入代理平台,减少企业自定义集成负担。
NVIDIA借法国AI基建合围欧洲:开放模型Nemotron背后的硬件锁定
NVIDIA联合法国政府、Mistral、Scaleway等部署GB200、Blackwell B300及Vera Rubin NVL72硬件,并通过Nemotron开放模型联盟吸引LINAGORA、H Company等,构建以NVIDIA为中心的AI基础设施生态,表面开放实则强化硬件依赖。
Nvidia ENPIRE框架:AI编码代理自主训练机器人安装GPU,实现99%成功率
Nvidia GEAR实验室与CMU、UC Berkeley联合发布ENPIRE框架,利用Codex、Claude Code等AI编码代理自主编写机器人训练代码、测试并迭代,在GPU安装等接触密集型任务上达到99%成功率。系统通过Git共享结果,无需人类干预,但token消耗随规模超线性增长,仿真到现实仍有差距。
Introducing Amazon Bedrock Managed Knowledge Base for faster, more accurate enterprise AI applications
...
AWS Trainium 以 80% MFU 突破世界模型训练性价比拐点
AWS 宣称其自研 AI 芯片 Trainium 在训练世界模型(world models)时达到 80% 模型算力利用率(MFU),近乎行业平均的两倍。通过通用指令集设计和持续高负载散热能力,Trainium 正在吸引 Odyssey、DeCart AI 等初创公司,挑战 Nvidia GPU 在 AI 训练领域的主导地位。
ASUS联手NVIDIA推出桌面级AI超算,企业AI控制权从云端向本地急剧转移
ASUS发布基于NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip的ExpertCenter Pro ET900N G3桌面系统,提供20 PFLOPS AI算力与748GB一致内存,可运行近万亿参数模型。同时,Coherent在德州扩建磷化铟工厂保障光互联供应,NVIDIA计划发行200-250亿美元债券筹资。
华为LogicFolding架构:以3D堆叠绕过制程封锁,重塑AI芯片竞争格局
华为提出Tau Scaling Law和LogicFolding架构,通过垂直堆叠逻辑单元实现晶体管密度提升55%、能效提升41%,并宣称2031年可达1.4nm等效。同时Ascend 920/910C芯片已用于训练DeepSeek V4-Pro模型,证明其AI芯片从理论走向实战,威胁Nvidia在华市场。
Cisco AI Defense推出Agent Harness专项红队测试,填补Agent安全评估空白
Cisco在AI Defense: Explorer Edition中引入Agent Validation功能,专门针对Agent Harness的独特攻击面(工具路由、间接内容通道、跨会话持久状态)进行自动化红队测试。该功能通过自主侦察、结构化攻击与独立验证,填补了传统对话式安全评估在Agent场景下的空白。
AWS S3推出Annotations:1GB可变元数据直接嵌入对象,重塑AI数据湖元数据范式
AWS发布S3 Annotations,允许为每个对象附加最多1,000个、每个1MB的注解,总计1GB,支持JSON/XML/YAML,可随时修改。注解自动索引到Apache Iceberg表,可通过Athena查询,无需恢复对象或支付检索费。此举将元数据管理从外部数据库内嵌到存储层,彻底改变AI代理和数据湖的元数据架构。
NVIDIA ACE本地化:用RTX硬件锁定游戏AI,控制点从云端移至GPU
NVIDIA发布ACE Game Agent SDK(开源C/C++框架)和UE5插件(ASR/SLM/TTS),将AI NPC推理完全本地化至GeForce RTX。配套DLSS 4.5插件支持多帧生成。此举旨在将游戏AI控制权从云服务商转移到NVIDIA GPU生态,但隐藏了硬件锁定与模型性能折衷。
NVIDIA联手HPE扩展AI Factory:Vera CPU专为代理AI设计,全栈集成锁定企业基础设施
NVIDIA与HPE宣布扩展AI Factory方案,推出首款代理AI专用CPU Vera(集成于HPE ProLiant DL394 Gen12),以及NVIDIA Agent Toolkit、Confidential Computing和全栈NVIDIA集成(Spectrum-X、BlueField、ConnectX)。该方案旨在将代理AI从概念验证推向生产,提供从训练到部署的完整基础设施。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。
Palo Alto GlobalProtect VPN遭主动利用:远程代码执行漏洞暴露企业网关防线脆弱性
Palo Alto Networks GlobalProtect VPN曝出严重漏洞,允许未认证攻击者远程执行任意代码,且已在野被主动利用。该漏洞直接威胁依赖VPN进行远程接入的企业网络边界,凸显了在混合办公模式下,VPN设备作为关键入口点的脆弱性。安全团队需立即修补并审查日志。
NVIDIA力推World-Action模型:机器人控制权从语言转向视频基础模型
NVIDIA发表深度技术博客,提出World-Action Model(WAM)作为VLM-based VLA的替代路线。WAM利用预训练视频/世界模型骨干,同时预测未来状态和机器人动作,旨在克服VLA的语言-动作接地鸿沟。该范式可能重塑机器人基础模型训练格局,但面临推理成本和实时性挑战。
NVIDIA携ASUS推桌面级DGX Station:GB300芯片下放,控制点从云转向本地硬件生态
ASUS发布ExpertCenter Pro ET900N G3,基于NVIDIA DGX Station GB300架构,搭载GB300 Grace Blackwell Ultra芯片,提供748GB统一内存和20 PFLOPS AI性能。该桌面级AI超算支持本地LLM微调、推理及AI agent工作负载,通过NVLink-C2C实现高速互连,并集成NVIDIA AI软件栈与NemoClaw框架。