情报
AI 生成的结构化厂商动态简报
亚马逊CloudWatch发布Coding Agent Insights监控AI编码工具
...
Anthropic Claude Opus 5登陆AWS Bedrock,0%注入率挑战OpenAI安全论断
Anthropic发布Claude Opus 5,在AWS Bedrock四个区域GA,同时上线Claude Platform。Auto Mode在129个浏览器代理测试中实现0% prompt injection,反驳OpenAI'无法解决'论。定价$5/$25 per M token,性能领先,半价对标Fable 5。
Anthropic发布Claude Opus 5:半价对标旗舰,AWS集成暗藏控制权转移
Anthropic正式发布Claude Opus 5,API定价与Opus 4.8持平但性能接近Fable 5,实现半价追平旗舰。同时AWS宣布Claude Platform全面上市,将Anthropic API完整集成至AWS IAM/计费/管理,标志控制点从独立API向云平台转移。
Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛
Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。
NVIDIA CUDA 13.3新增clmad指令,硬件加速无进位乘法,加密性能跃升
NVIDIA在CUDA 13.3中为Ampere及以上GPU新增clmad硬件指令,实现无进位乘累加。GHASH吞吐量达6.3 TB/s(B200),较bitsliced方案提升18.8倍;零知识证明sum-check协议加速3-13倍。该指令还适用于CRC、Reed-Solomon等编码。
OpenClaw漏洞揭示AI助手主机执行环境成新攻击面,命令注入可致RCE
OpenClaw个人AI助手曝出3个严重漏洞(CVSS 8.8/8.4),包括命令注入和路径遍历,攻击链可从凭据窃取直达主机任意代码执行。这印证了AI助手主机执行环境已成为关键攻击面,传统漏洞与AI代理风险叠加。
NVIDIA发布Vera CPU:以最大单线程性能重构AI Agent生态
NVIDIA推出Vera CPU,专为AI Agent工作负载设计,采用Olympus核心,提供比x86高1.8倍的持续每核心性能。该CPU与NVIDIA GPU和BlueField统一架构,旨在构建AI工厂的统一计算平台,挑战现有x86 CPU生态。
AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters
...
When AI Invents the Attack: Browser-Native Ransomware
...
Anthropic指控阿里系发起史上最大AI蒸馏攻击,暴露API安全致命漏洞
Anthropic向美国参议员致信,指控与阿里相关的运营商通过约2.5万个欺诈账户发起2880万次模型交换,系统性地提取Claude前沿能力。此事件凸显AI模型API面临的新型大规模蒸馏威胁,迫使行业重新评估推理端点安全与使用监控。
Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式
Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。
Cisco Live US & InfoComm 2026 : la collaboration entre dans l’ère agentique
...
AWS Lambda推出MicroVMs:用Firecracker快照打破无服务器有状态隔离困局
AWS发布Lambda MicroVMs,基于Firecracker提供虚拟机级隔离、近即时启动/恢复、有状态执行。用户通过Dockerfile和S3构建镜像,从快照启动,支持自动挂起/恢复,适合多租户AI代码执行、交互式分析等场景。
Arm服务器收入占比超45%,AI驱动下x86生态面临重构
IDC数据显示,2026年Q1全球服务器市场收入创纪录达1226亿美元,其中Arm架构服务器收入占比超过45%,x86降至52%。加速服务器(GPU/ASIC/FPGA)贡献超70%收入。Nvidia Grace CPU(NVL72)及超大规模厂商自研Arm芯片是主要驱动力,x86在出货量上仍占优但受供应限制。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
美光与Anthropic战略合作:内存与AI模型深度绑定,重构供应链生态
美光与Anthropic达成战略协议,涵盖AI内存/存储架构联合设计、长期供应合同、内部采用Claude以及H轮投资。此举将前沿AI模型需求直接映射到基础设施设计,旨在优化token经济学与能效,但实质是供应锁定与生态重构。
戴尔XE8812服务器:NVIDIA Vera Rubin NVL4的液冷密度陷阱
戴尔发布PowerEdge XE8812服务器,采用NVIDIA Vera Rubin NVL4架构,每机架支持144颗GPU、300kW+功耗、100%直接液冷。该平台为HPC和AI大模型提供内存和计算密度代际跃升,但深度绑定Dell PowerRack、iDRAC和ORv3标准,形成从芯片到机架的全面锁定。
AWS Agentic AI平台化:Bedrock AgentCore整合知识、安全与运维
AWS在2026年峰会上推出以Bedrock AgentCore为核心的Agentic AI平台,提供托管知识库、机器速度安全(Continuum)、持续现代化(Transform)及DevOps Agent等服务,将知识连接、安全治理、代码维护直接嵌入代理平台,减少企业自定义集成负担。
Nvidia ENPIRE框架:AI编码代理自主训练机器人安装GPU,实现99%成功率
Nvidia GEAR实验室与CMU、UC Berkeley联合发布ENPIRE框架,利用Codex、Claude Code等AI编码代理自主编写机器人训练代码、测试并迭代,在GPU安装等接触密集型任务上达到99%成功率。系统通过Git共享结果,无需人类干预,但token消耗随规模超线性增长,仿真到现实仍有差距。
NVIDIA RTX Remix 1.5:用RTX IO压缩和AI Agent重塑游戏MOD生态,强化GPU锁定
NVIDIA发布RTX Remix 1.5更新,核心亮点是引入RTX IO技术,将《半条命2 RTX》文件大小从80GB压缩至50GB,并降低CPU开销。同时,新增AI Agent集成(RTX Remix Skills),允许AI编码代理自动执行复杂的MOD制作步骤,降低非程序员用户的入门门槛。