情报
AI 生成的结构化厂商动态简报
Anthropic Claude Opus 5登陆AWS Bedrock,0%注入率挑战OpenAI安全论断
Anthropic发布Claude Opus 5,在AWS Bedrock四个区域GA,同时上线Claude Platform。Auto Mode在129个浏览器代理测试中实现0% prompt injection,反驳OpenAI'无法解决'论。定价$5/$25 per M token,性能领先,半价对标Fable 5。
微软自研MAI模型公开预览:GPU成本降低89%,摆脱OpenAI依赖
微软在Azure Foundry推出自研MAI-Image-2.5-Pro和MAI-Voice-2-Flash,实现8K文字渲染96.8%准确率,GPU成本较GPT系列降低84%-89%。已部署于Bing、PowerPoint、OneDrive等产品,标志着微软从依赖OpenAI转向自研AI的战略转折。同期NVIDIA Jetson登月任务展示太空边缘AI。
美国AI Kill Switch法案提案:强制关停权重塑AI安全基础设施
美国两党议员提出AI Kill Switch法案,授权DHS在loss-of-control场景下紧急关停训练成本超1亿美元且年收入超5亿美元的AI系统。违规罚款高达$2M/天,违反关停令罚款$20M/天。同期,红队研究者声称发现跨模型通用脱狱技术,暴露安全护栏不足。
AMD Helios投产:12层HBM4容量制胜,开放UALoE挑战NVLink封闭生态
AMD第二代Helios机架AI服务器全面投产,搭载72张MI455X GPU和Samsung独家12层HBM4内存,单机柜31TB。相比NVIDIA Rubin 8层设计,容量提升50%,成本降低30%。微软Azure规模部署,标志Hyperscaler双供应商策略落地。
Anthropic携手SpaceX获取22万GPU,算力生态从云转向非传统数据中心
Anthropic与SpaceX签署协议,获取Colossus 1数据中心300MW容量及22万块NVIDIA GPU,同时探索轨道AI算力。此举标志着Anthropic从依赖AWS、Google等云厂商转向多元化算力来源,并大幅提升Claude Code使用限制。
Meta与Anthropic百亿算力租赁:Hyperscaler从租户到房东的生态重构
Meta与Anthropic正就最高100亿美元的算力租赁协议进行早期谈判,标志着Meta Compute从内部自用转向对外商业出租。此举将Meta的巨额AI资本支出转化为可货币化资产,同时开创了Hyperscaler间相互租赁算力的‘Inter-Cloud’模式,重构AI基础设施生态。
NVIDIA联合纬创美国首产GB300,AI制造生态重心转移至德州
NVIDIA携手纬创在德州开设D1工厂,实现GB300 Grace Blackwell Ultra的L6级美国本土集成制造。该工厂投资7亿美元,首台系统含150万零件、重2吨、单价400万美元,并规划Vera Rubin量产。此举标志着美国AI Capex本土化率从5%向30%跃升的关键转折,重塑全球AI供应链格局。
Cisco揭示AI模型多轮攻击88.3%成功率,收购Astrix Security布局Agent安全
Cisco在VB Transform 2026上披露,针对15个旗舰AI模型的6986次多轮攻击中88.3%成功突破防御。同时宣布以4亿美元收购Astrix Security,填补AI Agent身份管理与运行隔离的关键空白,与Palo Alto/CrowdStrike的收购形成行业整合浪潮。
Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛
Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。
OpenAI 200亿美元自建数据中心:AI算力从租赁走向自有控制
OpenAI宣布在佐治亚州启动Project Camellia,投资200亿美元建设3.2GW自建数据中心,从依赖云算力转向自主控制。同时从xAI挖来Colossus核心团队,算力CTO晋升,算力支出预期上调至7500亿美元。
AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink
AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。
NVIDIA千亿投资OpenAI共建10GW AI工厂,Vera Rubin平台深度绑定
NVIDIA与OpenAI签署战略合作,部署至少10GW基于Vera Rubin平台(Rubin GPU、Vera CPU、HBM4、NVLink 6)的AI算力设施,NVIDIA投资最多$1000亿。首批设施2026下半年上线,支撑OpenAI下一代模型训练推理,标志AI算力进入超GW时代。
AMD发布Zen 6 Venice与MI455X,Helios机架级设计挑战NVIDIA
AMD在Advancing AI 2026大会发布基于TSMC 2nm的Zen 6 EPYC Venice(最高256核)和CDNA5架构MI455X(432GB HBM4,40 PFLOPS FP4),推出Helios机架级参考设计(单rack 2.9 exaFLOPS FP4),宣称四年AI性能提升1000倍,获Meta、OpenAI等大客户长期合同。
HPE Private Cloud AI集成Vera Rubin NVL72,推动AI工厂与Agent原生部署
HPE宣布扩展Private Cloud AI产品线,集成NVIDIA Vera Rubin NVL72及HGX Rubin NVL8平台,推出Compute XD700和Cray GX240 blade(搭载Vera CPU)。同时引入Agent Toolkit和NemoClaw,实现Agent原生基础设施,计划Q4 2026推出Alletra Storage MP X10000。
台积电追加千亿美元美国建6座晶圆厂,3nm本土化重塑AI芯片供应链
台积电宣布追加1000亿美元投资美国亚利桑那州,总投资额达2650亿美元,计划建设6座晶圆厂,重点聚焦3nm及更先进制程。此举配合NVIDIA、Apple、AMD等客户的AI算力需求,并将3nm制程美国本土化,彻底改变全球半导体供应链格局。Q2净利同比暴增77%,全年资本支出上调至600-640亿美元。
纽约州签署一年期AI超大规模数据中心禁令,监管化范式转折开启
纽约州签署行政命令,对50MW以上AI超大规模数据中心实施一年建设禁令,立即生效。此举为美国首个全州范围禁令,至少11州正审议类似法案,标志着AI基础设施从'建得快'到'建得稳'的监管范式转折。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。
CrowdStrike集成Claude API:AI Agent安全监控正式成为SOC核心遥测
CrowdStrike将Anthropic Claude Compliance API集成到Falcon平台,在Next-Gen SIEM中统一监控Claude Enterprise/Platform活动日志与对话,并与端点、身份、云遥测关联,实现AI Agent安全可视与自动化响应。
AMD确认Zen 6 EPYC Venice:首款2nm服务器CPU,2026年7月登场
AMD确认将于2026年7月22-23日推出基于Zen 6架构的EPYC Venice服务器CPU,这是业界首款采用2nm制程的芯片。该CPU采用三层混合架构,单核性能提升约29%,多核提升约22%,核心数达128-192核,旨在强化AI推理与CPU-GPU协同。
NVIDIA推动HVDC电力架构,AI数据中心能效与供应链面临重构
NVIDIA正推动AI数据中心从传统交流(AC)向高压直流(HVDC)电力系统转变,旨在减少多次转换损耗,提升能效。此举将重构服务器制造、电力设备及冷却系统全链条,但面临直流电弧安全、标准缺失等挑战,可能加速HVDC在超大规模AI集群的部署。