情报
AI 生成的结构化厂商动态简报
NVIDIA Vera Rubin NVL72规格公布,量产推迟至2027下半年
NVIDIA公布Vera Rubin NVL72机架级平台详细规格,确认通用可用性推迟至2027年下半年,较GTC时间线晚约六个月。该平台基于Vera CPU和72-GPU相干域,在性能每瓦特和令牌成本上设定新基准,但延迟为现有GB300客户延长了Blackwell生命周期。
英特尔18A工艺量产良率超预期,200亿美元加码AI芯片制造
英特尔18A先进制程正式量产且良率超预期,公司上调2026年资本支出至200亿美元用于AI芯片制造。数据中心与AI事业部营收同比增长59%至63亿美元,占总营收70%,凸显英特尔向AI基础设施的战略重心转移。
微软签超1300亿美元数据中心租赁,长期锁定AI算力资源
微软在最新季度签署超1300亿美元数据中心长期租赁协议,确保Azure、Copilot和OpenAI工作负载的算力供应。未运营设施租赁义务达3291亿美元,显示超大规模云商提前数年预订容量,押注AI需求持续高涨。全年Azure收入首破1000亿美元,Copilot付费席位超3000万。
Azure DDoS防护自定义策略公开预览:精细化网络攻击缓解阈值控制
...
微软Azure AI Gateway预览:统一多云AI安全管控层
微软Azure API Management新增AI Gateway层,支持统一管理来自OpenAI、Anthropic、AWS Bedrock、Google Vertex AI等多提供商的AI模型及MCP服务器,提供一致的安全策略、身份验证和基于OpenTelemetry的可观测性。
NVIDIA Vera Rubin全球部署:每兆瓦Token吞吐量10倍提升,锁定AI工厂标准
NVIDIA宣布Vera Rubin平台全面量产交付,CoreWeave等云厂商已部署NVL72系统。该平台采用Vera CPU和Rubin GPU,每兆瓦Token吞吐量较Blackwell提升10倍,支持千兆瓦级AI工厂,全球超350站点部署。
NVIDIA Rubin GPU:3nm双die 336B晶体管,HBM4与NVLink 6带宽翻倍
NVIDIA在SIGGRAPH 2026公布Rubin GPU完整规格:采用TSMC 3nm工艺双die封装,总计3360亿晶体管,配备288GB HBM4内存和22 TB/s带宽。NVLink 6提供3600 GB/s双向带宽,较上代翻倍。NVL72机架集成72颗Rubin GPU,功耗超1000W,需全液冷散热。
微软Azure举办AI代理生产环境部署技术加速器
...
NVIDIA投资SSI 50亿美元,开放Vera Rubin平台锁定AI安全研究生态
NVIDIA对Ilya Sutskever创办的AI安全公司SSI进行重大股权投资,并开放下一代Vera Rubin GPU平台访问权限。合作超越硬件销售,NVIDIA获得SSI保密研究访问权,研究洞察将反馈至NVIDIA平台路线图,标志着NVIDIA从硬件供应商向深度研究合作伙伴的战略转变。
What customers value most in Microsoft Databases—from reliability to AI readiness | Microsoft Azure Blog
July 27 5 min read What customers value most in Microsoft Databases—from reliability to AI readiness ...
微软1900亿美元资本支出仍无法满足算力需求 Azure面临供应瓶颈
...
SAP与Google Cloud推零拷贝BDC连接,加速AI代理数据访问
SAP和Google Cloud宣布SAP Business Data Cloud Connect for BigQuery正式可用,实现零拷贝双向数据共享。企业可直接在BigQuery中访问SAP数据产品,保留业务语义,降低TCO,为AI代理提供实时运营数据,加速分析和工作流自动化。
阿里云WAIC 2026发布Agent-Native全栈,开源SAIL软件栈挑战CUDA生态
阿里云在WAIC 2026发布Agent-Native云套件(AgentLoop/AgentTeams/AgentRun/TokenWorks),开源T-Head SAIL AI软件栈,推出2.4T参数模型Qwen 3.8-Max-Preview及Zhenwu M890超节点,全面布局Agent-Native云与开源AI生态,意图构建从硬件到平台的全栈竞争力。
微软Azure引入AMD Helios机架级平台,正式打破NVIDIA AI GPU垄断格局
微软Azure宣布将在2026下半年部署AMD Helios机架级AI平台。该平台集成72颗MI455X GPU、18颗Venice CPU及液冷系统,单机架提供2.9 Exaflops FP4推理算力。此举标志着全球第二大云厂商正式摆脱对NVIDIA单一GPU供应商的依赖,开启AI基础设施多架构时代。
Anthropic Claude Opus 5登陆AWS Bedrock,0%注入率挑战OpenAI安全论断
Anthropic发布Claude Opus 5,在AWS Bedrock四个区域GA,同时上线Claude Platform。Auto Mode在129个浏览器代理测试中实现0% prompt injection,反驳OpenAI'无法解决'论。定价$5/$25 per M token,性能领先,半价对标Fable 5。
微软自研MAI模型公开预览:GPU成本降低89%,摆脱OpenAI依赖
微软在Azure Foundry推出自研MAI-Image-2.5-Pro和MAI-Voice-2-Flash,实现8K文字渲染96.8%准确率,GPU成本较GPT系列降低84%-89%。已部署于Bing、PowerPoint、OneDrive等产品,标志着微软从依赖OpenAI转向自研AI的战略转折。同期NVIDIA Jetson登月任务展示太空边缘AI。
AMD Helios投产:12层HBM4容量制胜,开放UALoE挑战NVLink封闭生态
AMD第二代Helios机架AI服务器全面投产,搭载72张MI455X GPU和Samsung独家12层HBM4内存,单机柜31TB。相比NVIDIA Rubin 8层设计,容量提升50%,成本降低30%。微软Azure规模部署,标志Hyperscaler双供应商策略落地。
Anthropic发布Claude Opus 5:半价对标旗舰,AWS集成暗藏控制权转移
Anthropic正式发布Claude Opus 5,API定价与Opus 4.8持平但性能接近Fable 5,实现半价追平旗舰。同时AWS宣布Claude Platform全面上市,将Anthropic API完整集成至AWS IAM/计费/管理,标志控制点从独立API向云平台转移。
Anthropic携手SpaceX获取22万GPU,算力生态从云转向非传统数据中心
Anthropic与SpaceX签署协议,获取Colossus 1数据中心300MW容量及22万块NVIDIA GPU,同时探索轨道AI算力。此举标志着Anthropic从依赖AWS、Google等云厂商转向多元化算力来源,并大幅提升Claude Code使用限制。
Databricks全面Azure化并采用Cobalt 200 ARM,Microsoft锁定AI Agent控制平面
Databricks将全面迁移至Azure,采用Microsoft Cobalt 200 ARM芯片处理数据与AI工作负载,同时深度集成Genie和Unity AI Gateway至Microsoft产品线,形成长期锁定。Databricks完成188亿美元估值融资。