情报
AI 生成的结构化厂商动态简报
NVIDIA Vera Rubin NVL72规格公布,量产推迟至2027下半年
NVIDIA公布Vera Rubin NVL72机架级平台详细规格,确认通用可用性推迟至2027年下半年,较GTC时间线晚约六个月。该平台基于Vera CPU和72-GPU相干域,在性能每瓦特和令牌成本上设定新基准,但延迟为现有GB300客户延长了Blackwell生命周期。
NVIDIA美国制造启航:纬创工厂量产GB300与Vera Rubin,重构AI供应链
纬创在德克萨斯州沃斯堡开设首座美国制造工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该工厂投资7亿美元,计划月产数万块板,标志着NVIDIA供应链本土化的重大转折。
Meta斥资500亿美元扩建5GW数据中心,以Local-First模式重构AI基础设施生态
Meta将路易斯安那州Hyperion数据中心扩建至5GW容量,总投资从100亿美元跃升至500亿美元。通过与Entergy合作自建10座发电设施和240英里输电线,并采用合资与融资模式,Meta正在开创AI基础设施的Local-First时代,彻底改变数据中心与能源、资本的协作方式。
高通发布Dragonfly数据中心CPU与HBC内存,以推理优先架构挑战NVIDIA霸权
高通在投资者日公布完整数据中心路线图,包括250核Oryon CPU(Dragonfly C1000)、近内存计算HBC(声称133TB/s带宽)、AI300推理加速器(54x带宽提升),以及800G/1.6T互联。与Meta签署多年CPU供应协议,2028年商用,旨在以低功耗高带宽颠覆AI推理市场。
Cisco Live US & InfoComm 2026 : la collaboration entre dans l’ère agentique
...
NVIDIA借AI代理与数字孪生重塑电信网络控制平面
NVIDIA在DTW Ignite 2026展示其AI代理平台,集成NeMo合成数据、NemoClaw安全运行时、OpenShell沙箱及RTX PRO 6000加速的数字孪生,旨在实现电信网络自主运营。合作伙伴包括SoftBank、Amdocs、NTT DATA等,共同推动从任务自动化向自主网络转型。
Nvidia Vera Rubin CPU: 10-wide核心颠覆CPU设计,锁定代理计算生态
Nvidia在GTC Taipei 2026公布Vera Rubin CPU架构,采用完全自定义10-wide指令流水线核心,IPC和带宽远超现有CPU。该CPU专为代理计算设计,旨在与GPU协同,同时Nvidia宣布与Microsoft合作重新定义PC为Personal AI,并承诺50%自由现金流回报。
NVIDIA JUPITER超算验证Grace Hopper平台:百亿亿次科学计算进入生产阶段
欧洲首台百亿亿次超算JUPITER基于NVIDIA Grace Hopper Superchips和Quantum-X800 InfiniBand,完成了人类大脑细胞级图谱、1公里分辨率气候模拟、6G AI模型训练和50量子比特量子计算模拟,标志着百亿亿次计算从研究走向生产。
NVIDIA Rubin全液冷突破45°C,冷却能耗骤降40%
NVIDIA Rubin代AI服务器实现100%液冷,冷却液温度高达45°C,无风扇、无冷热通道。DSX参考设计采用封闭循环干冷器,零水消耗,冷却能耗降低约40%。该架构使机架密度提升3倍,推动AI工厂冷却范式根本转变。
AWS Agentic AI平台化:Bedrock AgentCore整合知识、安全与运维
AWS在2026年峰会上推出以Bedrock AgentCore为核心的Agentic AI平台,提供托管知识库、机器速度安全(Continuum)、持续现代化(Transform)及DevOps Agent等服务,将知识连接、安全治理、代码维护直接嵌入代理平台,减少企业自定义集成负担。
NVIDIA借法国AI基建合围欧洲:开放模型Nemotron背后的硬件锁定
NVIDIA联合法国政府、Mistral、Scaleway等部署GB200、Blackwell B300及Vera Rubin NVL72硬件,并通过Nemotron开放模型联盟吸引LINAGORA、H Company等,构建以NVIDIA为中心的AI基础设施生态,表面开放实则强化硬件依赖。
ASUS联手NVIDIA推出桌面级AI超算,企业AI控制权从云端向本地急剧转移
ASUS发布基于NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip的ExpertCenter Pro ET900N G3桌面系统,提供20 PFLOPS AI算力与748GB一致内存,可运行近万亿参数模型。同时,Coherent在德州扩建磷化铟工厂保障光互联供应,NVIDIA计划发行200-250亿美元债券筹资。
NVIDIA联合Coherent扩建6英寸InP晶圆厂,锁定AI光学互连供应链
Coherent在德州扩建全球首座6英寸磷化铟晶圆厂,NVIDIA投资20亿美元并承诺数十亿美元采购。该厂生产激光器、收发器和可插拔光学模块,支撑NVIDIA Vera Rubin Ultra NVL576等576-GPU集群的硅光子互连,标志着AI数据中心从铜缆向光通信的规模化转折。
NVIDIA联合Coherent扩建6英寸磷化铟晶圆厂,光互连成AI基础设施新瓶颈突破口
NVIDIA投资20亿美元并与Coherent签订数十亿美元采购协议,扩建全球首座6英寸磷化铟晶圆厂,规模化生产AI光互连所需的激光器和光模块。此举旨在解决大规模GPU集群(如Vera Rubin Ultra NVL576)中铜缆无法满足距离与功耗的问题,推动共封装光学从实验室走向量产。
NVIDIA携ASUS推桌面级DGX Station:GB300芯片下放,控制点从云转向本地硬件生态
ASUS发布ExpertCenter Pro ET900N G3,基于NVIDIA DGX Station GB300架构,搭载GB300 Grace Blackwell Ultra芯片,提供748GB统一内存和20 PFLOPS AI性能。该桌面级AI超算支持本地LLM微调、推理及AI agent工作负载,通过NVLink-C2C实现高速互连,并集成NVIDIA AI软件栈与NemoClaw框架。
NVIDIA联手Google DeepMind推出并行文本生成模型,吞吐量突破1000 tokens/sec
NVIDIA宣布与Google DeepMind合作优化DiffusionGemma,该模型基于扩散去噪实现每步并行生成256个token,在单个H100上达到1000 tokens/sec,并通过NIM和NeMo提供即用部署,显著降低推理成本和延迟。
NVIDIA借DiffusionGemma并行生成,将本地AI推理控制权锁定于自家GPU
NVIDIA优化Google DeepMind的DiffusionGemma开源模型,该模型通过并行生成256 tokens(非逐token)实现4倍加速。在H100上达1000 tokens/sec,DGX Spark上150 tokens/sec,完全本地运行,无云成本。此举强化了NVIDIA GPU在计算密集型本地AI推理中的核心地位。
思科Silicon One扩展至校园:以芯片内嵌控制锁定Agentic AI网络
思科宣布将Silicon One芯片用于校园网络,推出C9550/C9350系列智能交换机,配合Cloud Control平台,实现分布式可见性、持续高性能和自适应可编程。通过深度片上缓冲、身份感知转发和亚秒级策略更新,意图将控制平面从外围设备转移至芯片和云原生编排,以应对AI代理带来的持续流量和安全挑战。
Cisco Talos威胁狩猎扩展:跨端点、网络与身份域锁定用户生态
Cisco Talos宣布将威胁狩猎服务从端点扩展到Cisco Firewall(网络流量)和Cisco Duo/Identity Intelligence(身份活动),利用AI引擎持续执行假设驱动搜索,通过Cisco Security Cloud Control统一门户交付发现结果。此举旨在捕获低于传统检测阈值的隐蔽攻击信号。
NVIDIA FOX蓝图:工厂控制层从PLC转向AI代理,锁定DGX硬件
NVIDIA发布Factory Operations Blueprint (FOX),基于NemoClaw和DGX Station (GB300 Grace Blackwell Ultra Desktop Superchip)构建自主工厂管理代理,整合机器信号、质量系统与机器人车队,实现全厂智能决策。富士康、和硕、研华、纬创已部署,预计根因分析效率提升80%,劳动生产力提升15%。