情报
AI 生成的结构化厂商动态简报
NVIDIA美国制造启航:纬创工厂量产GB300与Vera Rubin,重构AI供应链
纬创在德克萨斯州沃斯堡开设首座美国制造工厂,生产NVIDIA GB300 Grace Blackwell Ultra和Vera Rubin超级芯片。该工厂投资7亿美元,计划月产数万块板,标志着NVIDIA供应链本土化的重大转折。
NVIDIA推Agent Toolkit全栈锁定本地Agent,控制点从云端转向DGX Station
NVIDIA发布Agent Toolkit,包含NemoClaw、Nemotron 3 Ultra、Omniverse Libraries和OpenShell四大组件,使开发者可在DGX Station GB300上30分钟完成本地AI Agent部署。此举旨在将Agent开发生态锁定在NVIDIA硬件与软件栈,推动控制点从云服务向本地硬件转移。
Anthropic Claude独家登陆Azure,微软借GB300锁定AI模型分销权
Anthropic的Claude模型正式在Azure Foundry全面可用,基于NVIDIA GB300 NVL72集群(4600+ Blackwell Ultra GPU)。首批上线Opus 4.8和Haiku 4.5,支持提示缓存与扩展思考。微软获得独家企业分销渠道,强化对AWS/谷歌云的竞争地位。
微软Azure Blackwell Ultra集群发布,AI训练即服务锁定生态控制权
微软Azure发布搭载NVIDIA Blackwell Ultra GPU的AI超级计算机集群,峰值算力超200 exaflops,并推出AI训练即服务(AI Training as a Service)。与OpenAI合作部署GPT-6训练集群(预计2027年),采用液冷技术实现PUE 1.08,旨在将万亿参数模型训练全面迁移至云平台。
英伟达Blackwell Ultra与Omniverse:AI工厂生态锁定,工业数字孪生标准之争
NVIDIA发布Blackwell Ultra架构,推理性能提升4倍,推出DGX B200系统。与富士康合作建设全球最大AI工厂(2027年投产)。Omniverse平台已有700+客户,成为工业数字孪生标准,旨在重塑全球计算架构为AI工厂。
ASUS联手NVIDIA推出桌面级AI超算,企业AI控制权从云端向本地急剧转移
ASUS发布基于NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip的ExpertCenter Pro ET900N G3桌面系统,提供20 PFLOPS AI算力与748GB一致内存,可运行近万亿参数模型。同时,Coherent在德州扩建磷化铟工厂保障光互联供应,NVIDIA计划发行200-250亿美元债券筹资。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。
NVIDIA携ASUS推桌面级DGX Station:GB300芯片下放,控制点从云转向本地硬件生态
ASUS发布ExpertCenter Pro ET900N G3,基于NVIDIA DGX Station GB300架构,搭载GB300 Grace Blackwell Ultra芯片,提供748GB统一内存和20 PFLOPS AI性能。该桌面级AI超算支持本地LLM微调、推理及AI agent工作负载,通过NVLink-C2C实现高速互连,并集成NVIDIA AI软件栈与NemoClaw框架。
NVIDIA推AgentPerf基准测试:Blackwell Ultra每瓦代理数较Hopper提升20倍
NVIDIA与Artificial Analysis联合发布首个Agentic AI基准测试AgentPerf,结果显示GB300 NVL72平台在运行DeepSeek V4 Pro等MoE模型时,每兆瓦可承载的并发代理数较HGX H200提升20倍。该基准模拟真实编码代理轨迹,测量端到端吞吐与响应延迟。
微软联合NVIDIA推RTX Spark Arm AI芯片,Windows PC算力跨越1 Petaflop门槛
微软在Computex 2026宣布与NVIDIA、MediaTek合作推出RTX Spark Arm架构AI超级芯片,集成Blackwell RTX GPU和128GB统一内存,支持本地运行120B参数大模型。同时Intel Arc G3、高通Snapdragon X2系列齐发,Windows AI PC生态全面升级。
NVIDIA联手Google DeepMind推出并行文本生成模型,吞吐量突破1000 tokens/sec
NVIDIA宣布与Google DeepMind合作优化DiffusionGemma,该模型基于扩散去噪实现每步并行生成256个token,在单个H100上达到1000 tokens/sec,并通过NIM和NeMo提供即用部署,显著降低推理成本和延迟。
NVIDIA NVFP4:原生4位训练实现1.73倍吞吐跃升,锁定Blackwell生态
NVIDIA发布NVFP4格式,利用Blackwell原生硬件支持,在JAX/MaxText中实现4位混合精度预训练。相比FP8基线,Llama 3.1 405B在GB300上获得1.73倍吞吐提升,且精度无损失。该技术通过微块缩放、随机哈达玛变换等创新,显著降低训练成本,但深度绑定NVIDIA硬件生态。
NVIDIA FOX蓝图:工厂控制层从PLC转向AI代理,锁定DGX硬件
NVIDIA发布Factory Operations Blueprint (FOX),基于NemoClaw和DGX Station (GB300 Grace Blackwell Ultra Desktop Superchip)构建自主工厂管理代理,整合机器信号、质量系统与机器人车队,实现全厂智能决策。富士康、和硕、研华、纬创已部署,预计根因分析效率提升80%,劳动生产力提升15%。
NVIDIA Blackwell Ultra GB300 NVL72:FP4算力1.44 EFLOPS,AI工厂性能跃升50倍
NVIDIA发布Blackwell Ultra GB300 NVL72机架系统,集成72颗Blackwell Ultra GPU和36颗Grace CPU,FP4稀疏算力达1,440 PFLOPS,配备20TB HBM3e和130TB/s NVLink,相比Hopper AI工厂输出提升50倍,已上市。
英伟达发布企业级AI工厂参考架构,推动本地AI基础设施标准化
英伟达发布企业级AI工厂参考架构,为本地部署提供从RTX PRO到NVL72的三种标准化配置。该架构整合了计算、网络、存储及软件,旨在将AI基础设施从实验性部署转变为可预测、可扩展的工业化运营平台。
NVIDIA与Google Cloud深化合作,构建面向AI工厂与物理AI的云基础设施
NVIDIA与Google Cloud宣布合作升级,推出基于Vera Rubin和Blackwell GPU的新实例,旨在构建支持近百万GPU集群的“AI工厂”,并整合Gemini、Nemotron等模型平台,加速从智能体到物理AI(如机器人、数字孪生)的生产级部署。
英伟达联合能源机构展示AI算力工厂参与电网调峰
英伟达与能源研究机构EPRI、英国国家电网及初创公司Emerald AI合作,成功演示了基于Blackwell GPU集群的AI算力工厂如何根据电网实时需求,动态调节自身功耗以充当电网的“减震器”,同时保障高优先级AI工作负载的性能。
英伟达与Emerald AI展示AI工厂动态能耗调节能力
英伟达联合Emerald AI在96块Blackwell Ultra GPU集群上实现电网指令响应,通过NVIDIA System Management Interface获取秒级功耗数据,Emerald AI Conductor平台确保高优先级AI工作负载维持性能的同时动态调节能耗。
思科联合NVIDIA推出澳大利亚首个主权AI工厂
思科与Sharon AI合作,在澳大利亚部署基于1024个NVIDIA Blackwell Ultra GPU的AI工厂,整合UCS服务器、Nexus Hyperfabric和VAST Data存储,提供境内数据处理的AI基础设施。
NVIDIA用NVFP4量化+TeaCache将FLUX.2推理提速10倍,锁定Blackwell生态
NVIDIA与Black Forest Labs合作,在DGX B200/B300上通过NVFP4 4-bit量化、TeaCache步跳过、CUDA Graphs和torch.compile,将FLUX.2推理延迟较H200降低6.3x(单卡)至10.2x(双卡),内存需求降40%。该技术栈深度绑定TensorRT-LLM visualgen和Blackwell硬件。