筛选

×
当前筛选 清除全部
关键词: RUM ×
156 情报总数
3/8 当前页
Google 其他 2026-06-16

Google开源Brazos液冷:风冷数据中心即插即用高密度冷却

Google发布Brazos模块化液冷系统,可在现有风冷数据中心中逐机架部署,支持60kW热负载。系统基于OCP ORv3标准,开源设计,降低液冷采纳门槛,无需大规模设施改造。

AMD 其他 2026-06-16

AMD Ryzen 10000系列拟弃集成GPU换NPU:AI性能跃升但牺牲基本显示能力

据泄漏,AMD下一代Zen 6桌面CPU“Olympic Ridge”将不再集成GPU,转而集成NPU以提升本地AI算力(目标>40 TOPS以满足Copilot+认证)。同时升级cIOD支持CUDIMM/CAMM内存与EXPO 1.2超频标准。此举意在追赶Intel DDR5速度并抢占AI PC生态位,但迫使绝大多数用户必须搭配独立显卡。

AMD 其他 2026-06-15

AMD收购MEXT:用AI预测让Flash逼近DRAM,降低AI内存TCO

AMD宣布收购AI内存优化初创公司MEXT,其核心技术利用AI预测模型使NAND Flash在延迟和吞吐量上逼近DRAM,旨在扩展AI服务器的有效内存容量,降低总拥有成本(TCO)。该技术将被整合进AMD数据中心全线产品,包括EPYC CPU和Instinct GPU,以应对大模型对内存的饥渴。

AMD 其他 2026-06-15

AMD通过Vultr开源AI软件组件,向NVIDIA CUDA生态发起生态重构挑战

AMD通过Vultr Marketplace发布开源、模块化的企业AI软件组件,包括AMD Inference Microservices (AIMs)、AI Workbench、Resource Manager和Solution Blueprints。该组合旨在提供生产级AI基础设施,避免单一厂商锁定,直接挑战NVIDIA的CUDA生态。

MediaTek 其他 2026-06-15

Carmen Li推动GPU期货市场:算力金融化将颠覆AI基础设施采购模式

Carmen Li通过Silicon Data和Compute Exchange构建GPU价格指数和现货市场,目标推出计算期货。该计划获DRW支持,旨在解决GPU价格波动,标准化算力交易,可能创造万亿美元级新资产类别,彻底改变AI算力的定价与分配机制。

Microsoft 其他 2026-06-11

微软联合NVIDIA推RTX Spark Arm AI芯片,Windows PC算力跨越1 Petaflop门槛

微软在Computex 2026宣布与NVIDIA、MediaTek合作推出RTX Spark Arm架构AI超级芯片,集成Blackwell RTX GPU和128GB统一内存,支持本地运行120B参数大模型。同时Intel Arc G3、高通Snapdragon X2系列齐发,Windows AI PC生态全面升级。

NVIDIA 其他 2026-06-11

NVIDIA联手Google DeepMind推出并行文本生成模型,吞吐量突破1000 tokens/sec

NVIDIA宣布与Google DeepMind合作优化DiffusionGemma,该模型基于扩散去噪实现每步并行生成256个token,在单个H100上达到1000 tokens/sec,并通过NIM和NeMo提供即用部署,显著降低推理成本和延迟。

AMD 其他 2026-06-11

AMD携手戴尔与剑桥大学,以开放ROCm生态撬动英国主权AI算力基建

AMD联合戴尔和剑桥大学宣布建立英国主权AI创新实验室(SAIL),部署基于第五代EPYC和Instinct MI355X GPU的Zenith超级计算机,以及用于聚变能源研究的Sunrise系统。该实验室旨在推动开放、可互操作的AI基础设施,以ROCm软件栈为核心,对抗NVIDIA的CUDA生态锁定,为英国政府和研究机构提供长期技术选择。

AMD 其他 2026-06-10

AMD EPYC以机架级密度宣战:Agentic AI的CPU控制权之争

AMD发布博客,宣称其EPYC处理器在机架级性能上领先NVIDIA Vera和Intel Xeon,专为Agentic AI的CPU密集型服务(如编排、缓存、数据库)设计。通过100kW机架模型,EPYC 9965(Turin)实现2.37倍于Vera的吞吐量,下一代“Venice”将扩展至3.30倍。强调现有x86平台即可部署,无需等待未来架构。

Cloudflare 其他 2026-06-10

Cloudflare 将安全栈延伸至私有源站:DNS 路由开启应用层控制新范式

Cloudflare 发布 Application Services for Private Origins,允许企业客户通过 DNS 记录启用私有路由,将 WAF、Bot 管理、速率限制等安全服务应用于私有 IP 上的应用,无需公网暴露或 connector 软件。该功能基于 Cloudflare 已有的私有网络连接(IPsec/GRE/CNI/Mesh)实现,并支持 Spectrum 和 Workers VPC 绑定,构建统一的私有流量控制平面。

NVIDIA 其他 2026-06-08

NVIDIA 借英国主权AI基金,从芯片商跃升为国家AI基础设施的幕后控制者

NVIDIA 与英国政府合作,通过 Isambard-AI(搭载 5,400 颗 GH200)及 Sovereign AI Fund,扶持本地初创(Cosine, Cursive, Doubleword)。此举表面是技术部署,实则是 NVIDIA 构建主权AI控制平面,将国家算力锁入其生态系统,削弱AWS/Azure等传统云厂商的地位。

NVIDIA 其他 2026-06-08

NVIDIA联手斗山集团:以全栈物理AI平台重构工业自动化生态

NVIDIA与斗山集团扩大合作,将Isaac Sim、Cosmos、Jetson Thor等物理AI栈整合进斗山机器人Agentic Robot OS,并探索AI工厂电力(SMR、氢燃料电池)及MGX生态PCB材料。此举旨在将NVIDIA从GPU供应商转型为物理AI和AI工厂基础设施的中央平台,深度锁定工业自动化生态。

NVIDIA 其他 2026-06-04

NVIDIA Nemotron 3 Ultra:以MoE与MOPD重构AI Agent控制平面,锁定企业推理成本

NVIDIA发布**Nemotron 3 Ultra**,一个550B参数MoE模型(55B活跃),专为AI Agent编排而设计。通过**多教师在线策略蒸馏(MOPD)** 与**Hybrid Mamba-Transformer**架构,其在**SWE-bench**等任务中实现5倍吞吐量提升与30%成本节省,标志着推理控制权从单一模型向分层Agent系统的转移。

Cisco 其他 2026-06-02

思科AI Defense升级:以Agent供应链安全为名,行平台锁定之实

思科发布AI Defense重大更新,聚焦AI Agent安全,引入自适应红队测试、策略工作室(Policy Studio)和自动Agent依赖图扫描。新功能旨在实现跨平台(AWS Bedrock、Google ADK、LangChain)的上下文感知保护,但深度绑定Cisco Secure AI Factory与NVIDIA生态,隐藏了性能开销和迁移成本。

Google 其他 2026-06-01

AlloyDB Remote MCP Server GA:Google Cloud以开放协议重塑AI代理数据访问生态

Google Cloud宣布AlloyDB Remote MCP Server正式GA,允许AI代理通过HTTP端点安全访问操作型数据。该服务基于开放MCP协议,提供IAM细粒度授权、Model Armor防护和审计日志,并集成AlloyDB的ScaNN向量索引(10亿+向量,6倍速度)与AI函数,旨在成为企业AI代理的单一数据源。

NVIDIA 其他 2026-06-01

NVIDIA Cosmos 3开源统一物理AI模型,以MoT架构合围GPU生态

NVIDIA发布Cosmos 3,基于Mixture-of-Transformers双塔架构统一物理推理、世界生成与动作生成。开源模型权重、训练脚本和六个合成数据集,但部署优化深度绑定NVIDIA NIM微服务与GPU,意图将物理AI开发生态锁定在其硬件和软件栈上。

NVIDIA 其他 2026-06-01

NVIDIA BlueField DPU硬件隔离安全:将AI工厂控制点从软件转向硅片

NVIDIA发布基于BlueField-4 DPU的DOCA安全堆栈(Argus、Vault、Flow),通过硬件隔离执行域实现运行时内存分析、零信任文件访问和800Gb/s网络策略执行。该架构将安全控制从主机操作系统转移到DPU硅片,在不影响AI性能前提下提供分布式全栈保护,但深度绑定Vera Rubin平台,形成生态锁定。

Nokia 其他 2026-05-29

诺基亚1830 GX多轨OLS:以密度和功耗优势重塑AI集群跨站点光互联经济性

诺基亚发布1830 GX多轨开放线路系统(OLS),在1RU内支持4个光纤轨,实现40RU机架部署160轨,功耗每轨降低超60%。该方案专为AI集群跨数据中心互联(Scale-Across)设计,通过集成C+L波段EDFA、DGE、OCM和OTDR,解决传统ILA站点空间与功耗瓶颈,实现9.6THz频谱容量。

NVIDIA 产品发布 2026-05-29

NVIDIA Blackwell Ultra GB300 NVL72:FP4算力1.44 EFLOPS,AI工厂性能跃升50倍

NVIDIA发布Blackwell Ultra GB300 NVL72机架系统,集成72颗Blackwell Ultra GPU和36颗Grace CPU,FP4稀疏算力达1,440 PFLOPS,配备20TB HBM3e和130TB/s NVLink,相比Hopper AI工厂输出提升50倍,已上市。

Cisco 其他 2026-05-28

Cisco Scale-Across架构:硅光融合定义AI跨数据中心网络新标准

Cisco发布Scale-Across方案,基于Silicon One P200路由系统(51.2Tbps)和400G/800G ZR/ZR+相干光模块,结合开放线路系统,旨在解决AI训练因功率限制需跨数据中心分布时的网络性能问题,实现类似单机房的低延迟无损连接。