情报
AI 生成的结构化厂商动态简报
NVIDIA与SK hynix联合定义下一代AI内存,锁定HBM4与Vera Rubin架构协同
NVIDIA与SK hynix宣布多年技术合作,联合开发面向Vera Rubin、RTX Spark及Jetson Thor的下一代内存。同时,SK Telecom采用DGX全栈平台建设吉瓦级AI云,计划2027年上线。此举将SK hynix从供应商升级为联合架构定义者,强化NVIDIA在HBM及AI生态的锁定效应。
NVIDIA RTX Spark与Nemotron-3 Ultra:端侧AI控制权从云端下沉至个人PC
NVIDIA在GTC Taipei 2026发布RTX Spark个人AI超级计算机(与联发科合作)及Nemotron-3 Ultra开源混合架构模型。RTX Spark搭载N1X芯片,提供1 PFLOPS本地AI算力,首次将大模型推理下沉至PC端,并重构软件生态。此举标志英伟达从云端GPU供应商转型为端侧AI基础设施垄断者。
美国政府强制关停Anthropic两款模型:跨境AI监管收紧重塑行业规则
美国政府以跨境数据安全隐患为由,强制Anthropic关停Fable 5与Mythos 5两款大模型。事件暴露闭源AI的监管脆弱性,凸显开源模型(如DeepSeek)的战略价值。监管不确定性将重塑企业AI选型标准,模型可移植性成为核心评估维度。
ReflectionAI获63亿美元SpaceX算力,开源AI破局硬件锁定
开源AI初创ReflectionAI与SpaceX签署63亿美元协议,租用Colossus 2数据中心NVIDIA GB300算力,用于训练开放权重前沿模型。此举使开源阵营获得与闭源巨头同等的计算资源,但深度绑定NVIDIA专有硬件,形成新的生态依赖。
智谱GLM-5.2开源:MIT协议744B MoE,以可下载模型对抗地缘政治禁运
智谱AI发布GLM-5.2,744B MoE仅40B激活参数,支持1M输入上下文和131K输出,采用MIT开源协议。时间点紧贴Anthropic Fable 5被美国政府强制下架,提供可下载、不可被禁的替代方案,兼容Anthropic API实现零代码迁移,旨在为企业提供技术主权选项。
SGLang 0.5.13发布:MoE路由预判+稀疏缓存,GB300 NVL72推理性能飙升25倍
SGLang 0.5.13版本引入两阶段MoE路由预判和稀疏KV缓存,在NVIDIA GB300 NVL72平台实现25倍推理加速。实测显示,在A100上吞吐量提升65%,延迟降低40%,路由开销锐减62%。该优化直击MoE模型推理瓶颈,有望重塑AI推理部署的经济性。