情报
AI 生成的结构化厂商动态简报
NVIDIA Vera Rubin平台规格披露:单片CPU+GPU集成,每瓦token数提升10倍
NVIDIA正式披露Vera Rubin平台详细规格,采用单片化设计,每2个Rubin GPU搭配1个Vera CPU,旗舰NVL72集成36CPU+72GPU。宣称每瓦处理token数较Grace Blackwell提升10倍,内存带宽提升3倍。Vera CPU将独立销售,首批客户包括Microsoft、OpenAI、Oracle,预计2026年下半年量产。性能数据来自内部测试,独立验证待确认。
NVIDIA开源Cosmos 3 Edge 4B世界模型,Jetson Thor实现15Hz实时机器人控制
NVIDIA开源Cosmos 3 Edge(4B参数)世界动作模型,专为边缘机器人控制设计,在Jetson Thor平台实现15Hz实时推理和32个动作生成。此举将物理AI栈从数据中心扩展到边缘,推动机器人从感知到动作的端到端部署。
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
阿里发布2.4T参数Qwen3.8-Max,MoE架构与0.2折定价冲击AI市场
阿里巴巴发布Qwen3.8-Max-Preview,总参数2.4万亿,采用MoE架构,支持多模态和1M上下文窗口。同步推出Qoder平台与Token Plan,限时折扣低至0.2折,大幅降低推理成本。官方声称综合能力仅次于Anthropic Fable 5,标志着中国AI进入参数军备与开源竞争双轨制。
PPIO发布Agentic Cloud,智能模型网关成Agent流量新控制点
PPIO在WAIC 2026发布Agentic Cloud和智能模型网关,专为Agent工作负载设计,实现语义级流量识别与成本感知调度。平台日均Token调用超1.2万亿,Agent Harness支持沙箱冷启动低于200毫秒。这标志着Agent基础设施正成为独立品类。
华为Atlas 950 SuperPoD与灵衢2.0:中国AI算力生态从单卡到集群的系统级重构
华为在WAIC 2026首次公开展示Atlas 950 SuperPoD真机,采用1024张昇腾NPU卡,并发布“灵衢2.0”高速互联协议。该产品标志着中国AI基础设施从单卡追赶转向集群系统级领先,通过开放协议构建国产AI算力生态闭环,直接对标NVIDIA NVL系列。
华为昇腾950超节点真机首秀:1024卡统一内存编址,系统级算力成竞争新标尺
华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),单柜集成1024张NPU,实现256TB统一内存编址和3微秒级时延。通过系统级架构创新弥补先进制程受限,集群可扩展至50万卡,瞄准十万亿参数大模型训练,标志着算力竞争从单卡转向系统有效算力。
Microsoft自研MAI模型替代OpenAI/Anthropic,AI供应商格局生变
Microsoft开始在Excel和Outlook中用自研MAI模型替代OpenAI和Anthropic的AI调用,每周处理数万次提示任务。此举旨在降低对Anthropic的依赖和成本,推动AI模型内部化战略,影响AI供应商生态。
高通与字节跳动谈判定制芯片,战略转向数据中心生态
高通正与字节跳动谈判定制芯片开发,包括VPU、AI组件和自研CPU,基于AlphaWave Semi互联技术。此举标志高通从智能手机市场向数据中心定制芯片战略转型,其Dragonfly产品组合已涵盖C1000 CPU、HBC和AI300加速器。
纽约州签署一年期AI超大规模数据中心禁令,监管化范式转折开启
纽约州签署行政命令,对50MW以上AI超大规模数据中心实施一年建设禁令,立即生效。此举为美国首个全州范围禁令,至少11州正审议类似法案,标志着AI基础设施从'建得快'到'建得稳'的监管范式转折。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。
英伟达大幅削减亚洲AI芯片客户,白名单制度重塑供应链
英伟达宣布削减亚洲地区授权AI芯片客户数量超半数,在新加坡、马来西亚和日本建立白名单制度,要求客户提交详细业务证明和最终用途声明。此举旨在防止先进AI芯片非法流入中国,将深刻影响全球AI芯片供应链,迫使企业重新评估采购策略。
长电科技百亿Capex押注先进封装,AI芯片封装供应链加速重构
长电科技(JCET)宣布2026年资本支出100亿人民币,大幅增加AI先进封装投资,重点发展Chiplet、HBM、2.5D/3D封装。此举标志着中国OSAT正式大规模切入高端封装领域,与台积电CoWoS产能形成双轨并行,推动AI封装从台湾单极主导走向两岸分工,支撑本土Hyperscaler算力本地化。
华为昇腾万卡集群上线韶关,灵衢协议统一池化引领国产AI算力
华为在粤港澳大湾区韶关上线昇腾万卡智算集群,部署超万张昇腾AI加速卡。同时发布Atlas 950 SuperPoD,采用自研灵衢(UnifiedBus)互联协议,支持8192张NPU卡互联,带宽16.3 PB/s。华为云入选Gartner 2026云AI基础设施领导者象限,进一步强化国产算力生态布局。
OpenAI重返开源:GPT-oss系列以Apache 2.0许可部署云端卸载控制点
OpenAI发布GPT-oss-120b和GPT-oss-20b两款开源模型,采用Apache 2.0许可,可在单张80GB GPU上运行。但模型内置云端卸载机制,复杂任务自动转至闭源模型处理,表面开源实则保留核心控制点。
Anthropic承认Claude Code植入隐蔽标记:全链路封锁暴露模型访问控制权争夺
Anthropic公开承认在Claude Code中部署隐蔽账号标记机制,用于检测并封锁未授权转售和模型蒸馏行为,导致部分地区用户全链路受限。此举是防止模型能力泄露的防御手段,但本质上是将访问控制权从用户转移至厂商,并可能误伤合法用户。
百亿美元押注Forward Deployed Engineer:AI部署控制权从模型转向工程
微软、OpenAI、Anthropic、AWS同期宣布近百亿美元投资Forward Deployed Engineer(驻场部署工程师)模式,模型可互换成为默认前提,稀缺资源从模型参数转向将AI嵌入业务流程的工程能力。这一趋势标志着企业AI部署范式的根本性转变。
华为发布韬定律V2:麒麟2026同制程AI推理性能跃升40%,系统级优化挑战摩尔定律
华为何庭波发布韬定律V2,公布麒麟2026芯片参数:晶体管密度238 MTr/mm²(提升55%),同性能功耗降41%,SRAM频率升40%。在不依赖EUV光刻机的情况下,通过架构-电路-制程协同设计实现等效性能跃升,验证了系统级优化路径的工程可行性。
Google Cloud推Blackwell GPU机密VM与开源Prompt加密SDK,重塑AI安全边界
Google Cloud升级机密计算产品线,推出基于Blackwell GPU的机密虚拟机(Confidential G4 VMs预览版)和开源Prompt Encryption SDK,同时升级Confidential Space,引入Intel Trust Authority认证和Hopper GPU支持,以应对TEE漏洞CVE-2026-33697,强化AI推理与跨机构联合训练的数据保护。
微软斥资25亿美元成立AI部署独立公司,削减中国Azure研发岗位
微软宣布成立Microsoft Frontier Company,投入25亿美元和6000人专注企业AI部署。同时裁减Azure云部门北京上海200-400个研发岗位,标志着从中国战略撤退。