情报
AI 生成的结构化厂商动态简报
DeepSeek斥资350亿美元自建1GW数据中心,从租用转向垂直整合
DeepSeek宣布在内蒙古乌兰察布建设1GW超大规模AI数据中心,投资约350亿美元,标志着其从依赖第三方算力转向自建专用基础设施。该项目利用当地低电价和凉爽气候,与中国东数西算战略一致。
DeepSeek联手华为:Ascend 950对标GB200,自研Tile Language破CUDA垄断
DeepSeek创始人梁文锋宣称一年内中国将摆脱NVIDIA,华为Ascend 950超节点性能对标GB200/GB300。DeepSeek自研推理芯片及Tile Language编程语言以减少对CUDA依赖,标志着中国AI产业从国产替代向自主技术体系演进的关键转折。
阿里云WAIC 2026发布Agent-Native全栈,开源SAIL软件栈挑战CUDA生态
阿里云在WAIC 2026发布Agent-Native云套件(AgentLoop/AgentTeams/AgentRun/TokenWorks),开源T-Head SAIL AI软件栈,推出2.4T参数模型Qwen 3.8-Max-Preview及Zhenwu M890超节点,全面布局Agent-Native云与开源AI生态,意图构建从硬件到平台的全栈竞争力。
NVIDIA联合纬创美国首产GB300,AI制造生态重心转移至德州
NVIDIA携手纬创在德州开设D1工厂,实现GB300 Grace Blackwell Ultra的L6级美国本土集成制造。该工厂投资7亿美元,首台系统含150万零件、重2吨、单价400万美元,并规划Vera Rubin量产。此举标志着美国AI Capex本土化率从5%向30%跃升的关键转折,重塑全球AI供应链格局。
NVIDIA Vera Rubin Driving Performance Per Watt, Lowest Token Cost for Partners Worldwide
...
Moonshot发布Kimi K3:2.8万亿参数开源MoE,定价$3/$15冲击AI格局
Moonshot AI发布Kimi K3,2.8万亿参数MoE架构(896专家激活16个),原生多模态,1M上下文。API定价$3/$15,显著低于竞争对手。开源权重将于7月27日公开,发布后GPU容量即耗尽。该模型在Arena.ai排行榜以1679分超越Fable 5。
英伟达Vera Rubin七芯片堆栈与Dynamo解耦,推高推理智能成本效率
英伟达发布Vera Rubin平台,包含七芯片堆栈(Vera CPU、Rubin GPU、NVLink 6等)和Dynamo 1.0推理解耦架构,将预填充与解码分离。单个NVL72机架集成72 GPU/36 CPU,提供1.6 PB/s带宽,推理性能提升7倍,并引入‘每美元智能’指标,标志AI算力从训练转向推理成本竞争。
阿里发布2.4T参数Qwen3.8-Max,MoE架构与0.2折定价冲击AI市场
阿里巴巴发布Qwen3.8-Max-Preview,总参数2.4万亿,采用MoE架构,支持多模态和1M上下文窗口。同步推出Qoder平台与Token Plan,限时折扣低至0.2折,大幅降低推理成本。官方声称综合能力仅次于Anthropic Fable 5,标志着中国AI进入参数军备与开源竞争双轨制。
华为Atlas 950 SuperPoD与灵衢2.0:中国AI算力生态从单卡到集群的系统级重构
华为在WAIC 2026首次公开展示Atlas 950 SuperPoD真机,采用1024张昇腾NPU卡,并发布“灵衢2.0”高速互联协议。该产品标志着中国AI基础设施从单卡追赶转向集群系统级领先,通过开放协议构建国产AI算力生态闭环,直接对标NVIDIA NVL系列。
Microsoft自研MAI模型替代OpenAI/Anthropic,AI供应商格局生变
Microsoft开始在Excel和Outlook中用自研MAI模型替代OpenAI和Anthropic的AI调用,每周处理数万次提示任务。此举旨在降低对Anthropic的依赖和成本,推动AI模型内部化战略,影响AI供应商生态。
OpenAI重返开源:GPT-oss系列以Apache 2.0许可部署云端卸载控制点
OpenAI发布GPT-oss-120b和GPT-oss-20b两款开源模型,采用Apache 2.0许可,可在单张80GB GPU上运行。但模型内置云端卸载机制,复杂任务自动转至闭源模型处理,表面开源实则保留核心控制点。
Google Gemini 3.5 Pro架构重写:200万Token上下文引爆AI模型军备竞赛
Google DeepMind宣布7月17日发布Gemini 3.5 Pro,采用从头重建的预训练架构而非迭代升级,以解决数学推理、SVG生成和图像质量三大短板。模型将具备200万Token上下文窗口、Deep Think推理层和多步骤自主工作流能力,但官方规格尚未确认。
When AI Invents the Attack: Browser-Native Ransomware
...
Anthropic Claude独家登陆Azure,微软借GB300锁定AI模型分销权
Anthropic的Claude模型正式在Azure Foundry全面可用,基于NVIDIA GB300 NVL72集群(4600+ Blackwell Ultra GPU)。首批上线Opus 4.8和Haiku 4.5,支持提示缓存与扩展思考。微软获得独家企业分销渠道,强化对AWS/谷歌云的竞争地位。
OpenAI GPT-5.6激进定价与150万上下文窗口,加速Agent化转型
OpenAI传闻发布GPT-5.6,上下文扩展至150万token,定价仅为Claude Fable 5的三分之一,并强化Agent可靠性。此举意在利用Anthropic被下线窗口期抢占市场,同时修复reward hacking事故。
微软Copilot Cowork转向按量计费,引入DeepSeek重构AI模型生态
微软宣布其企业Agentic AI工具Copilot Cowork从不限量订阅转向按使用量计费(Copilot Credits),并探索引入微调后的DeepSeek V4或开源模型作为低成本选项,托管于Azure。此举旨在应对用户高频任务带来的高成本,同时推动多模型路线。
美国出口管制突袭Anthropic:Fable/Mythos模型全球访问被禁,AI地缘政治拐点到来
美国商务部以国家安全为由,暂停Anthropic的Fable 5和Mythos 5模型对全球外国国民的访问权限,包括Anthropic外籍员工。模型立即下线,Anthropic派员赴华盛顿谈判。此举可能开创AI模型出口管制先例,重塑全球AI服务供应链。
华为LogicFolding架构:以3D堆叠绕过制程封锁,重塑AI芯片竞争格局
华为提出Tau Scaling Law和LogicFolding架构,通过垂直堆叠逻辑单元实现晶体管密度提升55%、能效提升41%,并宣称2031年可达1.4nm等效。同时Ascend 920/910C芯片已用于训练DeepSeek V4-Pro模型,证明其AI芯片从理论走向实战,威胁Nvidia在华市场。
OpenAI收购Ona:控制点从模型转向持久化AI智能体运行时
OpenAI收购云基础设施初创公司Ona,将其持久化执行环境整合进Codex,使AI智能体可在企业自有云中长时间独立运行。此举旨在解决企业级部署中的安全管控与合规审计问题,标志着OpenAI从模型提供商向全栈AI平台转型。
NVIDIA Blackwell MLPerf六连冠:NVLink与NVFP4定义AI训练新范式
NVIDIA在MLPerf Training 6.0中凭借Blackwell平台全面领先,首次提交所有7个基准测试,包括MoE模型。GB300 NVL72比GB200快1.6x,通过第五代NVLink实现72 GPU一体化,NVFP4低精度训练提升性能。展示了从单机到8192 GPU集群的线性扩展能力。