情报
AI 生成的结构化厂商动态简报
Intel 18A良率单季跃升20个百分点至85%+,先进封装EMIB良率达98%逼近TSMC N2
Intel Foundry 18A良率从65%提升至85%+,单季跃升20个百分点,逼近TSMC N2的90%。同时EMIB先进封装良率达90-98%,使Intel从封装瓶颈转为卖点。NVIDIA、AMD、Apple等已签约,但多为次级供应。
Microsoft自研MAI模型替代OpenAI/Anthropic,AI供应商格局生变
Microsoft开始在Excel和Outlook中用自研MAI模型替代OpenAI和Anthropic的AI调用,每周处理数万次提示任务。此举旨在降低对Anthropic的依赖和成本,推动AI模型内部化战略,影响AI供应商生态。
Google BigQuery深度集成Gemini Enterprise,重塑AI治理控制权
Google Cloud推出方案,将Gemini Enterprise应用的遥测数据(用户提示、模型响应、活动日志)实时路由到BigQuery。利用BigQuery的AI分析能力(Conversational Analytics、自动Schema生成),实现大规模AI部署的自动化审计、合规治理和业务洞察,强化数据驱动的AI可观测性。
CrowdStrike集成Claude API:AI Agent安全监控正式成为SOC核心遥测
CrowdStrike将Anthropic Claude Compliance API集成到Falcon平台,在Next-Gen SIEM中统一监控Claude Enterprise/Platform活动日志与对话,并与端点、身份、云遥测关联,实现AI Agent安全可视与自动化响应。
Cisco发布Cloud Control整合管理平台,AgenticOps推动AI运维自动化
Cisco在Live 2026发布Cloud Control,整合Meraki、Catalyst Center等管理平台,并推出AgenticOps AI运维代理,同时裁员471人转向AI优先战略。此举标志着从设备销售向运营订阅模式的根本转变,旨在通过统一控制平面锁定客户。
英伟达否认Kyber NVL144延期,但78层PCB工艺瓶颈暴露AI硬件物理极限
英伟达官方否认Kyber NVL144机架延期至2028年的报道,但SemiAnalysis披露的78层超高密度PCB中板制造瓶颈及Rubin Ultra取消,揭示了下一代AI集群在信号完整性与物理制造上的硬性天花板,为AMD与Google留下战略窗口。
How AI-leading Security Teams Are Building the Agentic SOC
...
Making private MCP servers reachable without making them public | OpenAI Developers
...
高通HBC Gen 1堆叠LPDDR实现133TB/s带宽,颠覆HBM生态
高通发布HBC Gen 1,通过3D堆叠LPDDR内存并集成计算die,实现133 TB/s带宽和6倍能效提升。该技术计划2027年中随AI250加速器出货,意图替代传统HBM,但供应链和物理实现仍存疑。
Anthropic指控阿里系发起史上最大AI蒸馏攻击,暴露API安全致命漏洞
Anthropic向美国参议员致信,指控与阿里相关的运营商通过约2.5万个欺诈账户发起2880万次模型交换,系统性地提取Claude前沿能力。此事件凸显AI模型API面临的新型大规模蒸馏威胁,迫使行业重新评估推理端点安全与使用监控。
Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式
Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。
华为推AI原生网络架构:从字节计费转向Token货币化,UCM缓存突破长上下文瓶颈
华为在MWC上海2026发布AI原生网络架构,集成服务-网络-计算,实现从流量中心到智能中心的转变。核心是Unified Cache Manager(UCM)将KV缓存扩展至PB级外存,在GLM-5.1模型128K序列长度下实现372% token吞吐量提升。同时推出token货币化框架,允许运营商按AI推理容量计费,并引入agentic运营模式。
Google Cloud推多代理自主运维,控制点从人类转向AI验证架构
Google Cloud提出“agent-scale data management”,通过多代理验证架构减少人工监督,并与Nokia部署6个Gemini代理实现网络自治。同时Amazon计划商业化Trainium芯片,加剧AI硬件竞争,挑战Google TPU和Nvidia GPU。
高通发布Dragonfly数据中心CPU与HBC内存,以推理优先架构挑战NVIDIA霸权
高通在投资者日公布完整数据中心路线图,包括250核Oryon CPU(Dragonfly C1000)、近内存计算HBC(声称133TB/s带宽)、AI300推理加速器(54x带宽提升),以及800G/1.6T互联。与Meta签署多年CPU供应协议,2028年商用,旨在以低功耗高带宽颠覆AI推理市场。
Cisco推出AI故障排除代理,重塑工业网络运维控制权
Cisco发布面向工业网络的AI故障排除代理,作为Cisco AgenticOps和Cloud Control的一部分。该代理通过本地部署、全天候监控交换机系统消息,利用确定性逻辑诊断物理层和网络层故障,为OT技术人员提供可操作的修复步骤,旨在缩短MTTD和MTTR。
OpenAI联手Broadcom推出Jalapeno推理芯片,重塑AI硬件生态
OpenAI与Broadcom合作开发了名为Jalapeno的LLM推理加速芯片,采用多芯片模块、HBM3E内存,9个月完成流片。该芯片专为OpenAI模型栈优化,旨在降低推理成本并减少对NVIDIA GPU的依赖,计划2026年底部署。
Cisco Live US & InfoComm 2026 : la collaboration entre dans l’ère agentique
...
NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破
NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。
中国LineShine超算登顶TOP500:纯CPU架构突破2 ExaFLOPS,ARMv9+HBM成新范式
LineShine超级计算机基于13.79百万个ARMv9核心、20480节点,实现2.198 ExaFLOPS FP64持续性能,成为全球首个突破2 ExaFLOPS的系统。它完全依赖CPU(无GPU加速),每个节点配备双LX2 CPU(304核)和32GB HBM,展示了CPU+HBM架构在HPC领域的潜力。
Nokia, Amazon Web Services expand collaboration to deliver autonomous networks built for the AI era
...