情报
AI 生成的结构化厂商动态简报
Coherent获5千万美元补贴扩建InP产线,AI连接瓶颈催生光芯片军备竞赛
光通信芯片巨头Coherent获得美国CHIPS法案5000万美元补贴,扩建其德州6英寸磷化铟(InP)晶圆厂,产能提升4倍。NVIDIA已战略投资20亿美元锁定产能,创始人黄仁勋亲临现场,标志AI基础设施从算力堆叠转向光互连能力成为新瓶颈。
NVIDIA 200亿美元购Groq LPU:推理芯片从HBM转向片上SRAM
NVIDIA与Groq达成约200亿美元技术许可协议,获取LPU(Language Processing Unit)核心技术与团队。LPU采用230MB片上SRAM,带宽80TB/s,专为Transformer推理解码优化,替代传统GPU的HBM瓶颈,重塑AI推理芯片格局。
NVIDIA登顶数据中心以太网市场:GPU算力控制网络架构的转折点
IDC报告显示,NVIDIA在2026年Q1数据中心以太网交换机市场以21.5%份额首次登顶,营收21亿美元。这标志着Spectrum-X平台结合RoCE和NVLink技术,成功将GPU算力需求转化为网络控制权,直接冲击Cisco和Arista的传统地位。
华为昇腾910C完成1.6万亿参数训练:国产算力首次突破MoE全流程
华为联合河套学院等机构,基于昇腾910C集群完成DeepSeek-V4-Pro(1.6万亿参数MoE架构)全参数后训练。核心数据:千卡集群稳定1500步,算力利用率30%,算子效率提升14%,全程无海外GPU依赖,标志着国产算力首次实现万亿级大模型完整训练闭环。
SK海力士HBM4E送样:3nm逻辑+384GB单GPU,引爆AI内存带宽军备竞赛
SK海力士向主要客户发出12层HBM4E样品,采用TSMC 3nm逻辑裸芯,单引脚带宽显著提升,目标平台为NVIDIA Rubin Ultra,每GPU容量达384GB。此举标志着与三星在下一代AI存储赛道正式进入抢跑阶段,HBM BOM占比已飙升至65-70%。
英伟达吞下Groq LPU:Feynman GPU融合SRAM推理单元,混合架构加速2028
英伟达通过非排他许可与逆向招安获取Groq的LPU推理技术,计划在2028年Feynman GPU中采用台积电SoIC混合键合集成大容量SRAM芯片块,实现确定性调度与80TB/s片上带宽,从纯GPU供应商向混合推理/训练平台转型。
NVIDIA Spectrum-X登顶以太网交换机市场:AI工厂生态重构网络产业格局
IDC报告显示,NVIDIA在2026年Q1以21亿美元营收(同比+192.7%)首次成为数据中心以太网交换机市场第一。核心驱动力是专为AI GPU集群设计的Spectrum-X平台,其整合了Spectrum交换机、BlueField DPU和LinkX线缆系统,标志着AI工厂网络从通用架构向垂直集成生态的根本性转变。
微软Copilot SearchLeak漏洞:一次点击即可通过LLM窃取所有企业已索引数据
Varonis发现微软365 Copilot企业版存在SearchLeak漏洞链(CVE-2026-42824),利用参数到提示词注入(P2P注入)、HTML渲染竞态条件及借助Bing服务的SSRF绕过CSP。攻击者通过恶意URL诱导用户点击,Copilot将敏感数据嵌入图片URL并通过必应外传,绕过传统安全防护。微软已发布补丁。
OpenAI砸1.5亿美元认证30万顾问,生态重构独立于微软掌控企业AI落地
OpenAI宣布Partner Network计划,投资1.5亿美元在2026年底前认证30万企业AI顾问,与麦肯锡、埃森哲等顶级咨询公司合作。这是OpenAI首次独立于微软建立认证和销售体系,标志着AI从模型竞赛进入落地生态竞争阶段。
Palo Alto 250亿美元收购CyberArk:安全控制点从网络边界转向机器身份
Palo Alto Networks宣布以约250亿美元收购CyberArk,构建统一的Agent身份与权限管理平台。此举将安全控制从网络防火墙和端点检测转移至机器身份生命周期,应对AI Agent爆发带来的身份治理需求,并采用Token用量授权模式直接绑定收入。
OpenAI与Anthropic同步强制身份验证:AI匿名使用时代终结
OpenAI和Anthropic不约而同在2025-2026年引入用户身份验证,包括证件上传和3D活体检测。这标志着AI从匿名聊天工具转向实名代理,为执行真实世界操作奠定法律和安全基础,将重塑整个AI行业的用户准入标准。
Intel获Google TPU封装大单:Foundry转型的里程碑,但TSMC仍是AI制造核心
Intel宣布将为Google生产超过300万颗Tensor Processing Unit,采用先进的EMIB-T封装技术,预计2028年交付。此订单是Intel Foundry迄今最大的外部AI芯片订单,但分析人士指出该交易主要涉及封装而非核心芯片制造,TSMC仍是Google TPU的主要晶圆代工厂。
微软GitHub向AWS租用算力:AI需求引爆跨云协作,打破云厂商竞争壁垒
微软旗下GitHub因AI辅助编程需求暴涨14倍,被迫向竞争对手AWS租用计算容量。此举暴露单一云厂商无法满足AI基础设施需求,打破传统云竞争格局,预示跨云混合部署成为新常态。
Google Gemini 3.5 Flash驱动搜索转向AI答案引擎,控制点从链接转向摘要
Google将搜索全面转型为基于Gemini 3.5 Flash的AI优先答案引擎,搜索栏支持长问题、文件上传和对话追问,AI Mode生成定制摘要页面替代链接列表。模型性能提升:Terminal-bench 2.1得分76.2%,1M上下文和65K输出,多Agent协同平台Antigravity可调度93个子Agent生成26亿token。
智谱GLM-5.2开源:MIT协议744B MoE,以可下载模型对抗地缘政治禁运
智谱AI发布GLM-5.2,744B MoE仅40B激活参数,支持1M输入上下文和131K输出,采用MIT开源协议。时间点紧贴Anthropic Fable 5被美国政府强制下架,提供可下载、不可被禁的替代方案,兼容Anthropic API实现零代码迁移,旨在为企业提供技术主权选项。
SGLang 0.5.13发布:MoE路由预判+稀疏缓存,GB300 NVL72推理性能飙升25倍
SGLang 0.5.13版本引入两阶段MoE路由预判和稀疏KV缓存,在NVIDIA GB300 NVL72平台实现25倍推理加速。实测显示,在A100上吞吐量提升65%,延迟降低40%,路由开销锐减62%。该优化直击MoE模型推理瓶颈,有望重塑AI推理部署的经济性。
Google TurboQuant:6倍KV缓存压缩,AI推理内存成本拐点到来
Google发布TurboQuant算法,通过PolarQuant和QJL两阶段压缩,将大模型KV缓存内存占用压缩6倍(3-bit量化),注意力计算速度提升8倍,且无精度损失。该技术直接冲击HBM内存需求叙事,导致Micron、Western Digital等内存股下跌,标志AI推理效率拐点。
CrowdStrike推基于SPIFFE的AI Agent持续身份授权,控制点从静态凭证转向动态风险平面
CrowdStrike在Identiverse 2026发布Continuous Identity for AI Agents,基于SPIFFE开放标准为每个AI Agent提供加密可验证身份,替代API密钥。每次操作实时评估风险授权,零常驻权限,支持委托链路,并与Falcon AIDR联动。该能力源于收购SGNL的技术,旨在定义AI Agent身份治理新品类。
出口管制迫使Anthropic全球停服,AI模型部署遭遇合规架构断层
Anthropic因无法实现按国籍的用户过滤,被迫全球下架Fable 5和Mythos 5模型,白宫谈判无果。$9650亿IPO面临停服风险,暴露AI厂商在合规访问控制上的技术短板。