情报
AI 生成的结构化厂商动态简报
Microsoft自研MAI模型替代OpenAI/Anthropic,AI供应商格局生变
Microsoft开始在Excel和Outlook中用自研MAI模型替代OpenAI和Anthropic的AI调用,每周处理数万次提示任务。此举旨在降低对Anthropic的依赖和成本,推动AI模型内部化战略,影响AI供应商生态。
NVIDIA+Nokia联盟打破RAN生态:GPU加速AI RAN 2027年商用
NVIDIA与Nokia联合开发AI RAN技术,利用NVIDIA GPU加速基带处理,通过AI优化波束赋形和频谱管理,目标2028年频谱效率翻倍。该合作标志着电信RAN从专用硬件向GPU通用计算和AI软件定义的重大转型,预计2027年商用部署。
IBM发布0.7nm纳米堆叠技术,三维晶体管架构突破摩尔定律极限
IBM发布业界首个亚1纳米(0.7nm)芯片技术,采用纳米堆叠三维晶体管架构,在指甲盖大小芯片集成近1000亿晶体管,密度是2nm芯片的2倍。该技术实现50%性能提升或70%能效提升,并支持40% SRAM缩放,为AI芯片存储墙提供新解。
NVIDIA推出Jetson Thor T3000/T2000,以Blackwell架构压降边缘AI推理成本壁垒
NVIDIA发布基于Thor架构的Jetson T3000和T2000模块。T3000集成Blackwell GPU、8核Neoverse CPU,以T5000一半的功耗提供865 FP4 TFLOPS算力,并搭配新的Jetson Agent Skills自动化内存优化工具,旨在推动人形机器人和边缘AI应用的大规模部署。
NVIDIA CUDA 13.3新增clmad指令,硬件加速无进位乘法,加密性能跃升
NVIDIA在CUDA 13.3中为Ampere及以上GPU新增clmad硬件指令,实现无进位乘累加。GHASH吞吐量达6.3 TB/s(B200),较bitsliced方案提升18.8倍;零知识证明sum-check协议加速3-13倍。该指令还适用于CRC、Reed-Solomon等编码。
7.4万台FortiGate遭入侵:边界设备管理界面成致命弱点
巴基斯坦CERT警告约7.4万台Fortinet FortiGate设备被入侵,覆盖194国。攻击者利用公开管理界面和旧版凭证存储机制获取权限,威胁政府、金融等关键行业。事件凸显边界设备管理面安全防护的紧迫性。
高通与字节跳动谈判定制芯片,战略转向数据中心生态
高通正与字节跳动谈判定制芯片开发,包括VPU、AI组件和自研CPU,基于AlphaWave Semi互联技术。此举标志高通从智能手机市场向数据中心定制芯片战略转型,其Dragonfly产品组合已涵盖C1000 CPU、HBC和AI300加速器。
英特尔18A良率突破85% 获NVIDIA等大单 挑战台积电代工地位
英特尔宣布其18A工艺良率从65%提升至85%,接近台积电N2水平,并已获得NVIDIA、AMD、OpenAI等多家巨头代工订单。其EMIB先进封装良率也达98%,用于NVIDIA Feynman GPU、谷歌TPU等产品。这标志着英特尔代工业务取得实质性突破,可能改变AI芯片制造格局。
NVIDIA联手诺基亚推商用AI-RAN:软件定义无线接入网,GPU取代专用硬件
NVIDIA与诺基亚宣布推出业界首个商用AI-RAN平台,基于诺基亚anyRAN软件和NVIDIA Aerial平台,通过GPU加速和AI驱动实现频谱效率提升20%以上,目标2028年提升超100%。该平台旨在使无线网络摆脱专用硬件,转向软件定义、通用计算架构。
Google BigQuery深度集成Gemini Enterprise,重塑AI治理控制权
Google Cloud推出方案,将Gemini Enterprise应用的遥测数据(用户提示、模型响应、活动日志)实时路由到BigQuery。利用BigQuery的AI分析能力(Conversational Analytics、自动Schema生成),实现大规模AI部署的自动化审计、合规治理和业务洞察,强化数据驱动的AI可观测性。
Apple洽谈PrismML压缩Qwen 27B模型,端侧AI实现15倍内存缩减
Apple正与AI初创公司PrismML洽谈,利用其压缩技术将阿里巴巴Qwen 27B参数模型部署到iPhone上。该技术通过1-bit量化、蒸馏和架构优化,使模型仅需10GB VRAM运行,实现15倍内存减少,推动端侧AI从云端调用转向本地推理。
纽约州签署一年期AI超大规模数据中心禁令,监管化范式转折开启
纽约州签署行政命令,对50MW以上AI超大规模数据中心实施一年建设禁令,立即生效。此举为美国首个全州范围禁令,至少11州正审议类似法案,标志着AI基础设施从'建得快'到'建得稳'的监管范式转折。
CrowdStrike集成Claude合规API,AI Agent安全监控纳入SOC
CrowdStrike将Anthropic Claude Compliance API集成到Falcon平台,使安全团队能统一监控Claude Enterprise和Platform的活动日志,并与端点、身份、云遥测关联,通过Charlotte Agentic SOAR自动响应。此举标志着AI Agent监控正式成为SOC标准能力,安全预算从基础设施转向专精安全厂商的趋势得到印证。
Cisco联手G42与AMD部署阿联酋1GW AI集群,推动GPU多元化与全栈集成
Cisco与G42、AMD合作,在阿联酋部署基于AMD MI350X GPU的大规模AI集群,集成Cisco全栈安全AI基础设施(UCS服务器、Nexus 9K交换机、Firepower防火墙等)。这标志着Cisco从网络厂商转型为AI基础设施全栈集成商,并推动AMD成为美国盟国AI算力第二供应商,同时锁定阿联酋市场对抗中国厂商。
CrowdStrike集成Claude API:AI Agent安全监控正式成为SOC核心遥测
CrowdStrike将Anthropic Claude Compliance API集成到Falcon平台,在Next-Gen SIEM中统一监控Claude Enterprise/Platform活动日志与对话,并与端点、身份、云遥测关联,实现AI Agent安全可视与自动化响应。
Cisco演示运营级QKD量子网络,控制层向编排器转移
Cisco在意大利光子中心演示基于纠缠的QKD运营级量子网络,集成Aliro Orchestrator作为量子网络管理层,通过SKIP接口将量子密钥注入Cisco 8000系列路由器,实现MACsec加密会话,验证量子安全通信从研究到生产部署的跃迁。
Microsoft发布Agent Framework Go SDK,与Google争夺Go开发者生态
2026年7月,Microsoft发布Agent Framework的Go SDK公开预览版,支持MCP和多Agent协调。此举使Microsoft与Google成为仅有的两家为Go语言提供原生Agent框架的一线云厂商,而OpenAI和Anthropic仍仅支持Python,面临开发者生态流失风险。
AMD确认Zen 6 EPYC Venice:首款2nm服务器CPU,2026年7月登场
AMD确认将于2026年7月22-23日推出基于Zen 6架构的EPYC Venice服务器CPU,这是业界首款采用2nm制程的芯片。该CPU采用三层混合架构,单核性能提升约29%,多核提升约22%,核心数达128-192核,旨在强化AI推理与CPU-GPU协同。
Intel发布18A太空级SoC Starfire,剑指Xilinx太空计算生态
Intel发布Starfire太空级SoC,基于18A工艺与Foveros封装,是Panther Lake的太空加固衍生版。面向卫星载荷与太空AI推理,2026Q3提供样品,旨在以先进AI性能和SWaP-C优化争夺Xilinx/Microchip的太空FPGA市场。
FortiBleed漏洞暴露7万台设备:攻击面从0day转向凭证管理薄弱点
2026年7月曝光的FortiBleed攻击活动针对超过73,000台Fortinet设备,通过定制工具拦截VPN凭证。攻击者利用默认或弱密码入侵,而非未知漏洞,已确认与INC和Lynx勒索软件组织关联。全球银行、能源和关键基础设施运营商受影响,凸显基础安全措施失效的行业级威胁。