情报
AI 生成的结构化厂商动态简报
Project Perception:多模型AI编排漏洞修复,控制权转移
Microsoft正在开发代号Project Perception的AI安全产品,通过编排多个AI模型自动化完成漏洞发现、分类、补丁生成、验证与部署全流程。这标志着安全运营从人工驱动向自愈系统转型,控制权从安全分析师转移到AI编排平台。
PrismML 1-bit压缩技术突破:270亿参数Qwen模型4GB内完整运行于手机端
PrismML实现270亿参数稠密大模型压缩至4GB,在iPhone 17 Pro上全量激活运行。采用原生1-bit技术(权重仅{-1, +1}),压缩比超92%,推理速度提升8倍,能耗降低75-80%。显著区别于Apple稀疏架构方案,有望重塑端侧AI部署范式。
Towards Feature Complete Triton Support in JAX-Triton â ROCm Blogs
...
微软重构Copilot应用,消费者与企业版合并为单一产品
...
OpenAI通过系统优化将推理成本砍半,数百GPU支撑ChatGPT海量请求
OpenAI通过模型量化(FP16→INT4/INT8)、KV-Cache优化、动态批处理与投机解码等系统底层技术,将AI推理成本降低50%以上,仅用数百张NVIDIA GPU支撑ChatGPT未登录用户流量。推理毛利率从38%跃升至65%,实现接近盈亏平衡。
NVIDIA推AI计算合伙人计划:用信用兜底+收入分成锁定云厂商,转型算力央行
NVIDIA推出AI计算合伙人计划,通过收入分成与信用兜底机制,从硬件销售转向持续性服务收益。首批项目包括澳洲Sharon AI的4万张GB300芯片和印尼Firmus的17万张GPU,总规模二十万级高端芯片。NVIDIA正成为AI算力的“中央银行”,压缩云中间商空间。
AWS与Anthropic签Token付费协议,重塑AI云生态利益分配
亚马逊AWS与Anthropic达成新协议,从按算力付费转向按Token付费。此举旨在应对亚马逊自有Nova模型竞争力不足的困境,同时深化与Anthropic的绑定,以对标微软-OpenAI的合作模式,但为亚马逊的AI支出引入了新的成本变量。
思科收购WideField:将身份会话智能注入Splunk Agentic SOC,争夺AI代理安全控制平面
思科宣布收购WideField Security,将其身份与会话智能能力整合进Splunk的Agentic SOC。此举旨在解决AI代理、非人类身份等机器速度活动带来的新型安全风险,通过确定性数据管道和会话级信号,实现证据驱动的自主响应,强化Cisco Data Fabric中的信任层。
AMD MLPerf 6.0:MI350系列用MXFP4实现3.5倍代际提升,多节点训练首秀
AMD在MLPerf Training 6.0中提交了最全面的结果,包括首次多节点训练(FLUX.1在512 GPU上)和MXFP4训练配方。MI355X相比MI300X在Llama 2-70B上实现3.5倍性能提升,且与NVIDIA B200的差距缩小至5%以内。10家生态伙伴验证了可复现性。
NVIDIA联手Google DeepMind推出并行文本生成模型,吞吐量突破1000 tokens/sec
NVIDIA宣布与Google DeepMind合作优化DiffusionGemma,该模型基于扩散去噪实现每步并行生成256个token,在单个H100上达到1000 tokens/sec,并通过NIM和NeMo提供即用部署,显著降低推理成本和延迟。
OpenAI押注Codex:从聊天机器人到智能体控制平台的战略跃迁
OpenAI计划对ChatGPT进行史上最大改版,核心是将Codex编程工具、AI智能体和第三方应用整合为超级应用。此举标志着产品定位从问答聊天机器人,转向以Codex为控制平面的智能体执行平台,旨在提升企业变现能力并应对Anthropic的竞争压力。
Google I/O 2026:TPU 8t/8i跨数据中心训练与Gemini 3.5 Flash速度革命
Google发布第八代TPU:TPU 8t(训练)和TPU 8i(推理),原始计算力提升3倍,性能功耗比提升2倍。通过JAX/Pathways实现跨100万+TPU的分布式训练。同时推出Gemini 3.5 Flash,输出速度是其他前沿模型的4倍,并在GDPVal等基准上领先。SynthID被OpenAI、Nvidia等采用。
思科收购Astrix Security,强化非人身份与AI代理安全控制层
思科宣布计划收购非人身份安全公司Astrix Security,旨在将AI代理与API密钥、服务账户等非人身份的安全管理,深度整合至其身份智能平台与零信任访问方案中。此举标志着安全控制点正从传统人机交互向自动化AI代理工作负载迁移,以应对由AI代理滥用凭证引发的全新攻击面。
思科通过Vision Portal将AI与网络融合,强化物理安全事件响应
思科在其Meraki Vision门户中推出新软件功能,利用AI和跨摄像头追踪技术,将智能摄像头深度集成到企业网络管理平面。此举旨在通过统一的云管理界面,将物理安全事件响应从被动监控转变为主动、快速的调查。
思科通过产品冲刺优化开发者门户,聚焦AI代理工作流数据
思科DevNet团队分享了其通过产品冲刺方法优化开发者门户和内容的具体实践,核心是建立可衡量的产品-市场匹配指标。值得注意的是,其新增的分析事件专门追踪开发者内容如何被AI编码助手或代理使用,例如复制Markdown、下载OpenAPI/SDK/MCP文档等行为。
思科宣布收购Galileo,强化AI Agent全生命周期可观测性
思科宣布计划收购专注于AI可观测性的初创公司Galileo。此举旨在将Galileo的AI质量评估、故障检测与护栏技术深度集成至Splunk可观测性云平台,为企业的AI Agent系统提供从开发到生产的全生命周期可见性与安全保障。
三星将Bixby重构为以LLM为核心的设备智能体
三星宣布其语音助手Bixby已完成架构重构,从基于命令的执行模式转变为以LLM为核心的智能体范式。新版Bixby能理解设备上下文与用户意图,自主调用设备功能与API执行复杂多步骤任务,并计划成为三星全系设备的统一交互入口。
Anthropic与Mozilla合作,AI模型可独立发现Firefox高危漏洞
Anthropic宣布其Claude Opus 4.6模型在两周内为Mozilla Firefox发现了22个漏洞,其中14个被定为高危。这标志着AI模型已能独立识别复杂软件中的未知安全漏洞,并初步尝试生成漏洞利用,预示AI在网络安全攻防两端的能力均进入新阶段。
AMD发布突破性MLPerf 6.0推理结果,展示多节点扩展与多模态能力
AMD在MLPerf Inference 6.0基准测试中,凭借Instinct MI355X GPU在Llama 2 70B和GPT-OSS-120B模型上首次突破每秒100万令牌的推理吞吐量。其提交强调了多节点扩展效率、对新型文本到视频模型(Wan-2.2-t2v)的快速启用,以及广泛的合作伙伴生态系统复现结果。
Arm首次推出自研AGI CPU,进军数据中心硅产品市场
Arm宣布其计算平台首次扩展至生产级硅产品,推出自研的Arm AGI CPU,专为AI数据中心和Agentic AI工作负载设计。该CPU旨在提供远超x86平台的每机架性能与能效,并已获得Meta、OpenAI等关键客户及广泛OEM/ODM生态支持。