情报
AI 生成的结构化厂商动态简报
Google Cloud扩展Gemini企业代理平台,推出运行时、身份与治理新功能
Google Cloud宣布Gemini企业代理平台多项功能正式可用,包括Agent Runtime(最长7天持续运行)、Agent Memory Bank(持久化上下文)、Agent Identity(原生IAM)、Agent Gateway(统一网关)和Agent Observability(追踪与仪表盘),旨在为企业构建长时间运行的AI代理提供治理和监控能力。
Rate limit test
...
Test CNN
...
Test TheStreet
...
Test Associated Press
...
Test BBC
...
Test article
...
Google Cloud推出托管蒸馏服务,大幅降低企业高级推理AI部署门槛
Google Cloud将DeepMind的AlphaEvolve(进化式代码优化)作为API正式上线,并推出基于Gemini 3.1 Pro到Gemini 2.5 Flash的托管蒸馏服务,允许企业以Flash级别的速度和成本运行专业推理负载,同时发布面向科学领域的Co-Scientist等AI工具。
Palo Alto收购Embrace推Synthetics,构建AI数字体验监控闭环
Palo Alto Networks宣布收购RUM厂商Embrace并推出自研Synthetics主动测试,整合现有Observability平台与Cortex AgentiX,形成从真实用户体验到基础设施健康的闭环数字体验监控。此举标志着Palo Alto从网络安全向AI Agent驱动的全栈可观测性提供商转型,直接挑战Datadog和New Relic。
AlphaEvolve GA:Google DeepMind AI自我进化优化数据中心效率
2026年7月19日,Google DeepMind宣布基于Gemini的多智能体进化系统AlphaEvolve正式GA。该系统能够自主设计算法、进行数学发现并优化数据中心效率,已应用于Borg调度器和Orca推理基础设施,旨在通过AI自我改进显著降低超大规模AI算力投入的Capex。
Google BigQuery深度集成Gemini Enterprise,重塑AI治理控制权
Google Cloud推出方案,将Gemini Enterprise应用的遥测数据(用户提示、模型响应、活动日志)实时路由到BigQuery。利用BigQuery的AI分析能力(Conversational Analytics、自动Schema生成),实现大规模AI部署的自动化审计、合规治理和业务洞察,强化数据驱动的AI可观测性。
百亿美元押注Forward Deployed Engineer:AI部署控制权从模型转向工程
微软、OpenAI、Anthropic、AWS同期宣布近百亿美元投资Forward Deployed Engineer(驻场部署工程师)模式,模型可互换成为默认前提,稀缺资源从模型参数转向将AI嵌入业务流程的工程能力。这一趋势标志着企业AI部署范式的根本性转变。
Google发布第八代TPU:训练性能3倍跃升,推理SRAM暴增3倍,锁定AI算力新拐点
Google Cloud Next 2026推出第八代TPU,分为训练专用TPU 8t(单Pod 9600颗,2PB共享内存)和推理专用TPU 8i(1152颗,片上SRAM增3倍)。同时发布Gemini Enterprise Agent Platform,整合AI代理构建、治理与安全,并推出N4 Axion ARM实例(性价比2倍于x86)。
Google发布Antigravity 2.0,用AI智能体取代传统IDE并强制迁移
Google发布Antigravity 2.0,包含桌面应用、CLI、SDK和Managed Agents API,强制关闭Gemini CLI并迁移到Antigravity CLI。同时推出Gemini Spark个人AI智能体运行在Google Cloud专用VM上,通过MCP连接第三方工具。此举将编码辅助从编辑器功能升级为软件劳动操作系统。
Google AI Studio Starter Tier:预配置无服务器堆栈,以生态锁定换取零门槛部署
Google推出AI Studio Starter Tier,提供预配置的Cloud Run、Firestore、Cloud SQL for PostgreSQL和Firebase Authentication堆栈,无需支付方式即可从原型到上线。该层锁定单区域、有限API和共享配额,但支持无缝升级到完整GCP项目,旨在降低AI应用部署门槛并强化生态绑定。
Google Cloud 为 AI Agent 嵌入法律可验证身份,监管驱动架构重构
Google Cloud 为 Gemini Enterprise 和 Vertex AI Agent Engine 引入基于 SPIFFE 的 Agent Identity,并集成 Kakunin 的合规层,将内部 SPIFFE 标识映射为 AWS KMS 生成的 X.509 证书,所有状态变更写入 WORM 审计日志。此举将运行时安全升级为法律可审计的市场参与者身份,以应对 EU AI Act 和 MiCA 的问责要求。
Google开源Brazos液冷:风冷数据中心即插即用高密度冷却
Google发布Brazos模块化液冷系统,可在现有风冷数据中心中逐机架部署,支持60kW热负载。系统基于OCP ORv3标准,开源设计,降低液冷采纳门槛,无需大规模设施改造。
Google TPU 8代训练推理芯片分离,AI基础设施性价比拐点到来
Google Cloud推出第八代TPU,将训练芯片TPU8t与推理芯片TPU8i分离,训练Pod级性能提升3倍,推理美元当量性能提升80%。同时Vertex AI进化为Gemini Enterprise Agent Platform,结合Smals主权云合同,加速公共部门AI采纳。
Google发布Lightning Engine:4.9x性能提升背后的生态锁定与架构隐忧
Google Cloud宣布Lightning Engine全面可用,基于开源Gluten和Velox实现向量化原生执行,声称性能提升4.9倍,价格性能比领先2倍。深度优化Cloud Storage和BigQuery连接器,但通过专有集成和premium tier强化生态锁定。
GKE Inference Gateway前缀缓存:AI推理延迟降低92%,但锁定风险暗藏
Google Cloud推出GKE Inference Gateway,通过前缀缓存和模型感知路由,在Llama 3.1 8B模型上实现92.8%更短首令牌延迟和15.7%更高吞吐量。Snap实测缓存命中率达75-80%。但该技术深度绑定GKE Gateway API和Google生态,企业需警惕架构弹性损失。