Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛
内容摘要
核心要点
2026年7月22日,Alphabet CEO Sundar Pichai在Q2财报会上确认Google已启动Gemini 4预训练,称之为'史上最雄心勃勃的预训练'。Gemini 4系列将采用接近按月发布的节奏,支持4M+上下文窗口和多模态原生能力,并集成Agent工具。同时,Gemini 3.5 Pro因编码性能未达DeepMind内部阈值(DeepSWE 60%+)而延期,导致Alphabet盘后跌超3%。
Alphabet将2026全年资本开支上调$150亿至$1950-2050亿(同比+160%),Google Cloud Q2同比增长82%(超预期64%),但Q2自由现金流首次为负(-$5.9B)。Pichai强调AI编码和Agentic AI是提升重点。
Google Cloud增长驱动力来自Gemini API调用、Workspace AI和Vertex AI企业客户,凸显TPU+Frozen v2+Gemini 3全栈优势。此举标志着Google对NVIDIA的依赖减少,自研TPU路线强化,同时与NVIDIA Vera Rubin和AMD Helios形成竞争。Google还持有$124.3B未识别私人投资(主要为Anthropic股份)。
重要性说明
表面上Google宣布技术突破,实则是在防守NVIDIA对AI算力的垄断,并通过TPU+Frozen v2生态合围企业客户,迫使其放弃CUDA生态。Google刻意淡化TPU编程模型与主流CUDA的不兼容性,导致企业一旦采用Google Cloud TPU,将面临极高的迁移成本和工具链锁定。同时,4M+上下文在推理时带来巨大的内存带宽和尾部延迟挑战,Google未公开其稀疏注意力或KV缓存优化的具体实现,可能隐藏了实际吞吐量下降的风险。月度迭代节奏看似敏捷,实则增加企业模型版本管理和成本控制的复杂度,迫使客户持续跟随升级,无法稳定部署。此外,Frozen v2互连带宽可能成为大规模训练瓶颈,Google未公布与NVLink或InfiniBand的对比数据,存在隐藏的扩展性限制。资本开支大幅上调但自由现金流为负,表明Google在赌注式投资,若Gemini 4未达预期,可能面临资产减值风险,最终转嫁给云客户。
PRO 决策建议
【厂商】NVIDIA应加速CUDA生态的开放性和易用性,推出与TPU竞争的GPU+网络一体化方案,强调Vera Rubin的互连优势;AMD应利用Helios的token/$优势,瞄准Google Cloud边缘推理客户,提供开放ROCm工具链。OpenAI/Anthropic应坚持模型中立,避免被云厂商锁定,提供多平台部署选项。
【企业】CIO应进行零信任技术审计,评估TPU与现有CUDA工作负载的迁移成本,要求Google提供跨云可移植性保证(如标准MLOps工具兼容)。避免单一供应商锁定,采用多模型策略,保留NVIDIA GPU和AMD GPU的备选方案。关注4M+上下文的实际推理时延和成本,要求独立基准测试。
【投资者】看穿Google的公关辞令,关注自由现金流恶化趋势和资本开支回报率。Gemini 4的成功并非确定,模型竞赛的赢家未定,Google的自研芯片可能面临规模不经济。对比NVIDIA的稳定收入和AMD的增长潜力,Google的垂直整合风险更高。
觉得这篇分析有用?
每周收到3-5条AI基础设施关键信号 →
💬 评论 (0)