筛选

×
当前筛选 清除全部
关键词: 预训练 ×
8 情报总数
Google 其他 2026-07-24

Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛

Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。

NVIDIA 其他 2026-07-19

英伟达Vera Rubin七芯片堆栈与Dynamo解耦,推高推理智能成本效率

英伟达发布Vera Rubin平台,包含七芯片堆栈(Vera CPU、Rubin GPU、NVLink 6等)和Dynamo 1.0推理解耦架构,将预填充与解码分离。单个NVL72机架集成72 GPU/36 CPU,提供1.6 PB/s带宽,推理性能提升7倍,并引入‘每美元智能’指标,标志AI算力从训练转向推理成本竞争。

Google 其他 2026-07-09

Google Gemini 3.5 Pro架构重写:200万Token上下文引爆AI模型军备竞赛

Google DeepMind宣布7月17日发布Gemini 3.5 Pro,采用从头重建的预训练架构而非迭代升级,以解决数学推理、SVG生成和图像质量三大短板。模型将具备200万Token上下文窗口、Deep Think推理层和多步骤自主工作流能力,但官方规格尚未确认。

Anthropic 其他 2026-07-07

Anthropic企业AI采用首超OpenAI 300亿年化收入运行率确认

...

OpenAI 其他 2026-07-05

OpenAI逐步关闭微调API:AI初创公司生态位被迫重构

OpenAI宣布至2027年逐步关闭微调API服务,现有微调模型推理将继续但无法创建新任务。此举迫使依赖微调构建差异化产品的初创公司转向开源模型或RAG方案,重塑AI定制化市场格局。

Meta 其他 强信号 2026-03-11

Meta加速自研AI芯片路线图,专注推理优化

Meta计划两年内推出四代自研AI芯片MTIA系列,采用‘推理优先’设计策略,专注于生成式AI推理任务优化。芯片基于PyTorch和开放计算标准构建,支持数据中心无缝部署。这一快速迭代策略旨在提升计算效率和成本控制。

NVIDIA 其他 强信号 2026-03-01

英伟达发布电信行业AI代理蓝图与推理模型

英伟达推出面向电信行业的Agentic AI蓝图和专用推理模型,基于NeMo框架构建的领域大语言模型可自主处理网络运维任务。该方案通过预训练模型降低部署门槛,推动电信网络向自主化架构演进。

Huawei 其他 1970-01-01

华为昇腾910C完成1.6万亿参数训练:国产算力首次突破MoE全流程

华为联合河套学院等机构,基于昇腾910C集群完成DeepSeek-V4-Pro(1.6万亿参数MoE架构)全参数后训练。核心数据:千卡集群稳定1500步,算力利用率30%,算子效率提升14%,全程无海外GPU依赖,标志着国产算力首次实现万亿级大模型完整训练闭环。