筛选

×
当前筛选 清除全部
关键词: agentic AI ×
189 情报总数
1/10 当前页
AMD 其他 2026-07-26

AMD Helios投产:12层HBM4容量制胜,开放UALoE挑战NVLink封闭生态

AMD第二代Helios机架AI服务器全面投产,搭载72张MI455X GPU和Samsung独家12层HBM4内存,单机柜31TB。相比NVIDIA Rubin 8层设计,容量提升50%,成本降低30%。微软Azure规模部署,标志Hyperscaler双供应商策略落地。

Microsoft 其他 2026-07-25

Databricks全面Azure化并采用Cobalt 200 ARM,Microsoft锁定AI Agent控制平面

Databricks将全面迁移至Azure,采用Microsoft Cobalt 200 ARM芯片处理数据与AI工作负载,同时深度集成Genie和Unity AI Gateway至Microsoft产品线,形成长期锁定。Databricks完成188亿美元估值融资。

Google 其他 2026-07-24

Google启动Gemini 4预训练,4M+上下文与月度迭代加速AI竞赛

Alphabet确认启动史上最大规模预训练Gemini 4,支持4M+上下文和多模态原生,计划接近月度发布。同时上调2026资本开支至$1950-2050亿,Google Cloud Q2增长82%,显示全栈AI战略加速。

AMD 其他 2026-07-24

AMD Helios机架全栈出击,以开放网络UALoE挑战NVIDIA NVLink生态锁死

AMD在Advancing AI 2026发布Helios机架级方案,集成72颗MI455X GPU、18颗Venice EPYC CPU及Pensando网络,推理token/$比NVIDIA NVL72高30%,并推出UALoE开放标准。与Cerebras、Cisco等合作,构建全栈AI基础设施对抗NVIDIA。

Microsoft 其他 2026-07-24

AMD Helios全栈AI服务器获Azure规模化部署,UALoE开放标准挑战NVLink

AMD与Microsoft Azure联合宣布Helios全栈AI服务器将在Azure规模化部署,采用72×MI455X GPU、18×EPYC Venice CPU和Pensando DPU,配备31TB HBM4和1.7PB/s显存带宽。同时推出两个新Azure VM系列,分别面向Agentic AI和半导体设计。此举标志着Microsoft多供应商战略关键落地,直接挑战NVIDIA在AI基础设施的主导地位。

HPE 其他 2026-07-22

HPE扩展Private Cloud AI产品线,集成NVIDIA Vera Rubin NVL72平台

...

NVIDIA 其他 2026-07-22

NVIDIA Vera Rubin GPU+CPU完整披露:3360亿晶体管、88核Olympus,智能体AI能效10倍

NVIDIA完整披露Vera Rubin GPU与Vera CPU规格。Rubin GPU基于3nm工艺,3360亿晶体管,HBM4 288GB,智能体AI能效达Blackwell 10倍。Vera CPU搭载88核Olympus,智能体AI任务较Intel Sapphire Rapids快2.2倍。全栈策略强化,对AMD/Intel构成直接竞争。

ARM 其他 2026-07-19

ARM自产AGI CPU登顶超算,性能功耗比3倍于x86改写HPC格局

ARM在ISC 2026宣布,基于Armv9的LineShine超算以超2 exaflops性能登顶TOP500。同时发布自研AGI CPU(136个Neoverse V3核心)专为千兆瓦级AI数据中心,Neoverse系统在Green500包揽前四,性能功耗比达x86的3倍。

Huawei 其他 2026-07-17

华为WAIC亮出昇腾950超节点:1024卡共享256TB内存,AI算力走向系统级统一

华为在WAIC 2026首次公开展示昇腾950超节点(Atlas 950 SuperPoD),基于昇腾950DT芯片,单柜64卡,单系统支持1024卡高速互联,实现256TB统一内存编址,专为万亿参数大模型训练与Agentic AI推理设计,标志着AI基础设施从芯片堆叠转向系统级统一架构。

Google 其他 2026-07-15

Google BigQuery深度集成Gemini Enterprise,重塑AI治理控制权

Google Cloud推出方案,将Gemini Enterprise应用的遥测数据(用户提示、模型响应、活动日志)实时路由到BigQuery。利用BigQuery的AI分析能力(Conversational Analytics、自动Schema生成),实现大规模AI部署的自动化审计、合规治理和业务洞察,强化数据驱动的AI可观测性。

Microsoft 其他 2026-07-15

Microsoft发布Agent Framework Go SDK,与Google争夺Go开发者生态

2026年7月,Microsoft发布Agent Framework的Go SDK公开预览版,支持MCP和多Agent协调。此举使Microsoft与Google成为仅有的两家为Go语言提供原生Agent框架的一线云厂商,而OpenAI和Anthropic仍仅支持Python,面临开发者生态流失风险。

NVIDIA 其他 2026-07-08

NVIDIA发布Rigel CPU核心:单线程性能成Agentic AI新控制点

NVIDIA首次披露Rosa CPU架构,采用自研Rigel核心(Arm v9.2),专为Agentic AI工作负载优化单线程性能,配套Feynman GPU(1.6nm,50 PFLOPS)于2028年推出。该战略将CPU从核心数量竞赛转向串行延迟优化,直接威胁AMD EPYC和Intel至强数据中心基本盘。

NVIDIA 其他 2026-07-07

NVIDIA发布Vera CPU:以最大单线程性能重构AI Agent生态

NVIDIA推出Vera CPU,专为AI Agent工作负载设计,采用Olympus核心,提供比x86高1.8倍的持续每核心性能。该CPU与NVIDIA GPU和BlueField统一架构,旨在构建AI工厂的统一计算平台,挑战现有x86 CPU生态。

NVIDIA 其他 2026-07-07

AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters

...

Huawei 其他 2026-06-25

华为MWC上海2026力推Token计费:从字节管道转向AI价值交付,运营商需重构网络架构

华为在MWC上海2026提出运营商应从基于字节的计费转向基于AI Token的计费,并展示了AI推理加速方案,将长序列推理吞吐量提升372%。同时强调U6 GHz频段对AI可穿戴设备上行链路的关键作用,推动5G-A网络成为AI计算交付基础设施。

OpenAI 其他 2026-06-25

Oracle国防生态第三批:离线AI边缘部署成为军事实战新范式

Oracle在布鲁塞尔国防科技峰会上宣布国防生态系统第三批成员,新增10家公司。同时,Whitespace的Saga AI系统已在英国皇家海军HIGHMAST行动中部署在Oracle Roving Edge Devices上,实现完全离线的分类AI工作负载处理,标志着主权边缘AI从概念走向实战。

NVIDIA 其他 2026-06-25

高通发布Dragonfly数据中心CPU与HBC内存,以推理优先架构挑战NVIDIA霸权

高通在投资者日公布完整数据中心路线图,包括250核Oryon CPU(Dragonfly C1000)、近内存计算HBC(声称133TB/s带宽)、AI300推理加速器(54x带宽提升),以及800G/1.6T互联。与Meta签署多年CPU供应协议,2028年商用,旨在以低功耗高带宽颠覆AI推理市场。

OpenAI 其他 2026-06-25

OpenAI联手Broadcom推出Jalapeno推理芯片,重塑AI硬件生态

OpenAI与Broadcom合作开发了名为Jalapeno的LLM推理加速芯片,采用多芯片模块、HBM3E内存,9个月完成流片。该芯片专为OpenAI模型栈优化,旨在降低推理成本并减少对NVIDIA GPU的依赖,计划2026年底部署。

NVIDIA 其他 2026-06-24

NVIDIA与AWS联手:cuVS默认化GPU加速向量搜索,G7实例4.6倍推理性能突破

NVIDIA与AWS深度整合,推出EC2 G7实例(基于RTX PRO 4500 Blackwell GPU),性能提升4.6倍;并在OpenSearch Serverless中默认启用cuVS进行GPU加速向量索引,速度提升10倍、成本降低75%。AWS获GB300 Exemplar Cloud认证。

Nokia 其他 2026-06-24

Nokia, Amazon Web Services expand collaboration to deliver autonomous networks built for the AI era

...