筛选

×
当前筛选 清除全部
关键词: 基础设施 ×
374 情报总数
6/19 当前页
Anthropic 其他 2026-06-30

Anthropic Claude独家登陆Azure,微软借GB300锁定AI模型分销权

Anthropic的Claude模型正式在Azure Foundry全面可用,基于NVIDIA GB300 NVL72集群(4600+ Blackwell Ultra GPU)。首批上线Opus 4.8和Haiku 4.5,支持提示缓存与扩展思考。微软获得独家企业分销渠道,强化对AWS/谷歌云的竞争地位。

Google 其他 2026-06-29

谷歌限制Meta使用Gemini算力,暴露AI基础设施供给危机与生态壁垒

谷歌因算力不足限制Meta对Gemini大模型的API调用,导致Meta AI项目延迟。此举暴露即使拥有自研TPU和全球最大数据中心,谷歌仍无法满足激增需求,迫使行业重新审视AI算力分配与供应链韧性。

NVIDIA 其他 2026-06-29

英伟达Space-1瞄准太空AI算力,用Vera Rubin锁定轨道生态

英伟达为Space-1系统招募首席软件架构师,推进太空AI计算落地。Space-1搭载Vera Rubin芯片,专为近地轨道设计,需抵御辐射和温差。此举标志英伟达从概念进入实体研发,但商业回报仍遥远。

Samsung Electronics 其他 2026-06-29

三星与SK海力士十年4.4万亿投资,AI存储与代工军备竞赛升级

三星电子与SK海力士宣布未来十年超1000万亿韩元(约4.4万亿人民币)投资计划,重点用于HBM4内存扩产、3nm GAA工艺良率提升及新建AI芯片工厂。此举旨在巩固HBM双寡头地位,并缩小与台积电在先进制程代工市场的差距,全球AI基础设施供应链成本结构将受深刻影响。

OpenAI 其他 2026-06-26

OpenAI联手博通9个月流片自研推理芯片Jalapeño,剑指NVIDIA生态

OpenAI与博通联合发布首款自研推理ASIC芯片Jalapeño,采用TSMC 3nm工艺,专为Transformer推理优化,目标推理成本降低50%。从设计到流片仅9个月,计划2026年底部署于千兆瓦级数据中心,标志着OpenAI向全栈AI基础设施提供商转型,直接挑战NVIDIA在推理市场的控制权。

Qualcomm 其他 2026-06-26

Qualcomm 39亿美元收购Modular并开源Mojo,直击NVIDIA CUDA控制权

Qualcomm以39亿美元全股票交易收购AI基础设施初创公司Modular,并宣布开源Mojo编程语言。Mojo结合Python易用性与系统级性能,旨在为AI开发者提供不依赖CUDA的高性能计算路径,强化Qualcomm在AI推理芯片及边缘AI市场的软件生态。

Microsoft Azure 其他 2026-06-25

微软削减Azure中国研发:地缘政治迫使AI云战略收缩

微软裁减北京上海200-400名Azure中国研发岗位,2026年7月前完成。受美国AI芯片出口管制及中国数据安全法影响,前沿AI开发受阻。Azure中国通过世纪互联运营,份额已跌至5%以下,远落后于阿里云30%和华为云19%。

OpenAI 其他 2026-06-25

OpenAI联合博通发布推理ASIC Jalapeño,摆脱NVIDIA GPU依赖

OpenAI与博通合作推出首款定制AI推理芯片Jalapeño,9个月完成流片,专为大模型推理优化。OpenAI负责架构,博通负责网络硬件,Celestica集成。计划2026年底大规模部署,配套千兆瓦级数据中心,旨在降低推理成本并减少对NVIDIA的依赖。

ARM 其他 2026-06-23

Arm服务器市占突破45%:NVIDIA捆绑策略重塑AI基础设施架构

IDC数据显示,基于Arm架构的服务器已占据全球服务器市场超45%份额,主要驱动力来自NVIDIA将其Arm架构Vera CPU与NVL72、Rubin等GPU系统捆绑销售。x86阵营份额萎缩至52%,而加速系统贡献了70%以上营收。ODM直销占比50.2%,戴尔营收同比增长244.1%。

Cloudflare 其他 2026-06-23

Cloudflare全球故障暴露单点依赖风险,加速多CDN架构转型

Cloudflare于2026年6月22日发生重大服务中断,影响全球超20%网站。故障原因未明,但事件凸显了互联网基础设施单点故障风险,可能促使企业加速采用多云/多CDN架构以分散风险。

Check Point 其他 2026-06-23

Check Point押注GPT-5.5特权接入,安全控制权从防火墙转向大模型API

Check Point加入OpenAI网络安全可信接入计划,获得GPT-5.5高阶特权级接入权限,用于威胁分析等防御场景。这标志着安全竞争核心从自研最优防火墙转向获取顶尖大模型的可靠接入权限,但接入权限完全由OpenAI掌控。

Nokia 其他 2026-06-23

诺基亚联合谷歌云,用Gemini重塑网络运维范式

诺基亚将谷歌Gemini集成至其网络保障中心,打造6款AI智能体,覆盖事件分诊、异常检测等场景,宣称将故障排查时间缩短50%-80%。系统基于谷歌云平台,计划以SaaS形式于2026年9月推出。

Intel 其他 2026-06-23

英特尔Computex 2026:以CPU编排Agentic AI,x86重夺推理控制权

英特尔在Computex 2026发布基于18A制程的288核至强6+处理器与第三代酷睿Ultra,强调Agentic AI工作负载使CPU:GPU配比从1:8跃升至1:1,并联合SambaNova、富士康推出机架级推理系统,试图将CPU重新定义为AI推理的编排核心。

Cloudflare 其他 2026-06-22

Cloudflare AI网关2.0:边缘控制平面夺取AI推理路由与安全主导权

Cloudflare推出AI Gateway 2.0,通过智能路由跨越50+模型提供商,宣称降低成本30%;同时推出Workers AI边缘推理(延迟<10ms),与NVIDIA合作部署GPU加速服务,并扩展AI防火墙。此举将AI流量控制平面从云巨头转移至边缘网络。

HPE 其他 2026-06-22

HPE ProLiant DL394 Gen12搭载NVIDIA Vera CPU,AI计算架构迎来ARM颠覆

HPE在Computex 2026展示基于NVIDIA Vera CPU的ProLiant DL394 Gen12服务器,2026年秋上市。Vera为NVIDIA首款数据中心CPU,百万级量产,AI性能较x86提升1.8倍。首批客户包括OpenAI、Anthropic、xAI等。HPE继续推进GreenLake即服务战略,同时保留Intel至强6+选项。

Apple 其他 2026-06-22

Apple打破封闭:Private Cloud Compute扩展至Google Cloud,采用NVIDIA机密GPU

Apple在WWDC 2026宣布将其Private Cloud Compute(PCC)扩展至Google Cloud,利用NVIDIA GPU的Confidential Computing能力进行安全AI推理。这标志着Apple AI基础设施从自有数据中心向第三方云的策略性转变,同时M6 Neural Engine性能提升。

Intel 其他 2026-06-22

Intel推至强6+及AI战略:CPU重掌AI基础设施控制平面

Intel在Computex 2026发布基于18A制程的至强6+处理器(288能效核,576MB L3缓存)、以太网800系列E835控制器(200GbE)及下一代GPU Crescent Island,并宣布与SambaNova、富士康合作机架级AI基础设施。战略核心是让至强CPU成为智能体AI的控制平面。

Microsoft Azure 其他 2026-06-21

微软Azure Blackwell Ultra集群发布,AI训练即服务锁定生态控制权

微软Azure发布搭载NVIDIA Blackwell Ultra GPU的AI超级计算机集群,峰值算力超200 exaflops,并推出AI训练即服务(AI Training as a Service)。与OpenAI合作部署GPT-6训练集群(预计2027年),采用液冷技术实现PUE 1.08,旨在将万亿参数模型训练全面迁移至云平台。

Cisco 其他 2026-06-21

思科Cloud Control AI平台:控制平面从域工具转向统一代理编排

思科在Cisco Live 2026推出Cisco Cloud Control,一个统一平台,让人类和AI代理协同管理网络、安全、计算等IT基础设施。核心组件包括AI Canvas协作空间、Cloud Control Studio代理构建器(支持50+第三方集成)和Live Protect运行时防护,意图将分散的运维控制点集中到一个智能编排层。

MediaTek 其他 2026-06-19

联发科AI战略转向系统级整合:瞄准谷歌TPU与马斯克芯片机架

联发科将其AI业务从芯片设计升级为系统级设计,初期目标包括谷歌TPU的PCBA L6组装及马斯克AI芯片的L10机架整合。采用轻资产模式,依托台湾供应链,目标毛利率40%以上,驱动因素为CPO和800V高压供电带来的机架设计复杂性。