筛选

×
当前筛选 清除全部
关键词: 推理优化 ×
11 情报总数
Apple 其他 2026-07-28

苹果M7芯片跳过M6代际直指端侧AI推理加速

...

Other 其他 2026-07-27

阿里云WAIC 2026发布Agent-Native全栈,开源SAIL软件栈挑战CUDA生态

阿里云在WAIC 2026发布Agent-Native云套件(AgentLoop/AgentTeams/AgentRun/TokenWorks),开源T-Head SAIL AI软件栈,推出2.4T参数模型Qwen 3.8-Max-Preview及Zhenwu M890超节点,全面布局Agent-Native云与开源AI生态,意图构建从硬件到平台的全栈竞争力。

AMD 其他 2026-07-25

AMD发布2nm GPU MI455X与Zen 6 EPYC,双线夹击NVIDIA与英特尔

AMD在Advancing AI 2026大会上宣布数据中心CPU市场份额达46%,并发布全球首颗2nm制程GPU Instinct MI455X,采用CDNA架构与HBM4内存,专为AI训练与推理优化。同时推出第六代EPYC Venice处理器,基于Zen 6架构,进一步强化AI负载性能。

AMD 其他 2026-07-20

微软Azure部署AMD Helios全栈AI机架,打破NVIDIA云AI独占生态

微软Azure正式引入AMD Helios机架级AI基础设施,每机架搭载72颗MI455X GPU(432GB HBM4,19.6TB/s带宽)、Venice EPYC CPU和Pensando DPU,并推出ND MI455X v7(推理)、HDv2(预处理)、HXv2(HPC)三个新实例,标志着Azure AI计算从NVIDIA独家转向多供应商策略。

Huawei 其他 2026-07-19

华为昇腾950超节点:自研HCCS互联打造AI算力自主生态

华为在WAIC展示昇腾950超节点,集成32颗自研昇腾950 AI处理器,通过自研HCCS高速互联实现芯片间超低延迟通信,算力密度较上一代提升2.5倍,支持万亿参数模型训练,旨在提供不依赖海外供应链的AI算力选择。

OpenAI 其他 2026-06-26

OpenAI联手博通9个月流片自研推理芯片Jalapeño,剑指NVIDIA生态

OpenAI与博通联合发布首款自研推理ASIC芯片Jalapeño,采用TSMC 3nm工艺,专为Transformer推理优化,目标推理成本降低50%。从设计到流片仅9个月,计划2026年底部署于千兆瓦级数据中心,标志着OpenAI向全栈AI基础设施提供商转型,直接挑战NVIDIA在推理市场的控制权。

MediaTek 其他 2026-06-23

联发科独家接单谷歌TPU v9推理升级款Triggerfish,SRAM缓存翻倍

谷歌计划推出TPU v9推理优化升级款Triggerfish,由联发科独家代工。该芯片SRAM缓存规模为前代2-3倍,DRAM升级至HBM4E,并引入simulation die用于本地管理。预计2027年底投产,生命周期出货100-200万颗,单价高出约三成。

Microsoft Azure 其他 2026-06-22

Google发布第八代TPU:训练性能3倍跃升,推理SRAM暴增3倍,锁定AI算力新拐点

Google Cloud Next 2026推出第八代TPU,分为训练专用TPU 8t(单Pod 9600颗,2PB共享内存)和推理专用TPU 8i(1152颗,片上SRAM增3倍)。同时发布Gemini Enterprise Agent Platform,整合AI代理构建、治理与安全,并推出N4 Axion ARM实例(性价比2倍于x86)。

NVIDIA 其他 2026-05-25

NVIDIA Vera CPU冲击x86:1.5倍性能与4倍密度,AI推理全栈锁定

据传闻,NVIDIA将在Computex 2026展示自研通用CPU Vera,性能达x86的1.5倍、吞吐量2倍、机架密度4倍。FY2027出货目标120万颗,FY2028达420万颗。Vera旨在满足AI推理时代CPU/GPU配比从1:8向1:1演进的需求,与Grace双线并行,构建GPU+CPU全栈生态。

Meta 其他 强信号 2026-03-11

Meta加速自研AI芯片路线图,专注推理优化

Meta计划两年内推出四代自研AI芯片MTIA系列,采用‘推理优先’设计策略,专注于生成式AI推理任务优化。芯片基于PyTorch和开放计算标准构建,支持数据中心无缝部署。这一快速迭代策略旨在提升计算效率和成本控制。

AMD 其他 中信号 2026-03-02

AMD推出ROCm AI开发者中心强化软件生态

AMD推出ROCm AI开发者中心,提供集中化软件工具和资源平台,支持开发者在AMD GPU上进行AI模型训练和推理优化。该平台通过文档、工具和最佳实践简化开发流程,提升从开发到部署的效率。