筛选

×
当前筛选 清除全部
关键词: GPU ×
227 情报总数
3/12 当前页
AMD 其他 强信号 2026-05-25

AMD EPYC Venice业界首款量产2nm HPC CPU,$100亿封装生态投资

AMD发布EPYC Venice,业界首款量产2nm HPC CPU。同时宣布$100亿封装生态投资,与台积电、三星深度绑定先进封装产能。Venice采用2nm GAA工艺,核心数和性能未正式公布,但GF Securities预测将大幅领先当前Genoa/Bergamo。Venice+Helios(GPU)组合剑指AI推理服务器市场。2nm量产领先Intel一代,封装投资锁定供应链产能,形成工艺+产能双重护城河。

NVIDIA 其他 强信号 2026-05-25

NVIDIA Vera CPU Computex前哨:1.5x x86性能,FY2027出货120万台

NVIDIA将在Computex 2026展示Vera自研x86 CPU。GF Securities预测:1.5倍x86速度、2倍吞吐量、4倍机架密度提升,FY2027出货目标120万台。Vera+Grace双线并行,NVIDIA从GPU独占扩展为GPU+CPU全栈供应商。AI推理时代CPU/GPU配比从1:8向1:1重构,直接冲击Intel/AMD服务器CPU基本盘。关键数据:Vera采用台积电4nm工艺,支持PCIe 6.0和CXL 3.0,定位AI推理与通用计算融合场景。

NVIDIA 其他 强信号 2026-05-23

NVIDIA 开源医学图像生成框架,推动 3D 医疗 AI 数据瓶颈突破

NVIDIA 发布并开源了基于 MAISI-v2 (Latent Rectified Flow) 架构的 NV-Generate-CTMR 框架及其新模型 NV-Generate-MR-Brain。该框架旨在规模化生成高质量的 3D CT 和 MRI 合成数据,并配套发布了大规模开源多模态 MRI 数据集 MR-RATE,以解决医疗 AI 开发中的数据稀缺和隐私限制问题。

Google 其他 2026-05-22

Google Cloud展示垂直行业AI Agent架构,强调混合集成能力

Google Cloud通过客户案例Movix,展示了为牙科制造业构建的端到端AI Agent解决方案。该方案基于Google Cloud基础设施,利用定制模型和Gemini Enterprise Agent Platform,并重点设计了连接本地遗留系统的混合架构,以进入保守市场。

Google 产品发布 强信号 2026-05-22

Google I/O 2026全面押注Agentic AI:Gemini 3.5 Flash/Omni/Antigravity 2.0/Gemini Spark密集发布

Google I/O 2026发布Gemini 3.5 Flash(4倍输出速度+前沿智能)、Gemini Omni Flash(原生多模态视频生成)、Antigravity 2.0(Agent编排桌面平台+CLI+SDK)、Gemini Spark(24/7个人AI助手)。Gemini MAU从4亿增至9亿;资本开支2026年预计1800-1900亿美元(2022年的6倍)。

NVIDIA 其他 强信号 2026-05-22

NVIDIA开源GPU Usage Monitor,简化Kubernetes集群GPU监控

NVIDIA发布开源项目GPU Usage Monitor,通过一个预集成的Helm Chart,将DCGM Exporter、kube-state-metrics、Prometheus和Grafana打包部署,为Kubernetes集群中的GPU资源提供开箱即用的实时监控能力。此举旨在解决AI工作负载在K8s环境中GPU利用率不透明、资源调度盲点等运营难题。

NVIDIA 其他 强信号 2026-05-22

NVIDIA在COMPUTEX展示Vera Rubin NVL72等AI基础设施创新

NVIDIA在COMPUTEX 2026上获得多项最佳选择奖,其Vera Rubin NVL72机柜级AI超算、Jetson Thor边缘平台及Alpamayo自动驾驶开放平台获奖,展示了其在AI工厂、边缘推理和物理AI领域的基础设施布局。

Cisco 其他 强信号 2026-05-21

思科全面拥抱SONiC,提供从硬件到软件的全栈开放网络方案

思科宣布在其Cisco 8000和即将推出的N9000系列交换机上全面支持开放网络操作系统SONiC,并提供构建自有发行版和预构建镜像两种消费模式。此举旨在将思科硅芯片性能与SONiC的开放架构相结合,为AI和高性能工作负载提供可编程、可扩展的网络基础设施。

Cisco 其他 强信号 2026-05-20

思科通过芯片层智能包流重塑AI数据中心网络架构

思科推出基于Silicon One G300芯片的智能包流技术,将网络从高速传输层转变为具备感知、适应和优化能力的智能系统,以应对大规模AI工作负载。该技术通过硬件级遥测、自适应路由和拥塞管理,显著提升AI集群的集体完成时间和GPU利用率。

Intel 其他 强信号 2026-05-20

英特尔以集成SoC架构推动边缘AI机器人计算从独立GPU迁移

英特尔宣布其Core Ultra Series 3处理器正被多家机器人公司采用,以集成CPU、GPU、NPU的SoC架构替代昂贵、高功耗的独立GPU,用于边缘AI推理。这标志着机器人“大脑”向成本效益更高、更易部署的集成化异构计算架构转变。

AMD 其他 强信号 2026-05-20

AMD定义“智能代理计算机”新品类,推动AI推理本地化

AMD提出“智能代理计算机”概念,旨在通过本地化硬件(Ryzen™ AI Max处理器、Radeon™ AI PRO显卡)运行持续AI推理工作负载,以应对云API成本上升。其核心是推动AI从云端按需消费模式向本地固定成本、高吞吐量模式转移。

AMD 其他 强信号 2026-05-20

AMD发布AI Halo开发平台与Max PRO 400系列处理器,瞄准本地AI代理计算

AMD发布Ryzen AI Halo开发者平台和Ryzen AI Max PRO 400系列处理器,旨在为本地AI代理(Agent)应用提供开发与运行环境。新平台支持高达2000亿参数模型本地运行,并提供高达192GB统一内存,推动AI工作负载从云端向边缘设备迁移。

NVIDIA 其他 强信号 2026-05-20

NVIDIA与Google Cloud深化开发者生态融合,推进AI基础设施与应用栈整合

NVIDIA与Google Cloud联合开发者社区规模超10万人,提供从JAX优化、NVIDIA Dynamo推理优化到AI水印(SynthID)的全栈学习路径。此举旨在通过整合双方底层硬件(Blackwell/Rubin GPU)、云平台(GKE, AI Hypercomputer)与软件框架(Nemotron, Gemma),加速企业级AI应用从原型到生产的落地。

Microsoft 其他 强信号 2026-05-19

微软发布新一代Surface商用设备,强化端侧AI与安全集成

微软发布新一代Surface Pro和Surface Laptop商用版,搭载英特尔酷睿Ultra Series 3及后续骁龙X2处理器,强调端侧AI推理、安全设计和全栈管理。设备作为Windows AI API和Foundry平台参考硬件,旨在成为企业混合AI战略的硬件基础。

NVIDIA 其他 强信号 2026-05-19

NVIDIA与戴尔发布全栈AI工厂,加速企业级Agentic AI部署

NVIDIA与戴尔深化合作,推出更新版Dell AI Factory with NVIDIA,旨在为企业提供从工作站到数据中心的端到端Agentic AI推理与部署平台。该平台整合了NVIDIA Vera Rubin GPU、Vera CPU、Confidential Computing及Nemotron模型,强调安全、高性能的本地化AI基础设施,以应对激增的AI推理需求。

Amazon 其他 强信号 2026-05-19

AWS深化AI代理与多云连接,强化企业现代化与安全

AWS发布多项更新,重点包括将Claude Platform原生集成至AWS账户,推出更强大的EC2 M3 Ultra Mac实例,并扩展AWS Transform AI代理现代化服务至Kiro、Claude等平台。同时,AWS Security Agent新增全仓库代码扫描,AWS Interconnect新增对Oracle Cloud Infrastructure的多云连接支持。

Intel 其他 中信号 2026-05-16

AI Agent工作负载推动服务器CPU结构性短缺,Arm需求超200亿美元重塑价值链

AI基础设施瓶颈从GPU向CPU转移。Agentic AI推动CPU-GPU配比从1:8向1:1演进。AMD EPYC交付8-12周份额46.2%,Intel部分Xeon配置交付6个月,Arm 3nm 136核AGI处理器需求超200亿美元。CPU成为新瓶颈资源。

NVIDIA 其他 强信号 2026-05-16

NVIDIA CUDA Toolkit堆溢出漏洞暴露GPU云共享模型的根本架构缺陷

Pwn2Own Berlin 2026首次纳入AI/ML类别,NVIDIA CUDA NVVM编译器堆溢出CVE-2026-12839被利用。恶意PTX代码可从GPU驱动逃逸至主机内核,云环境中实现跨租户逃逸。GPU云安全隔离依赖驱动层,此漏洞打破隔离基础假设。

NVIDIA 其他 强信号 2026-05-15

英伟达发布Vera Rubin平台,通过软硬件协同设计解决智能体AI规模化难题

英伟达发布Vera Rubin平台,通过Vera Rubin NVL72 GPU与Groq 3 LPX LPU的异构协同,结合Dynamo编排器,旨在解决智能体AI推理在长上下文、万亿参数MoE模型下的规模化、低延迟与高吞吐挑战。

Cisco 其他 强信号 2026-05-14

思科借SRv6与MRC协议,强化其在AI基础设施网络层的核心地位

思科通过其博客强调,其主导的SRv6网络架构是支撑OpenAI等巨头发布的MRC协议的关键基础。这标志着AI超算网络正从传统ECMP向基于SRv6的确定性、应用驱动架构演进,思科试图将自身定位为这一变革的核心标准制定者和技术提供方。