情报
AI 生成的结构化厂商动态简报
英伟达Jetson平台推进边缘AI开源模型本地化部署
英伟达通过Jetson边缘AI平台实现开源生成式AI模型的本地化部署,支持包括Qwen3 4B和Mistral 3在内的多种模型在边缘设备运行。平台提供从Jetson Orin Nano到Thor的完整硬件选项,集成计算与内存于SoM以简化设计。关键性能指标显示,Jetson Thor可实现52 tokens/秒的Mistral 3推理速度。
英伟达通过ComfyUI优化与硬件协同强化AI视频生成平台
英伟达在GDC发布针对本地AI视频生成的重大更新,包括ComfyUI界面简化、NVFP4/FP8格式原生支持带来2.5倍性能提升,以及RTX Video Super Resolution节点实现高效4K超分。这些优化通过软硬件深度协同,显著降低专业AI视频创作门槛并提升效率。
英伟达报告揭示企业AI采用成熟,开源与智能体成关键驱动力
英伟达基于全球3200多名受访者的AI现状报告显示,64%的企业已积极使用AI,大型企业采用率达76%。开源技术(85%认为重要)和智能体AI(44%已部署)成为核心趋势,推动业务增长和成本节约。
AMD扩展嵌入式AI处理器产品线强化边缘计算能力
AMD扩展Ryzen AI Embedded P100系列,基于Zen 4和RDNA 3架构集成XDNA AI引擎,提供高达50 TOPS的AI推理性能。该系列针对工业自动化、医疗成像等需要实时AI处理的边缘应用场景,支持多种核心配置和内存选项。
AMD推出电信加速卡评估板拓展网络硬件生态
AMD推出针对电信与网络领域的预构建加速卡评估板,为设备开发商提供硬件设计起点。该方案旨在加速5G核心网、边缘计算及网络功能虚拟化等场景的产品开发周期。此举体现了AMD强化电信基础设施市场硬件加速解决方案的战略方向。
AMD 即将公布端到端 AI 战略与产品路线图
AMD 宣布举办 Advancing AI 活动,将系统阐述其 AI 愿景并更新端到端产品布局。活动可能涵盖从数据中心到边缘计算的 AI 加速器与软件生态进展,体现其强化全栈 AI 能力的战略意图。
AMD推出企业AI套件强化硬件软件整合
AMD发布企业AI套件,整合硬件与软件生态系统,提供从模型优化到部署的端到端工具链。该套件针对Instinct加速器和Ryzen AI处理器优化,旨在提升AI工作负载性能并降低开发复杂性。
英伟达联合电信巨头推动AI原生6G开放平台
英伟达与全球电信运营商及设备商共同承诺构建基于开放、安全AI原生平台的6G网络,将AI技术深度融入网络设计、部署和运营全流程。该平台强调开放软件硬件架构与安全韧性,旨在为沉浸式通信和普适智能计算奠定基础。
英伟达发布电信行业AI代理蓝图与推理模型
英伟达推出面向电信行业的Agentic AI蓝图和专用推理模型,基于NeMo框架构建的领域大语言模型可自主处理网络运维任务。该方案通过预训练模型降低部署门槛,推动电信网络向自主化架构演进。
AMD发布FSR Redstone SDK 2.1强化神经渲染集成
AMD发布了FSR Redstone SDK 2.1版本,为游戏开发者提供更简化的API接口以集成FSR超分辨率技术。该版本重点开放了神经渲染技术的访问权限,降低了开发者采用门槛。这是AMD在AI/机器学习图形技术领域的持续深化,旨在扩大FSR生态覆盖范围。
AMD强化数据中心加速产品线布局
AMD通过自适应与嵌入式计算部门推出数据中心加速卡产品线,基于GPU和Versal自适应计算平台技术,针对AI和HPC工作负载提供算力支持。该举措表明AMD正加强在数据中心加速市场的战略存在,与英伟达等厂商直接竞争。产品线为企业提供了多元化的AI/HPC硬件解决方案选项。
思科联合英伟达与VAST推出AI数据平台端到端安全架构
思科联合英伟达和VAST推出可部署的AI数据平台参考架构,整合计算基础设施、数据平台和安全防护。该架构通过Cilium实现K8s网络策略控制,Tetragon提供容器运行时安全,AI Defense防护应用层风险,实现从数据到AI应用的全生命周期安全。
英伟达调查显示电信网络AI自动化投资回报显著增长
英伟达发布电信行业AI应用调查报告,显示AI正成为网络自动化核心驱动力。调查预测到2026年电信运营商将获得显著投资回报,主要应用于网络流量预测、故障诊断和能源效率优化。高性能计算基础设施需求增长推动GPU加速和专用AI平台投资。
NVIDIA RTX Spark与Nemotron-3 Ultra:端侧AI控制权从云端下沉至个人PC
NVIDIA在GTC Taipei 2026发布RTX Spark个人AI超级计算机(与联发科合作)及Nemotron-3 Ultra开源混合架构模型。RTX Spark搭载N1X芯片,提供1 PFLOPS本地AI算力,首次将大模型推理下沉至PC端,并重构软件生态。此举标志英伟达从云端GPU供应商转型为端侧AI基础设施垄断者。
SK海力士HBM4E送样:3nm逻辑+384GB单GPU,引爆AI内存带宽军备竞赛
SK海力士向主要客户发出12层HBM4E样品,采用TSMC 3nm逻辑裸芯,单引脚带宽显著提升,目标平台为NVIDIA Rubin Ultra,每GPU容量达384GB。此举标志着与三星在下一代AI存储赛道正式进入抢跑阶段,HBM BOM占比已飙升至65-70%。
英伟达吞下Groq LPU:Feynman GPU融合SRAM推理单元,混合架构加速2028
英伟达通过非排他许可与逆向招安获取Groq的LPU推理技术,计划在2028年Feynman GPU中采用台积电SoIC混合键合集成大容量SRAM芯片块,实现确定性调度与80TB/s片上带宽,从纯GPU供应商向混合推理/训练平台转型。
NVIDIA Spectrum-X登顶以太网交换机市场:AI工厂生态重构网络产业格局
IDC报告显示,NVIDIA在2026年Q1以21亿美元营收(同比+192.7%)首次成为数据中心以太网交换机市场第一。核心驱动力是专为AI GPU集群设计的Spectrum-X平台,其整合了Spectrum交换机、BlueField DPU和LinkX线缆系统,标志着AI工厂网络从通用架构向垂直集成生态的根本性转变。