情报
AI 生成的结构化厂商动态简报
AMD通过Vultr开源AI软件组件,向NVIDIA CUDA生态发起生态重构挑战
AMD通过Vultr Marketplace发布开源、模块化的企业AI软件组件,包括AMD Inference Microservices (AIMs)、AI Workbench、Resource Manager和Solution Blueprints。该组合旨在提供生产级AI基础设施,避免单一厂商锁定,直接挑战NVIDIA的CUDA生态。
联发科借谷歌ASIC订单转型AI芯片,挑战博通定制市场霸权
联发科与谷歌达成定制ASIC协议,用于AI基础设施,并将2026年AI ASIC收入目标翻倍至20亿美元。同时联合英伟达设计N1X CPU用于AI PC,可能获得SpaceX/xAI订单,采用英特尔14A工艺。此举标志着联发科从消费电子向AI基础设施芯片的生态位跃迁。
ARM转型芯片直销:从IP授权商到AI芯片供应商的战略临界点
ARM宣布加速实现150亿美元芯片收入目标,计划从纯IP授权模式转向直接销售AI芯片。此举将颠覆与高通、苹果等客户的合作关系,并直接挑战Nvidia、Intel等传统芯片厂商,推动半导体生态位重组。
美国政府勒令Anthropic封锁海外访问,AI模型出口管制进入强制时代
美国政府以国家安全为由,命令Anthropic阻止任何外国国民访问其最新模型Fable 5和Mythos 5,导致全球禁用。此举由亚马逊安全研究人员举报触发,并涉及中国团体曾获取Mythos访问权限的传闻。Anthropic被迫配合,IPO前遭遇重大合规冲击。
OpenAI IPO驱动超级应用转型:GPT-5.6与广告扩张下的生态锁定风险
OpenAI提交IPO申请,计划将ChatGPT改造为超级应用平台,集成编码工具、AI代理和广告服务。即将发布的GPT-5.6将支持150万token上下文窗口,同时降低API定价以应对竞争。此举标志着OpenAI从模型提供商向平台生态的转型,企业需警惕长期锁定风险。
NVIDIA力推World-Action模型:机器人控制权从语言转向视频基础模型
NVIDIA发表深度技术博客,提出World-Action Model(WAM)作为VLM-based VLA的替代路线。WAM利用预训练视频/世界模型骨干,同时预测未来状态和机器人动作,旨在克服VLA的语言-动作接地鸿沟。该范式可能重塑机器人基础模型训练格局,但面临推理成本和实时性挑战。
NVIDIA携ASUS推桌面级DGX Station:GB300芯片下放,控制点从云转向本地硬件生态
ASUS发布ExpertCenter Pro ET900N G3,基于NVIDIA DGX Station GB300架构,搭载GB300 Grace Blackwell Ultra芯片,提供748GB统一内存和20 PFLOPS AI性能。该桌面级AI超算支持本地LLM微调、推理及AI agent工作负载,通过NVLink-C2C实现高速互连,并集成NVIDIA AI软件栈与NemoClaw框架。
DXC与Anthropic深度绑定:用Claude认证工程师军团锁定关键任务AI部署
DXC与Anthropic宣布多年全球合作,DXC成为Claude Partner Network全球顶级合作伙伴。双方将培训数万名Claude认证工程师,通过DXC OASIS平台在银行、保险、制造等关键任务环境中部署Claude模型,采用“Customer Zero”内部验证模式。
Carmen Li推动GPU期货市场:算力金融化将颠覆AI基础设施采购模式
Carmen Li通过Silicon Data和Compute Exchange构建GPU价格指数和现货市场,目标推出计算期货。该计划获DRW支持,旨在解决GPU价格波动,标准化算力交易,可能创造万亿美元级新资产类别,彻底改变AI算力的定价与分配机制。
Cloudflare吸纳Ensemble团队:架构级模型压缩重塑边缘推理经济
Cloudflare宣布吸纳Ensemble AI核心团队,引入其架构级模型压缩技术NdLinear和NdLinear-LoRA。该技术通过保留多维激活结构而非扁平化处理,直接减少Transformer模型的参数量和计算开销。此举旨在显著降低Workers AI平台的推理成本,提升GPU利用率,并加速全球边缘AI部署。
美国政府出口管制强制下线Claude Fable 5,AI监管进入地缘政治硬约束时代
Anthropic最新Claude Fable 5模型因美国政府出口管制仅上线4天下线,起因是亚马逊担忧其被用于网络攻击。Anthropic拒绝修复越狱漏洞,政府直接干预。中国智谱AI同日发布开源模型GLM-5.2,预示AI部署范式转向开源与主权化。
高通AI200借AWS入云:推理芯片生态从英伟达独走向多元联盟
高通AI200推理芯片(768GB内存)预计2026年大规模部署于AWS,旨在降低云推理成本。此举标志着高通从移动端向云数据中心的关键战略转移,并借助AWS定制化芯片战略,直接挑战英伟达在AI推理环节的垄断地位,重构云推理芯片生态联盟。
NVIDIA借DSX平台与SK电讯共建千兆瓦级AI云,加速主权AI工厂生态锁定
SK电讯宣布采用NVIDIA DSX平台在韩国建设千兆瓦级AI云,首个AI工厂2027年上线。该平台整合NVIDIA加速计算、系统与软件,支持主权、物理及代理AI服务,旨在成为亚洲AI基础设施标杆。
NVIDIA GB300 NVL72在Agentic AI基准测试中实现20倍能效跃升,定义新推理标准
NVIDIA在第三方AA-AgentPerf基准测试中,凭借GB300 NVL72的72 GPU NVLink域、MXFP4/MXFP8内核及MoE优化,实现每兆瓦并发agent数达H200的20倍。该基准首次标准化agentic推理性能度量,直接冲击数据中心容量规划。
NVIDIA推AgentPerf基准测试:Blackwell Ultra每瓦代理数较Hopper提升20倍
NVIDIA与Artificial Analysis联合发布首个Agentic AI基准测试AgentPerf,结果显示GB300 NVL72平台在运行DeepSeek V4 Pro等MoE模型时,每兆瓦可承载的并发代理数较HGX H200提升20倍。该基准模拟真实编码代理轨迹,测量端到端吞吐与响应延迟。
NVIDIA联手SK Hynix锁定HBM4/5标准,Vera Rubin供应链闭环成型
NVIDIA与SK Hynix签署多年协议,联合定义HBM4量产及HBM5预研,覆盖Vera Rubin GPU架构。Samsung同步进入HBM4供应链。此举将SK Hynix从供应商升级为联合开发者,可能形成事实上的AI内存标准壁垒,挤压美光等对手空间。
Google 300万+颗TPU封装订单转向Intel Foundry:EMIB技术打破台积电CoWoS垄断
Google已向Intel Foundry下达超过300万颗下一代TPU的先进封装订单,采用Intel EMIB技术,2028年量产。这是Intel Foundry最大外部客户突破,标志着AI芯片封装从台积电CoWoS向多元化供应链的关键转折。
AMD Zen 6 Venice 256核EPYC以3.3倍机柜性能反击NVIDIA Vera,但预估数据存疑
AMD首次公布基于2nm制程的Zen 6 Venice EPYC处理器性能预估,在100kW整柜功耗下,以SPEC CPU 2017_rate基准,整数吞吐量达NVIDIA Vera CPU的3.3倍。此举是对NVIDIA Arm生态入侵x86数据中心领域的直接回应,但数据为理论推演而非实测硅片。
AMD投建全栈Instinct GPU云:TensorWave B轮融资暴露NVIDIA生态破局战略
TensorWave完成3.5亿美元B轮融资,AMD Ventures联合领投,估值达15.5亿美元。该云平台完全基于AMD Instinct GPU(MI300X至MI455X)构建,主攻记忆密集型AI工作负载,旨在提供绕过NVIDIA CUDA锁定的替代算力路径,并验证ROCm软件栈的商业化成熟度。
思科AI Defense Policy Studio:用元提示将隐性策略转化为可审计护栏
思科推出AI Defense Policy Studio,通过一个AI助手引导策略所有者以对话方式定义自定义AI护栏。该工具使用元提示(meta-prompting)技术,将非正式指导转化为人类和模型可读的策略文档,并直接部署到思科AI Defense运行时进行执行。