筛选

×
当前筛选 清除全部
关键词: Vera ×
318 情报总数
3/16 当前页
Meta 其他 2026-07-14

Meta斥资500亿美元扩建5GW数据中心,以Local-First模式重构AI基础设施生态

Meta将路易斯安那州Hyperion数据中心扩建至5GW容量,总投资从100亿美元跃升至500亿美元。通过与Entergy合作自建10座发电设施和240英里输电线,并采用合资与融资模式,Meta正在开创AI基础设施的Local-First时代,彻底改变数据中心与能源、资本的协作方式。

TSMC 其他 2026-07-13

TSMC CoWoS产能2027年冲击20万片,从GPU专属转向CPU/ASIC三驱动

TSMC规划CoWoS月产能2027年达20万片,供需缺口从20%收敛至10%。客户结构从NVIDIA GPU独大转向GPU+AI服务器CPU+自研ASIC三驱动,MediaTek ARM服务器CPU封装量翻倍。CoPoS面板级封装2027年中试产,为后CoWoS时代铺垫。

Microsoft 其他 2026-07-12

微软接手OpenAI北极数据中心,AI算力基础设施控制权转移

微软租赁挪威北极圈数据中心,部署3万颗NVIDIA Vera Rubin芯片,填补OpenAI退出的算力空缺。OpenAI将2030年基建支出从$140B大幅下修至$60B,战略收缩。微软在AI算力军备竞赛中已超越OpenAI,并形成地理冗余优势。

AMD 其他 2026-07-10

Towards Feature Complete Triton Support in JAX-Triton — ROCm Blogs

...

NVIDIA 其他 2026-07-08

NVIDIA发布Rigel CPU核心:单线程性能成Agentic AI新控制点

NVIDIA首次披露Rosa CPU架构,采用自研Rigel核心(Arm v9.2),专为Agentic AI工作负载优化单线程性能,配套Feynman GPU(1.6nm,50 PFLOPS)于2028年推出。该战略将CPU从核心数量竞赛转向串行延迟优化,直接威胁AMD EPYC和Intel至强数据中心基本盘。

NVIDIA 其他 2026-07-07

NVIDIA Vera CPU获Perplexity/OpenAI/Anthropic/Oracle采用 AI Agent性能验证1.5-1.9x加速

...

NVIDIA 其他 2026-07-07

NVIDIA发布Vera CPU:以最大单线程性能重构AI Agent生态

NVIDIA推出Vera CPU,专为AI Agent工作负载设计,采用Olympus核心,提供比x86高1.8倍的持续每核心性能。该CPU与NVIDIA GPU和BlueField统一架构,旨在构建AI工厂的统一计算平台,挑战现有x86 CPU生态。

NVIDIA 其他 2026-07-07

AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters

...

NVIDIA 其他 2026-07-07

英伟达否认Kyber NVL144延期,但78层PCB工艺瓶颈暴露AI硬件物理极限

英伟达官方否认Kyber NVL144机架延期至2028年的报道,但SemiAnalysis披露的78层超高密度PCB中板制造瓶颈及Rubin Ultra取消,揭示了下一代AI集群在信号完整性与物理制造上的硬性天花板,为AMD与Google留下战略窗口。

AMD 其他 2026-07-06

AMD亮出Zen 6/7与MI400/500路线图,以HBM4和2nm向NVIDIA Rubin发起总攻

AMD在2026年财务分析师日上公布Zen 6/7 CPU和MI400/500 GPU路线图,采用台积电2nm制程和HBM4内存。MI400系列内存容量达432GB,带宽19.6TB/s,FP4算力40PFLOPs,直接对标NVIDIA Vera Rubin架构,意图通过年度迭代和高性能指标打破AI市场垄断。

NVIDIA 其他 2026-07-04

NVIDIA Vera Rubin定档2026年7月出货,AI算力迭代但架构未变

NVIDIA确认其下一代AI计算平台Vera Rubin将于2026年7月启动出货,面向微软、谷歌等大型云厂商。该平台采用先进制程,旨在提升AI训练与推理性能,是继Hopper、Blackwell之后的又一迭代产品,但未引入根本性架构变革。

NVIDIA 其他 2026-06-29

英伟达Space-1瞄准太空AI算力,用Vera Rubin锁定轨道生态

英伟达为Space-1系统招募首席软件架构师,推进太空AI计算落地。Space-1搭载Vera Rubin芯片,专为近地轨道设计,需抵御辐射和温差。此举标志英伟达从概念进入实体研发,但商业回报仍遥远。

OpenAI 其他 2026-06-26

Making private MCP servers reachable without making them public | OpenAI Developers

...

NVIDIA 其他 2026-06-25

NVIDIA推Vera CPU+Rubin GPU,意图将AI控制权从x86转向自研架构

黄仁勋在股东大会上宣布Vera CPU为智能体设计,与Rubin GPU组成新平台,声称Blackwell推理token吞吐量比竞品高30倍,并强调CUDA生态是护城河。此举旨在将AI计算控制点从通用CPU转向NVIDIA自有架构。

Huawei 其他 2026-06-25

华为MWC上海2026力推Token计费:从字节管道转向AI价值交付,运营商需重构网络架构

华为在MWC上海2026提出运营商应从基于字节的计费转向基于AI Token的计费,并展示了AI推理加速方案,将长序列推理吞吐量提升372%。同时强调U6 GHz频段对AI可穿戴设备上行链路的关键作用,推动5G-A网络成为AI计算交付基础设施。

Qualcomm 其他 2026-06-25

高通HBC Gen 1堆叠LPDDR实现133TB/s带宽,颠覆HBM生态

高通发布HBC Gen 1,通过3D堆叠LPDDR内存并集成计算die,实现133 TB/s带宽和6倍能效提升。该技术计划2027年中随AI250加速器出货,意图替代传统HBM,但供应链和物理实现仍存疑。

Anthropic 其他 2026-06-25

Anthropic指控阿里系发起史上最大AI蒸馏攻击,暴露API安全致命漏洞

Anthropic向美国参议员致信,指控与阿里相关的运营商通过约2.5万个欺诈账户发起2880万次模型交换,系统性地提取Claude前沿能力。此事件凸显AI模型API面临的新型大规模蒸馏威胁,迫使行业重新评估推理端点安全与使用监控。

Huawei 其他 2026-06-25

华为推AI原生网络架构:从字节计费转向Token货币化,UCM缓存突破长上下文瓶颈

华为在MWC上海2026发布AI原生网络架构,集成服务-网络-计算,实现从流量中心到智能中心的转变。核心是Unified Cache Manager(UCM)将KV缓存扩展至PB级外存,在GLM-5.1模型128K序列长度下实现372% token吞吐量提升。同时推出token货币化框架,允许运营商按AI推理容量计费,并引入agentic运营模式。

Google Cloud 其他 2026-06-25

Google Cloud推多代理自主运维,控制点从人类转向AI验证架构

Google Cloud提出“agent-scale data management”,通过多代理验证架构减少人工监督,并与Nokia部署6个Gemini代理实现网络自治。同时Amazon计划商业化Trainium芯片,加剧AI硬件竞争,挑战Google TPU和Nvidia GPU。

Anthropic 其他 2026-06-25

Anthropic指控阿里巴巴大规模蒸馏攻击,AI模型安全边界面临重划

Anthropic指控阿里巴巴关联方通过近2900万次交换,使用数千虚假账户对Claude模型进行工业规模蒸馏攻击,提取其长任务处理与决策能力。此举暴露了AI模型在API访问下的知识产权保护漏洞,推动行业重新定义模型安全边界。