筛选

×
当前筛选 清除全部
关键词: 0% ×
1254 情报总数
9/63 当前页
Samsung Electronics 其他 2026-07-10

三星GAIA芯片供样,存储中心型NPU能效提升40%挑战AI PC格局

三星发布GAIA AI PC处理器,采用4nm制程和存储中心型NPU设计,将LPDDR5X控制器与NPU紧耦合,实现近存计算,能效比提升40%,算力达50 TOPS,已获微软Copilot+认证,联想计划Q4搭载。

Amazon 其他 2026-07-10

AWS Trainium 3对外销售:自研AI芯片挑战NVIDIA霸权

AWS正式对外销售第三代自研AI训练芯片Trainium 3,采用台积电3nm制程,单芯片算力达2.52 PFLOPS。Anthropic、Uber为首批客户,此举直接挑战NVIDIA主导地位,标志着AWS从云服务商向芯片供应商的战略延伸。

AMD 其他 2026-07-10

AMD实验性Topological Ghost Protocol使MI300X推理吞吐量飙升10倍

AMD在MI300X GPU上实验性推出Topological Ghost Protocol(TGP),通过KV-cache回收与分段状态管理,在高并发推理中实现431 tokens/秒吞吐量,较标准vLLM的42.7 tokens/秒提升10倍,成功率100%。该技术仍处实验阶段,但可能重新定义AI推理性能基准。

AMD 其他 2026-07-10

Towards Feature Complete Triton Support in JAX-Triton — ROCm Blogs

...

OpenAI 其他 2026-07-09

OpenAI GPT-5.6发布测试

...

OpenAI 其他 2026-07-09

OpenAI重返开源:GPT-oss系列以Apache 2.0许可部署云端卸载控制点

OpenAI发布GPT-oss-120b和GPT-oss-20b两款开源模型,采用Apache 2.0许可,可在单张80GB GPU上运行。但模型内置云端卸载机制,复杂任务自动转至闭源模型处理,表面开源实则保留核心控制点。

Google 其他 2026-07-09

Google Gemini 3.5 Pro架构重写:200万Token上下文引爆AI模型军备竞赛

Google DeepMind宣布7月17日发布Gemini 3.5 Pro,采用从头重建的预训练架构而非迭代升级,以解决数学推理、SVG生成和图像质量三大短板。模型将具备200万Token上下文窗口、Deep Think推理层和多步骤自主工作流能力,但官方规格尚未确认。

NVIDIA 其他 2026-07-09

SambaNova完成11亿美元融资估值110亿美元:推理芯片新格局确立

...

Anthropic 其他 2026-07-09

GhostApproval漏洞揭露AI编码工具系统性安全缺陷:符号链接绕过人类审核

Wiz研究院披露GhostApproval漏洞,影响六大主流AI编码工具(Claude Code、Codex、Cursor、Amazon Q、Antigravity等)。攻击者通过符号链接绕过人类审核,在开发者机器上实现持久远程访问。该漏洞暴露了Agent权限扩大后Human-in-the-Loop机制的UI层根本缺陷,需重构安全确认流程。

CrowdStrike 其他 2026-07-08

CrowdStrike借AIDR五倍增长切入身份安全,争夺AI运行时控制平面

CrowdStrike报告其AI检测与响应产品AIDR需求增长五倍,并借此拓展至身份安全领域。该产品监控AI应用数据流、检测提示词注入与模型越狱,同时发布Shadow AI Discovery for Endpoint,自动发现终端上的AI应用与LLM运行时。此举标志着安全控制点从传统端点向AI工作负载与身份融合的转移。

TSMC 其他 2026-07-08

台积电扩产PIC至2.5万片晶圆,CPO硅光互连加速淘汰传统电互联

台积电预计2028年将PIC光子集成电路月产能扩至2.5万片晶圆,其COUPE平台将成AI系统降低延迟与功耗的关键。初期产能锁定英伟达、博通和AMD,标志CPO技术从实验阶段正式迈入大规模量产准备,推动AI互连从电向光迁移。

NVIDIA 其他 2026-07-08

NVIDIA发布Rigel CPU核心:单线程性能成Agentic AI新控制点

NVIDIA首次披露Rosa CPU架构,采用自研Rigel核心(Arm v9.2),专为Agentic AI工作负载优化单线程性能,配套Feynman GPU(1.6nm,50 PFLOPS)于2028年推出。该战略将CPU从核心数量竞赛转向串行延迟优化,直接威胁AMD EPYC和Intel至强数据中心基本盘。

NVIDIA 其他 2026-07-07

NVIDIA Vera CPU获Perplexity/OpenAI/Anthropic/Oracle采用 AI Agent性能验证1.5-1.9x加速

...

NVIDIA 其他 2026-07-07

NVIDIA发布Vera CPU:以最大单线程性能重构AI Agent生态

NVIDIA推出Vera CPU,专为AI Agent工作负载设计,采用Olympus核心,提供比x86高1.8倍的持续每核心性能。该CPU与NVIDIA GPU和BlueField统一架构,旨在构建AI工厂的统一计算平台,挑战现有x86 CPU生态。

NVIDIA 其他 2026-07-07

AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters

...

Anthropic 其他 2026-07-07

Anthropic企业AI采用首超OpenAI 300亿年化收入运行率确认

...

Cisco 其他 2026-07-07

思科用Silicon One与Hypershield锁死AI数据中心安全控制平面

思科发布面向AI数据中心的下一代安全方案,将Splunk SIEM与Silicon One 51.2Tbps芯片深度绑定,通过Hypershield架构将安全策略下沉至网络边缘。此举旨在将安全控制平面从独立设备转移至其专有ASIC与管理平台,形成硬件锁定。

MediaTek 其他 2026-07-07

MediaTek联手阿里云,天玑平台端侧部署通义千问小模型

MediaTek与阿里云合作,在天玑9300/8300移动平台上完成通义千问大模型小尺寸版本的端侧部署,支持离线多轮对话。此举旨在通过NPU优化和SDK整合,抢占端侧AI推理控制权,直面高通竞争。

Cloudflare 其他 2026-07-07

Cloudflare最后通牒:强制AI爬虫分离,控制互联网数据流向

Cloudflare宣布2026年9月15日起强制AI公司分离搜索爬虫与AI训练/代理爬虫,混合爬虫将被全局拦截。同时推出Monetization Gateway和Pay Per Use机制,通过数字指纹判定内容引用并收取版权费。此举将改变AI公司获取训练数据的方式,可能加剧数据荒。

Amazon 其他 2026-07-07

AWS上调Trainium3 ASIC出货量,加速自研芯片生态对抗NVIDIA

亚马逊AWS通知供应链上调2026年Q3基于自研Trainium3芯片的ASIC服务器出货量20-30%。此举显示AWS对其自研AI芯片信心增强,旨在降低对NVIDIA GPU依赖,并推动AI基础设施自主化。同时,AWS与OpenAI宣布合作开发Stateful Runtime Environment,通过Bedrock提供服务。