筛选

×
当前筛选 清除全部
关键词: SWE-bench ×
11 情报总数
Anthropic 其他 2026-07-26

Anthropic Claude Opus 5登陆AWS Bedrock,0%注入率挑战OpenAI安全论断

Anthropic发布Claude Opus 5,在AWS Bedrock四个区域GA,同时上线Claude Platform。Auto Mode在129个浏览器代理测试中实现0% prompt injection,反驳OpenAI'无法解决'论。定价$5/$25 per M token,性能领先,半价对标Fable 5。

Anthropic 其他 2026-07-03

Anthropic发布Sonnet 5中端模型,性能逼近旗舰Opus,加速企业生态锁定

Anthropic发布中端模型Claude Sonnet 5,在SWE-bench Pro和知识工作基准测试中性能逼近旗舰Opus 4.8,定价仅为旗舰的六成。同时推出Claude Science科研工作台,整合60多个科学数据库,意图通过工具链和性价比优势深化企业用户锁定。

Anthropic 其他 2026-07-02

Anthropic发布Sonnet 5:以旗舰40%成本实现近Opus级性能,重构AI推理经济

Anthropic发布中端旗舰模型Claude Sonnet 5,定价仅为Opus 4.8的40%。该模型在SWE-bench Pro编码测试中得分63.2%,逼近Opus 4.8的69.2%;在知识工作基准GDPval-AA v2中以1618分超越Opus 4.8。Sonnet 5原生支持100万Token上下文,平均激活480亿参数,旨在以高性价比驱动大规模API收入增长。

OpenAI 其他 2026-06-23

OpenAI GPT-5.6激进定价与150万上下文窗口,加速Agent化转型

OpenAI传闻发布GPT-5.6,上下文扩展至150万token,定价仅为Claude Fable 5的三分之一,并强化Agent可靠性。此举意在利用Anthropic被下线窗口期抢占市场,同时修复reward hacking事故。

NVIDIA 其他 2026-06-04

NVIDIA Nemotron 3 Ultra:以MoE与MOPD重构AI Agent控制平面,锁定企业推理成本

NVIDIA发布**Nemotron 3 Ultra**,一个550B参数MoE模型(55B活跃),专为AI Agent编排而设计。通过**多教师在线策略蒸馏(MOPD)** 与**Hybrid Mamba-Transformer**架构,其在**SWE-bench**等任务中实现5倍吞吐量提升与30%成本节省,标志着推理控制权从单一模型向分层Agent系统的转移。

Anthropic 财务新闻 强信号 2026-04-30

Anthropic年度经常性收入突破$30B年化:Claude商业化进入收获期

Anthropic ARR超越$30B年化是一个商业里程碑,但从战略角度看更值得关注的是"多云分发策略的有效性验证"。Claude能在三大云平台同时可用,意味着Anthropic建立了OpenAI和Google都无法复制的渠道优势。

Anthropic 其他 强信号 2026-04-16

Anthropic发布Claude Opus 4.7并引入网络安全护栏

Anthropic正式发布Claude Opus 4.7模型,在复杂软件工程、多模态理解和长时推理任务上实现显著提升。该版本首次引入了针对高风险网络安全用途的自动检测与拦截护栏,并为安全研究设立了验证程序,旨在为更强大模型(如Mythos)的广泛发布积累安全经验。

Anthropic 产品发布 强信号 2026-04-16

Claude Opus 4.7发布:SWE-bench 87.6%刷新SOTA

Anthropic发布Claude Opus 4.7,刷新SWE-bench 87.6% SOTA。编程能力暴涨11%,Cursor代码完成率从58%升至70%。视觉理解3倍提升,支持375万像素图像。

Anthropic 产品发布 强信号 2026-04-15

Claude Mythos发布:最强模型限制公开

Anthropic发布Claude Mythos,性能大幅超越Opus 4.6和GPT-5.4。但因安全风险过高不公开上市,仅向50家关键基础设施合作伙伴提供防御性使用。

Anthropic 其他 2021-10-07

Anthropic联合科技巨头推出Project Glasswing:用AI模型自主发现零日漏洞,重塑网络安全防御范式

Anthropic宣布Project Glasswing,联合AWS、Apple、Cisco、Google、Microsoft、NVIDIA等十余家巨头,使用其前沿模型Claude Mythos Preview自主扫描并发现数千个零日漏洞,包括在OpenBSD、FFmpeg、Linux内核中存在数十年的漏洞。Anthropic提供1亿美元使用额度,意图将AI能力用于防御性安全,推动行业安全实践的根本性变革。

Research 其他 1970-01-01

智谱GLM-5.2开源:MIT协议744B MoE,以可下载模型对抗地缘政治禁运

智谱AI发布GLM-5.2,744B MoE仅40B激活参数,支持1M输入上下文和131K输出,采用MIT开源协议。时间点紧贴Anthropic Fable 5被美国政府强制下架,提供可下载、不可被禁的替代方案,兼容Anthropic API实现零代码迁移,旨在为企业提供技术主权选项。