发生了什么
Anthropic 发表 Claude Sonnet 4.5 网络安全防御
为什么值得关注
新增信息在于 Anthropic 明确把 Claude Sonnet 4.5 的优化重点放在漏洞发现、补丁修复和防御性安全测试,并给出其相较 Opus 4.1 更便宜、更快且在多项网络安全能力上可比或更强的结论。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Building AI for Cyber Defenders
Anthropic 讨论了将 Claude 用于网络安全防御的进展,称在过去一年里,前沿模型已从“理论可用”转向“实践可用”,并强调 AI 在攻防双方的能力差距正在快速变化。Anthropic 表示,Claude Sonnet 4.5 在发现代码漏洞和其他 cyber skills 上,已经达到或超过两个月前发布的 Claude Opus 4.1;同时它更便宜、速度更快。文中还提到,Anthropic 曾展示模型可在模拟中复现 2017 年 Equifax 数据泄露、在网络安全竞赛中部分情况下击败人类团队,并帮助发现自身代码中的漏洞;此外,Anthropic 的 Safeguards 团队还发现并阻断了利用 Claude 进行大规模数据勒索和更复杂间谍行动的案例。
打开原始来源 ↗Building AI for cyber defenders
Anthropic 介绍了其面向网络防御场景的 AI 研究进展,称已投入改进 Claude 在代码和已部署系统中检测、分析与修复漏洞的能力。公司表示,Claude Sonnet 4.5 在发现代码漏洞等网络安全能力上已与或超过两个月前发布的前沿模型 Opus 4.1,并且更便宜、更快。文中还提到,Anthropic 观察到前沿模型已被用于模拟 2017 年 Equifax 泄露、在网络安全竞赛中战胜人类团队、在 DARPA AI Cyber Challenge 中扫描数百万行代码,以及被滥用于大规模数据勒索和复杂间谍行动。
打开原始来源 ↗