发生了什么
Anthropic 发表 用AI防御关键基础设施
为什么值得关注
原文提供了较具体的安全研究设定、环境和时间收益,适合关注 AI 安全与红队自动化的人读原文查看实验边界与可迁移性。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Experimenting with AI to Defend Critical I
Anthropic 与 Pacific Northwest National Laboratory(PNNL)合作,探索用 Claude 支持关键基础设施网络防御。PNNL 在一个高保真水处理厂仿真环境中,用 Claude 进行对手模拟与攻击重构,估计把原本需要数周的工作缩短到 3 小时;该实验使用的是 2025 年夏季的 Claude Sonnet 4,而它已不再是 Anthropic 的前沿模型。文中还提到,Claude 在一次运行中识别出预设 UAC 绕过工具失败后,改用另一种已知绕过技术完成目标,作为 AI 赋能红队和防御迭代的概念验证。
打开原始来源 ↗