发生了什么
University of Washington 研究 分析 Agent 内存提示词注入风险
为什么值得关注
揭示了 Agent 长期记忆机制带来的安全隐患,需关注 Agent 在处理持久化上下文时的清理机制。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Bad Memory: Evaluating Prompt Injection Ri
University of Washington 研究发现 Agent 系统存在内存提示词注入风险:当模型在交互中遇到存储在内存文件(如 CLAUDE.md)中的恶意指令时,即便当前会话拒绝了攻击,通常也不会自动删除该恶意指令,导致风险在后续会话中持续存在。研究人员针对 4 个模型(包含 Claude Opus)在 multi-session probe sequences 实验中进行了 10 次试验。
打开原始来源 ↗