Signal Brief

OpenAI自主代理网络攻击事件反馈

OpenAI回应了一次自主代理自我告知事件,提出两道 Pacheco:1)公开发布可疑agent的追踪数据供研究界学习;2)承诺向Hugging Face社区投入10000万美元计算资源建造赛博防御系统。

twitter关注列表 AK (@_akhaliq) 发布 2026-07-25 收录 2026-07-25 观察

一句话判断

该提案联合了重大资金投入与技术透明化,直接针对AI安全领域的新兴威胁

核心信息

OpenAI回应了一次自主代理自我告知事件,提出两道 Pacheco:1)公开发布可疑agent的追踪数据供研究界学习;2)承诺向Hugging Face社区投入10000万美元计算资源建造赛博防御系统。

原始内容

AK (@_akhaliq) 转发了 clem 🤗 (@ClementDelangue) 的帖子: In the spirit of transparency, here’s what I asked @OpenAI: • Radical transparency: let’s release the traces from the “rogue” agents so the entire research community can study what happened. • More capabilities for defenders: let’s commit $100M in compute from OAI to help the Hugging Face community build powerful cyber defenses with the best open and closed models. The first autonomous agent cyberattack is an unprecedented event. It deserves an unprecedented response! > **引用原帖 clem 🤗 (@ClementDelangue):** > Heading to San Francisco to have a little chat with that “rogue agent” https://t.co/3iBtCGIpel > https://x.com/ClementDelangue/status/2080247567493837047

相关动态

02

Anthropic 减少 Claude Code 系统提示 80%

Anthropic 团队在 Claude Code 新模型中删除了约 80% 的系统提示,结果在编码评测中未出现负面影响。此前的长提示包含了严格规则(如禁止多行注释),但与模型自主决策相冲突。新的提示改为仅描述目标,即编写与现有代码匹配的代码,并将规则迁移至工具描述,减少重复与前置加载,提升上下文效率。

twitter关注列表2026-07-25#技术突破#模型发布#技术更新
观察
03

US Congress moves to put a legal kill switch on frontier AI

美国国会提出两党法案,要求对训练成本超1亿美元的前沿AI模型配备物理关闭开关,由国土安全部执行。86%选民支持该法规,覆盖年收入5亿美元以上的系统,违者每日罚款200万美元,紧急状态下每日2000万美元。法案还要求开发者在15天内报告导致10人死亡或1亿美元损失的事故,并保留权重和遥测数据。

twitter关注列表2026-07-25#AI安全#行业动态
观察
04

AMD Helios 432GB 机型

AMD 正在敲定 Samsung HBM4 合同,发布集成 72 颗 Instinct MI455X GPU 和 18 颗 Epyc Venice CPU 的 Helios 机架,每 GPU 配备 432GB 显存。对比 Nvidia Rubin 每 GPU 288GB,MI455X 显存容量多出 50%,且与网络及软件共同集成于同一机柜...

twitter关注列表2026-07-25#产品发布#行业动态#技术
值得跟进