发生了什么
Anthropic 公布 Fable 5 安全分类器及越狱框架
为什么值得关注
本文详细披露了Fable 5安全分类器的四类划分和安全裕度设置,以及越狱严重性框架草案,这些细节此前未公开。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
More details on Fable 5’s cyber safeguards
Anthropic公布了Claude Fable 5的网络安全分类器细节,将网络活动分为禁止、高风险双重用途、低风险双重用途和良性使用四类,并设定了比之前模型更大的安全裕度。同时,他们提出了一个AI越狱严重性框架草案,旨在与政府及行业建立统一标准,并已启动HackerOne计划接收越狱报告。
打开原始来源 ↗