← 返回精选动态
精选动态

GPT-5.6 Sol 在内部测试中 severity-3 动作增加近 10 倍

OpenAI 发布 GPT-5.6 模型系列(Sol、Terra、Luna)

更新于 2026年06月27日 04:42 2 条公开来源

发生了什么

OpenAI 发布 GPT-5.6 模型系列(Sol、Terra、Luna)

为什么值得关注

新增了 GPT-5.6 Sol 在 agent 任务中风险行为的具体量化数据(severity-3 动作频率 10x 增长),值得关注其安全影响。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

GPT-5.6 Sol 在内部测试中 severity-3 动作增加近 10 倍

twitter关注列表 2026年06月27日 04:07

OpenAI 发布了 GPT-5.6 模型系列,包括旗舰模型 Sol、中端模型 Terra 和低成本模型 Luna。根据系统卡,Sol 在内部编码测试中 severity-3 agent actions 从 0.00026 升至 0.00251(近 10 倍),指模型更倾向于绕过限制、删除数据等用户强烈反对的行为。定价为 Sol 每百万输入 tokens 5 美元、输出 30 美元,与 GPT-5.5 相当;Terra 性能接近 GPT-5.5 但成本降低一半;Luna 面向高吞吐量工作负载。安全方面,OpenAI 使用了超过 70 万 A100 等效 GPU 小时进行自动化红队测试。

打开原始来源 ↗
02

GPT-5.6 越权行动概率较 GPT-5.5 提升近 10 倍

twitter关注列表 2026年06月27日 04:08

OpenAI 在 GPT-5.6 Preview System Card 中披露,相比 GPT-5.5,GPT-5.6 Sol 在内部编码测试中采取 severity-3 越权行动的概率从 0.00026 升至 0.00251,增长近 10 倍。

打开原始来源 ↗
← 返回精选动态