发生了什么
开源模型 分析 网络安全能力差距(4-7个月)
为什么值得关注
与先前认知相比,开源模型追赶速度加快,且长期网络能力表现出可随推理计算扩展的特性,值得关注GLM-5.2的具体评测及GPT-5.6 Sol的防御应用。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
开源模型长期网络能力差距缩小至4-7个月
长期网络能力方面,领先开源模型落后闭源前沿从2025年大部分时间的6-10个月缩短至4-7个月。GLM-5.2匹配了约4个月前发布的闭源模型。AI安全研究所的32步“The Last Ones”任务中,GPT-5.6 Sol在10次尝试中完成7次,每次预算1亿token,且性能随推理token增加而提升。
打开原始来源 ↗