发生了什么
Z ai 发布 GLM-5.2(CritPt 20.9%)
为什么值得关注
GLM-5.2在硬核物理基准上追平顶尖专有模型,较前代跃升4.5倍,是开放权重模型科学推理能力的重要里程碑,值得关注原文及后续分析。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
GLM-5.2在CritPt基准上匹配Claude Opus 4.8
Z ai的GLM-5.2(最大推理努力)在CritPt基准上得分为20.9%,与Claude Opus 4.8持平,远超其他开放权重模型(DeepSeek V4 Pro为12.9%),并超越GPT-5.5、Gemini 3.1 Pro等专有模型。相比10周前GLM-5.1的4.6%,实现4.5倍跃升。CritPt由Argonne和UIUC联合开发,答案保密,由Artificial Analysis独立评测。
打开原始来源 ↗