← 返回精选动态
精选动态

GLM-5.2在CritPt基准上匹配Claude Opus 4.8

Z ai 发布 GLM-5.2(CritPt 20.9%)

更新于 2026年06月18日 04:38 1 条公开来源

发生了什么

Z ai 发布 GLM-5.2(CritPt 20.9%)

为什么值得关注

GLM-5.2在硬核物理基准上追平顶尖专有模型,较前代跃升4.5倍,是开放权重模型科学推理能力的重要里程碑,值得关注原文及后续分析。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

GLM-5.2在CritPt基准上匹配Claude Opus 4.8

twitter关注列表 2026年06月18日 03:32

Z ai的GLM-5.2(最大推理努力)在CritPt基准上得分为20.9%,与Claude Opus 4.8持平,远超其他开放权重模型(DeepSeek V4 Pro为12.9%),并超越GPT-5.5、Gemini 3.1 Pro等专有模型。相比10周前GLM-5.1的4.6%,实现4.5倍跃升。CritPt由Argonne和UIUC联合开发,答案保密,由Artificial Analysis独立评测。

打开原始来源 ↗
← 返回精选动态