← 返回精选动态
精选动态

GLM-5.2 开源 Agent 评测第三

Artificial Analysis 评测 GLM-5.2(1524 Elo, #3 overall)

更新于 2026年06月23日 02:43 1 条公开来源

发生了什么

Artificial Analysis 评测 GLM-5.2(1524 Elo, #3 overall)

为什么值得关注

GLM-5.2 在真实工作场景评测中超越多数闭源模型且价格低廉,值得查看原文的具体任务示例以评估其实用性。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

GLM-5.2 开源 Agent 评测第三

twitter关注列表 2026年06月23日 02:13

Artificial Analysis 评测显示,GLM-5.2 在真实世界 agentic 工作基准 GDPval-AA 上获得 1524 Elo,排名第三,仅次于 Claude Fable 5 (1783) 和 Claude Opus 4.8 (1615),与 GPT-5.5 (xhigh, 1509) 持平,是开源模型中最高分,领先第二名 MiniMax-M3 (1408) 约 116 分,并超越 Gemini 3.5 Flash 等闭源模型。该模型定价为每百万输入/输出 token $1.40/$4.40。

打开原始来源 ↗
← 返回精选动态