发生了什么
Artificial Analysis 评测 GLM-5.2(1524 Elo, #3 overall)
为什么值得关注
GLM-5.2 在真实工作场景评测中超越多数闭源模型且价格低廉,值得查看原文的具体任务示例以评估其实用性。
信息来源
以下内容来自公开来源,可打开原文继续核验。
GLM-5.2 开源 Agent 评测第三
Artificial Analysis 评测显示,GLM-5.2 在真实世界 agentic 工作基准 GDPval-AA 上获得 1524 Elo,排名第三,仅次于 Claude Fable 5 (1783) 和 Claude Opus 4.8 (1615),与 GPT-5.5 (xhigh, 1509) 持平,是开源模型中最高分,领先第二名 MiniMax-M3 (1408) 约 116 分,并超越 Gemini 3.5 Flash 等闭源模型。该模型定价为每百万输入/输出 token $1.40/$4.40。
打开原始来源 ↗