发生了什么
Anthropic 评测 Claude 4.7
为什么值得关注
新榜测评数据表明GLM-5.2基准测绩接近商业模型阈值,值得关注更新。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
GLM-5.2 Quelques-Mythos (Open Weights)
研究机构评估实验模型GLM-5.2的性能,在部分基准测试中接近GPT-5.2领域,但仍比Mythos类模型偏弱,显示开源模型持续占据竞争性地位。
打开原始来源 ↗Anthropic 评测 Claude 4.7
新榜测评数据表明GLM-5.2基准测绩接近商业模型阈值,值得关注更新。
以下内容来自公开来源,可打开原文继续核验。
研究机构评估实验模型GLM-5.2的性能,在部分基准测试中接近GPT-5.2领域,但仍比Mythos类模型偏弱,显示开源模型持续占据竞争性地位。
打开原始来源 ↗