发生了什么
Unsloth AI 发布 GLM-5.2(GGUF 2-bit 量化)
为什么值得关注
提供了量化后具体尺寸、精度和速度数据,值得关注开源模型本地部署可行性。
信息来源
以下内容来自公开来源,可打开原文继续核验。
GLM-5.2 量化模型本地运行测试
Unsloth AI 将 GLM-5.2 模型量化至 2-bit GGUF 格式,大小从 1.51TB 压缩至 238GB(-84%),保留约 82% 准确率,可在 256GB Mac Studio M3 Ultra 上以约 21.6 tok/s 速度本地运行,并与 Claude 4.8 Opus 和 GPT-5.5 进行了单次输出对比。
打开原始来源 ↗