← 返回精选动态
精选动态

GLM-5.2 量化模型本地运行测试

Unsloth AI 发布 GLM-5.2(GGUF 2-bit 量化)

更新于 2026年06月23日 23:49 1 条公开来源

发生了什么

Unsloth AI 发布 GLM-5.2(GGUF 2-bit 量化)

为什么值得关注

提供了量化后具体尺寸、精度和速度数据,值得关注开源模型本地部署可行性。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

GLM-5.2 量化模型本地运行测试

twitter关注列表 2026年06月23日 21:53

Unsloth AI 将 GLM-5.2 模型量化至 2-bit GGUF 格式,大小从 1.51TB 压缩至 238GB(-84%),保留约 82% 准确率,可在 256GB Mac Studio M3 Ultra 上以约 21.6 tok/s 速度本地运行,并与 Claude 4.8 Opus 和 GPT-5.5 进行了单次输出对比。

打开原始来源 ↗
← 返回精选动态