← 返回精选动态
精选动态

GLM-5.2 公开首个 1M-token 长上下文模型

GLM-5.2 发布 1M-context(1M token)

更新于 2026年06月17日 07:30 2 条公开来源

发生了什么

GLM-5.2 发布 1M-context(1M token)

为什么值得关注

其 IndexShare 方案大幅降低 FLOPs 并首次在 1M 长度上实现高质量长时序推理,值得关注。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

GLM-5.2 公开首个 1M-token 长上下文模型

twitter关注列表 2026年06月17日 07:12

离线 AI 研发团队推出 GLM-5.2,首个在 1M-token 上下文下稳定工作、具备长时序编码任务能力的开源模型。其新技术包括 IndexShare 通过在每四个稀疏注意力层共享同一索引器,使每 token FLOPs 在 1M 长度下降低 2.9 倍,以及改进的 MTP 线性层将拟议解码的接受长度提升 20%。GLM-5.2 在 FrontierSWE、PostTrainBench 与 SWE-Marathon 三大长时序编码基准上,分别以 1% 逼近 Opus‑4.8、在 PostTrainBench 位列第二并仅落后 Opus‑4.8;在 SWE‑Marathon 与 Opus‑4.8 差距 13%。

打开原始来源 ↗
02

Zai.org发布GLM-5.2长上下文大模型

twitter关注列表 2026年06月17日 01:49

Zai_org开源GLM-5.2大模型,提升了长上下文(1M token)能力,在Terminal-Bench 2.1的编码测试中得分提升至81.0(同比提升30个点),引入 henshin分区、Token Stabilizer升级等技术优化,同时保持API定价基本不变,推出多努力级别模型版本

打开原始来源 ↗
← 返回精选动态