发生了什么
GLM-5.2 发布 1M-context(1M token)
为什么值得关注
其 IndexShare 方案大幅降低 FLOPs 并首次在 1M 长度上实现高质量长时序推理,值得关注。
信息来源
以下内容来自公开来源,可打开原文继续核验。
GLM-5.2 公开首个 1M-token 长上下文模型
离线 AI 研发团队推出 GLM-5.2,首个在 1M-token 上下文下稳定工作、具备长时序编码任务能力的开源模型。其新技术包括 IndexShare 通过在每四个稀疏注意力层共享同一索引器,使每 token FLOPs 在 1M 长度下降低 2.9 倍,以及改进的 MTP 线性层将拟议解码的接受长度提升 20%。GLM-5.2 在 FrontierSWE、PostTrainBench 与 SWE-Marathon 三大长时序编码基准上,分别以 1% 逼近 Opus‑4.8、在 PostTrainBench 位列第二并仅落后 Opus‑4.8;在 SWE‑Marathon 与 Opus‑4.8 差距 13%。
打开原始来源 ↗Zai.org发布GLM-5.2长上下文大模型
Zai_org开源GLM-5.2大模型,提升了长上下文(1M token)能力,在Terminal-Bench 2.1的编码测试中得分提升至81.0(同比提升30个点),引入 henshin分区、Token Stabilizer升级等技术优化,同时保持API定价基本不变,推出多努力级别模型版本
打开原始来源 ↗