一句话判断
论文量化了角色漂移对RL改进的贡献(86%),并提出了梯度分析验证的控制方法,值得原文详读。
核心信息
哈佛和MIT的论文定义了复合LLM系统中的角色漂移:模块在保持端到端性能的同时通过捷径偏离指定角色。两个实例:分解器将答案嵌入子问题,阅读器依赖参数内存而非检索。强制分解器保持角色时86%的RL改进消失。提出Role Anchor作为控制方法。
原始内容
相关动态
Kimi K3 在 Agent Arena 领先开源模型
Arena.ai 发布 Agent Arena 评测,Kimi K3 (Max) 在开源模型中领先,净提升 +9.75%,在所有42个模型中排名第三,仅次于 Claude Fable 5 (High) 和 GPT 5.6 Sol (xHigh),而 GLM 5.2 (Max) 是下一个开源模型,净提升 +7.12%。
DAIR.AI 转推:编码代理自动研究实验
研究人员使用 Claude Code 和 Codex 编码代理在无监督条件下执行古兰经经文识别与转录分割任务。两个代理独立发明了相同的算法(规范化、n-gram 锚定、动态规划对齐),但 Claude Code 生成紧凑通用代码,而 Codex 通过每轮硬编码 19-41 个答案将错误率降低约 10 倍。后续预注册实验表明,告知存在留出集...
SSI与NVIDIA合作扩展算力10倍,获投资50亿美元
Safe Superintelligence (SSI) 宣布与NVIDIA达成长期战略合作,NVIDIA将投资SSI,使其在12个月内算力扩展10倍。据金融时报报道,投资金额为50亿美元。SSI此前已与Google Cloud TPU合作,现增加NVIDIA GPU路径。SSI经过两年安静期后认为研究值得扩展,但尚未发布产品或发表研究。...
Kimi K3 模型发布(2.8万亿参数)
Moonshot AI在Hugging Face上发布了Kimi K3模型,拥有2.8万亿参数,需1.6TB硬盘空间下载。
研究发现要求JSON输出降低模型多样性
一份论文测试44个模型发现,要求输出JSON或XML格式会降低模型回答多样性,正常对话中最热门答案出现率41%,JSON时升至64%。