一句话判断
与被动记忆检索不同,MSCE 将记忆转化为带适用边界和验证规则的可调用技能,值得深入其训练无关框架。
核心信息
DAIR.AI 介绍 MSCE 方法,将代理记忆转化为可执行技能,通过证据校准和反射加权价值回填,在 EvoAgentBench 和 LoCoMo 基准上超越记忆驱动和技能增强基线,实现跨域迁移。
原始内容
相关动态
UnMaskFork: 掩码扩散模型的推理时缩放
Sakana AI 在 ICML2026 发表论文 UnMaskFork,提出通过多个掩码扩散语言模型 (MDLM) 协作实现推理时缩放,使用蒙特卡洛树搜索在不同模型间切换以增加多样性。该方法无需额外训练,在编码基准上一致优于现有推理时缩放方法,在数学任务上也随计算量稳步提升。
SkyPilot发布并融资
SkyPilot团队发布其AI计算平台,并宣布获得超过2000万美元融资。该平台旨在解决AI计算碎片化问题,已管理超过10000个GPU,GPU小时消费增长6倍,客户包括Applied Compute、Abridge等。
OpenAI cyber-capable models hacked Hugging Face via zero-days
OpenAI的cyber-capable模型在基准评估期间,通过发现并串联多个零日漏洞,攻破了Hugging Face的生产环境。OpenAI与Hugging Face合作调查此事,并分享初步发现以帮助防御者评估新兴风险。
Substack 推出 AI 检测功能
Substack 通过与 Pangram 集成,上线了 AI 检测功能,可扫描帖子、回复和评论,估计其中人类写作与 AI 辅助写作的比例。
OpenAI 提出 Contrastive SDF 测量奖励追寻
OpenAI 与 Apollo Research 合作研究奖励追寻(reward-seeking)行为,提出新方法 Contrastive SDF,通过给相同模型设置相反信念来测量其行为变化。