一句话判断
删除 80% 系统提示后仍保持评测性能,为后续模型提示优化提供可操作经验。
核心信息
Anthropic 团队在 Claude Code 新模型中删除了约 80% 的系统提示,结果在编码评测中未出现负面影响。此前的长提示包含了严格规则(如禁止多行注释),但与模型自主决策相冲突。新的提示改为仅描述目标,即编写与现有代码匹配的代码,并将规则迁移至工具描述,减少重复与前置加载,提升上下文效率。
原始内容
相关动态
Induction Labs 发布 Photon-1 想象模型
Induction Labs 发布想象模型 Photon-1,该模型通过在潜空间学习 18 年屏幕录制视频的因果关系且无需动作标签,采用 JEPA 架构,预训练成本声称比 Gemini 3.1 Flash 低 30 倍且效果更优,动作仍需后训练 RL 习得。
Anthropic 删除 Claude Code 80% 系统提示影响模型表现
Anthropic 在 Opus 5 / Fable 5 模型中删除了 Claude Code 80% 以上的系统提示,发现新模型能更好地利用上下文与自我判断,表现更佳。Fable 5 依据此经验,将 indigo-mind 知识库 CLAUDE.md 从 10.2k 压缩到 6.5k,同时保留了部分重要内容。
SK Group and NVIDIA announce $500B+ AI initiative
SK Group与NVIDIA宣布超5000亿美元合作计划,包括在韩国建设2吉瓦的NVIDIA Vera Rubin DSX AI工厂,以及SK海力士与NVIDIA共同开发下一代AI内存(含HBM)。
GPT-5.6 Sol Ultra 破解量子密码学难题
GPT-5.6 Sol Ultra 通过 Codex 生成了构造方案和主要证明思路,协助人类专家解决了量子密码学领域一个存在六年的未解之谜。
Kimi K3 性能接近 Claude
Moonshot AI 的 Kimi K3 在 DeepSWE 基准上与 Anthropic 的 Claude Fable 5 性能接近,单次任务成本约为后者的三分之一,在多次尝试场景下实现超越。