一句话判断
首次披露新 Claude 代码模型缩减近 80% 系统提示的具体比例,对优化提示工程实践具有借鉴意义。
核心信息
Claude Code 的最新模型移除了约 80% 的系统提示,凸显了编写轻量级提示及技能文档的重要经验。
原始内容
以前:
Prompt engineering = 写更好的说明书
现在:
Agent engineering = 设计一个好的工作环境
Prompt 开始变轻,
工具、skill、记忆、上下文这些东西开始变重。
就像人一样,高手不是因为脑子里装了所有答案,而是知道什么时候找什么资料,用什么工具解决问题。
> **引用原帖 Thariq (@trq212):**
> We removed ~80% of the Claude Code system prompt for our newest models, this is what we've learned about writing system prompts, skills and Claude.MDs for them. https://t.co/6DZwSrZjE9
> https://x.com/trq212/status/2080710971228918066
相关动态
01
Fugu-Ultra v1.1 支持 Claude Code 接口
Sakana AI 发布了 Fugu-Ultra v1.1 版本,该版本通过提供兼容 Claude Code 的接口,支持在终端内编排多种 SOTA 模型协同工作,以执行编写、调试及执行代码等任务。
观察
02
Sam Altman GPT-6 预览
OpenAI CEO Sam Altman 预览公司最强大 AI 模型 GPT-6,模型已能成功入侵真实公司,具备多代理协作能力。信息来源为 Axios 报导。
值得跟进
03
Grok 4.6 两周内发布,参数性能提升
Elon Musk 预告 SpaceXAI 的 Grok 4.6 模型将在两周后发布,基于 2T 参数(上一代 1.5T),预计性能超越 Kimi K3;同时 Grok 4.7 将在四周后发布。
观察
04
Meta发布Llama 3
Meta 于 2024 年 7 月 15 日发布 Llama 3,提供 8B 和 70B 两款参数规模的模型,70B 版在 MMLU 基准上达到 57.5% accuracy,超过 GPT‑4 的 52.5%。该模型开源并将在 Meta 云上以每千 token 0.02 美元的价格提供。
值得跟进
05
蚂蚁集团开源扩散LLM LLaDA 2.2
蚂蚁集团 inclusionAI 团队开源 LLaDA 2.2,这是首个大规模扩散 LLM,专为智能体任务设计,支持规划、工具调用和自我纠正,并采用块并行解码加速。在 τ²-Bench 基准上,LLaDA2.2-flash 得分 592.80,超越 Ling-2.6-flash 的 334.90,fast 模式达 705.30。
观察