← 返回精选动态
精选动态

Anthropic 谈递归自改进

Anthropic 发表 Claude 递归自改进分析(2026 年 5 月)

更新于 2026年06月05日 02:36 2 条公开来源

发生了什么

Anthropic 发表 Claude 递归自改进分析(2026 年 5 月)

为什么值得关注

这篇把 Anthropic 内部生产力、任务时长、代码贡献率和研究效率的多组数据串成了一条递进曲线,适合关注模型能力外溢和自动化研发边界的人直接看原文。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

Anthropic 谈递归自改进

twitter关注列表 2026年06月05日 00:26

Anthropic 公开表示,内部数据显示 Claude 正在加速 AI 开发,可能走向递归自我改进,即由 AI 自主构建更强的后继模型,但他们强调这还未发生,也不是必然结果。文章给出多项量化进展:Anthropic 工程师平均每季度提交代码量较 2021-2025 年提升 8 倍;AI 可稳定完成的任务时长大约每 4 个月翻倍,较此前每 7 个月翻倍更快;Opus 3(2024 年 3 月)可处理约 4 分钟任务,Sonnet 3.7(一年后)约 90 分钟,Opus 4.6(再一年后)达到 12 小时。文中还称,Claude 在 Anthropic 代码库中贡献了截至 2026 年 5 月超过 80% 的合并代码,2026 年 3 月对 130 名研究人员的调查中位数预期是使用 Mythos Preview 后产出提升约 4 倍。

打开原始来源 ↗
02

Anthropic 递归自我改进讨论

twitter关注列表 2026年06月05日 01:44

引用帖概述了 Anthropic 一篇博客的要点:Anthropic 认为,能完全自主设计并构建其后继模型的 AI 已接近出现,但这并非已实现,也并非必然会发生。帖中给出多项进展数据:Anthropic 工程师平均每季度提交的代码量相比 2021–2025 年增长了 8 倍;AI 可可靠完成的任务时长大约每 4 个月翻倍,早先是每 7 个月翻倍。能力轨迹上,Opus 3(2024 年 3 月)约能处理 4 分钟任务,Sonnet 3.7(一年后)约 90 分钟,Opus 4.6(再过一年)达到 12 小时;SWE-bench 在两年内从低个位数到饱和,CORE-bench 在 15 个月内从约 20% 到饱和。另有数据称,截至 2026 年 5 月 Claude 参与了 Anthropic 代码库中 80% 以上的合并代码,2026 年 4 月 Claude 还完成了 800 多个修复,将一类 API 错误减少 1000 倍。

打开原始来源 ↗
← 返回精选动态