发生了什么
DeepReinforce 发布 Ornith-1.0(397B MoE, 9B Dense 等)
为什么值得关注
Ornith-1.0 的自改进训练策略通过联合优化 scaffold 和解决方案,与现有方法形成差异,值得关注其实际效果。
信息来源
以下内容来自公开来源,可打开原文继续核验。
DeepReinforce 发布 Ornith-1.0 开源编码模型系列
DeepReinforce 发布了 Ornith-1.0 开源模型系列,专门用于 agentic coding,参数覆盖 9B Dense、31B Dense、35B MoE 和 397B MoE。397B MoE 旗舰在编码基准上匹配 Claude Opus 4.7,9B Dense 变体优化用于边缘设备。模型基于 gemma4 和 qwen3.5 后训练,采用自改进训练策略,通过强化学习联合优化任务 scaffold 和解决方案,并在 Terminal-Bench 2.1、SWE-Bench 等基准上取得 SOTA 性能。所有模型采用 MIT 许可发布。
打开原始来源 ↗