发生了什么
Cursor 发布 Composer 2.5,并披露其在基准、成本和 RL 后训练方法上的具体改进。
为什么值得关注
对做 coding agent、模型后训练和推理成本优化的从业者很有参考价值,可直接观察到垂直产品如何通过 RL 与合成数据把性能/成本曲线做穿。
信息来源
以下内容来自公开来源,可打开原文继续核验。
Cursor 发布 Composer 2.5
Cursor 发布 Composer 2.5,宣称这是其最强模型,擅长长时任务与复杂指令跟随,并在 CursorBench 3.1 上取得 63.2%,单任务成本接近 0 美元,Terminal-Bench 也追平 Opus 4.7。文章还指出其核心不是底座参数,而是把大量算力投入 RL、合成数据和 textual feedback RL,显示 agentic coding 正在从“拼底座”转向“拼训练后处理与行为校准”。
打开原始来源 ↗Cursor 发布了 Composer 2.5
Cursor 发布了 Composer 2.5,称其相较 Composer 2 在智能、长任务持续性、复杂指令遵循和协作体验上都有明显提升,并披露了训练方法包括更大规模训练、复杂 RL 环境、定向文本反馈与大规模合成任务。文章还给出了价格、fast 变体与训练基础模型信息,对代码智能体和开发者工具赛道具有直接参考价值。
打开原始来源 ↗