发生了什么
研究人员发布了一项通过统一缩放方案实现奥林匹克级别推理能力的 30B 模型研究成果。
为什么值得关注
该研究展示了通过测试时缩放和强化学习提升模型在极高难度科学推理任务上的突破性进展。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
研究人员发布了一款 30B 参数规模的推理模型
研究人员发布了一款 30B 参数规模的推理模型,通过统一的缩放方案,在物理和数学奥林匹克竞赛(IPhO、IMO/USAMO)中达到了金牌水平。
打开原始来源 ↗