发生了什么
多个AI模型 评测 IMO 2026(满分42/42)
为什么值得关注
新增了多个前沿模型在IMO上的具体表现对比,包括Fable速度、Sol成本、Axiom的Lean证明能力,值得关注原文的详细数据和推理过程。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
四款AI模型IMO 2026获满分42/42
Claude Fable 5、GPT 5.6 Sol、Kimi K3和Axiom Math四款AI模型在IMO 2026中获得满分42/42。Fable 5用1次尝试最快,Sol用1次尝试最便宜,K3用4次尝试消耗大量token,Axiom Math在Lean中证明了所有题目。学生需9小时完成6题,Fable和Sol用时不到4小时。
打开原始来源 ↗