← 返回精选动态
精选动态

四款AI模型IMO 2026获满分42/42

多个AI模型 评测 IMO 2026(满分42/42)

更新于 2026年07月21日 23:37 1 条公开来源

发生了什么

多个AI模型 评测 IMO 2026(满分42/42)

为什么值得关注

新增了多个前沿模型在IMO上的具体表现对比,包括Fable速度、Sol成本、Axiom的Lean证明能力,值得关注原文的详细数据和推理过程。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

四款AI模型IMO 2026获满分42/42

twitter关注列表 2026年07月21日 11:33

Claude Fable 5、GPT 5.6 Sol、Kimi K3和Axiom Math四款AI模型在IMO 2026中获得满分42/42。Fable 5用1次尝试最快,Sol用1次尝试最便宜,K3用4次尝试消耗大量token,Axiom Math在Lean中证明了所有题目。学生需9小时完成6题,Fable和Sol用时不到4小时。

打开原始来源 ↗
← 返回精选动态