发生了什么
Berryxia.AI 评测 IMO 2026 模型性能(满分42分)
为什么值得关注
值得关注这些模型在数学推理上的突破,建议进一步查看独立评测或官方结果验证。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
多个模型IMO 2026满分
Berryxia.AI博主测试了GPT-SOL-5.6-High、Qwen3.8-Max-Preview、KIMI K3和Claude-Fable-5在IMO 2026大赛中的表现,前三个模型均获得满分42分(6道题),耗时分别为14分58秒、45分钟、1小时32分6秒,而Claude-Fable-5未完成任务。去年只有Gemini Deep Think和OpenAI模型获得35分,今年多个主流模型稳定满分。
打开原始来源 ↗