← 返回精选动态
精选动态

多个模型IMO 2026满分

Berryxia.AI 评测 IMO 2026 模型性能(满分42分)

更新于 2026年07月21日 23:37 1 条公开来源

发生了什么

Berryxia.AI 评测 IMO 2026 模型性能(满分42分)

为什么值得关注

值得关注这些模型在数学推理上的突破,建议进一步查看独立评测或官方结果验证。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

多个模型IMO 2026满分

twitter关注列表 2026年07月21日 23:06

Berryxia.AI博主测试了GPT-SOL-5.6-High、Qwen3.8-Max-Preview、KIMI K3和Claude-Fable-5在IMO 2026大赛中的表现,前三个模型均获得满分42分(6道题),耗时分别为14分58秒、45分钟、1小时32分6秒,而Claude-Fable-5未完成任务。去年只有Gemini Deep Think和OpenAI模型获得35分,今年多个主流模型稳定满分。

打开原始来源 ↗
← 返回精选动态