Signal Brief

dots-note-3.0获IMO满分金牌

小红书dots团队的大模型dots-note-3.0在第67届IMO中获得42分满分,超过金牌线13分,成为全球首个在IMO官方评卷中斩获满分的大模型,也是中国首个IMO金牌大模型。此前Gemini Deep Think曾获35分。该模型采用智能体化推理系统和加强归纳法,并计划近期开源。

twitter关注列表 小互 (@xiaohu) 发布 2026-07-22 收录 2026-07-22 值得跟进

一句话判断

该模型在IMO中首次以满分超越人类金牌线,其加强归纳法提供了新推理思路,值得关注开源版本。

核心信息

小红书dots团队的大模型dots-note-3.0在第67届IMO中获得42分满分,超过金牌线13分,成为全球首个在IMO官方评卷中斩获满分的大模型,也是中国首个IMO金牌大模型。此前Gemini Deep Think曾获35分。该模型采用智能体化推理系统和加强归纳法,并计划近期开源。

原始内容

有点牛P啊 中国模型继承了中国学生的数学能力😅 第67届国际数学奥林匹克竞赛(IMO)公布官方评卷结果 小红书大模型 dots-note-3.0 以 42 分满分的成绩获得“满分金牌”认证,超过本届金牌线 13 分。 成为 - 中国首个在 IMO 中斩获金牌的大模型。 - 全球首个在 IMO 官方评卷中斩获满分的大模型 在此之前,仅有 Gemini Deep Think 在 2025 年 IMO 中取得过官方认可的金牌表现(得分 35 分,完成 6 题中的 5 题) 本届 IMO 于 7 月 15 日至 16 日在上海举行 模型参赛方在学生考完后获取题目并在规定时间内提交,全程严禁任何形式的人工干预(包括提示思路、修正答案、调整逻辑或筛选结果等) dots-note-3.0 基于智能体化(Agentic)推理系统独立完成全部证明。而且采用了一种叫加强归纳法完成证明,提供了全新的思路... 两位 IMO 金牌得主评价该解法“很有新意,也很优雅”。 除顶尖的逻辑推理能力外,该模型在多模态领域亦有优秀表现。 据称:dots3 模型将于近期对外开源。 ![photo](https://pbs.twimg.com/media/HN0YpNFawAAHO_y.jpg) > **引用原帖 Chao Qiao (@ChaoQiao42):** > 1/6 42 has been in my handle for years - picked it on a whim. Never thought the dots model would one day achieve exactly that: 42/42 at IMO 2026. > Officially certified full marks. Gold-medal level. Perfecto! Still feels surreal. > A few thoughts on why this matters - and curious what others think. > https://t.co/5cMx8n8yGN > https://x.com/ChaoQiao42/status/2079583425112277158

相关动态

01

AutoLab: Can Frontier Models Solve Long-Horizon Auto Research and Engineering Tasks?

研究人员提出了 AutoLab 基准测试,包含 36 项涉及系统加速、谜题、模型开发及 CUDA kernel 工作的任务,旨在评估模型在长时程自动研究中的表现。通过对 17 个主流模型的测试发现,成功的关键不在于初始想法的质量,而在于模型的持续测试与反馈迭代能力;其中 Claude Opus 4.6 在该基准测试中表现最佳,原因在于其能...

twitter关注列表2026-07-22#技术#模型#研究
观察
02

Kimi K3 30分钟构建VR伴侣

Kimi团队展示Kimi K3模型在收到一个3D模型和一条提示后,于30分钟内自主构建了一个VR伴侣,该伴侣能够听、回应、改变表情并在场景间移动,期间K3独立发现并部署了本地ASR和TTS连接LLM,并构建了VR场景。

twitter关注列表2026-07-22#AI#模型#多模态
观察
03

Tencent Hy3 Agent Arena排名#25

Arena.ai评测显示,腾讯Hy3模型在Agent Arena中排名第25位(开放权重模型第5位),在Frontend Code Arena中排名第16位(开放模型第2位)。Hy3在工具使用(bash错误恢复,+2.6%)方面表现强劲,但在可操纵性(用户推回时调整能力)方面较弱,得分为-7.1%。

twitter关注列表2026-07-22#模型#评测#技术
观察
04

百度开源Unlimited-OCR模型

百度开源 Unlimited-OCR 模型,30亿参数但推理时仅5亿激活,支持一次性处理40页文档,32K上下文窗口,准确率93%(比基线高6%),错误率低于0.11,输出结构化Markdown,免费本地运行,对比亚马逊Textract等商用方案每页收费。

twitter关注列表2026-07-20#模型发布#开源#技术突破
观察
05

Unlimited OCR 再登 HuggingFace 全球趋势 ilmu第三

百度发布的 Unlimited OCR 开源 OCR 模型,被图灵奖获得者杨立昆转发后再次登上 HuggingFace 全球模型趋势榜,现位列第三,超越 GLM‑upiter‑5.2;GitHub Star 已突破 1.65 万,下载量 224 万。模型参数约 30 亿,能够一次性解析 100 页 PDF,40 页后错误率低于 0.11,...

twitter关注列表2026-07-22#开源宣发#技术突破#行业动态
值得跟进