Signal Brief

Grok 4.5 反驳30年图论猜想

Grok 4.5 通过 Capy 在 8 分钟内反驳了开放约 30 年的 Graffiti Conjecture 284,该猜想此前未被解决。

twitter关注列表 Elon Musk (@elonmusk) 发布 2026-07-23 收录 2026-07-23 观察

一句话判断

展示了 Grok 4.5 在数学推理上的具体能力,值得验证其复现性和方法论。

核心信息

Grok 4.5 通过 Capy 在 8 分钟内反驳了开放约 30 年的 Graffiti Conjecture 284,该猜想此前未被解决。

原始内容

Grok 4.5 just solved a graph theory conjecture that has been open for ~30 years > **引用原帖 justin (@justinsunyt):** > Capy accidentally cracked a graph theory conjecture entirely in Slack > REFUTED: Graffiti Conjecture 284 (open for ~30 years) > We shared the original post in Slack and Capy (running on Grok 4.5 Medium!!!) decided it wanted to take a shot, finding a novel refutation in 8 minutes https://t.co/jeqvUKrslr > https://x.com/justinsunyt/status/2080116559352316409

相关动态

02

RedNote AI 模型获 IMO 满分 42/42

RedNote(小红书母公司)旗下 AI 模型 dots-note-3.0 在国际数学奥林匹克竞赛(IMO)中获得 42/42 满分,成为首个达成此成就的 AI 系统。该模型直接阅读原始竞赛文档,通过结合自然语言推理与 Python 代码执行的代理循环,经草稿测试、破坏、修复及自我审查后提交答案,全程无人工改写或提示。对比之下,Googl...

twitter关注列表2026-07-23#AI#技术突破#大模型
值得跟进
03

RedNote AI模型IMO满分42分

RedNote(小红书)的AI模型dots-note-3.0在国际数学奥林匹克竞赛中获得满分42分,而Google DeepMind和OpenAI去年仅得35分。该模型直接阅读原题,使用自然语言推理与自执行Python代码的智能体循环,并具备自我审查机制,最终在禁止外部帮助的条件下取得满分。模型为dots3系列最小版本,承诺未来开源。

twitter关注列表2026-07-23#技术突破#大模型#AI模型
观察
05

PaddlePaddle开源HPD-Parsing文档解析器

PaddlePaddle在ModelScope上开源发布1B参数文档解析器HPD-Parsing(Apache 2.0),采用层级并行解码替代逐页序列生成,在OmniDocBench v1.6上得分94.91%报告为端到端统一解析器SOTA,吞吐达4752 TPS,较最快对比解析器高1.62倍、较自回归基线高3.06倍,长文档延迟降低5....

twitter关注列表2026-07-23#开源#模型发布#技术突破
观察