Signal Brief

OpenAI 公布 GPT-5.6 Sol Ultra 证明 50 年数学猜想

OpenAI 宣布其 GPT-5.6 Sol Ultra 模型利用 64 个子代理,在不到一小时内证明了存在 50 年的 Cycle Double Cover 猜想,并公开了提示和证明内容。

twitter关注列表 OpenAI (@OpenAI) 发布 2026-07-10 收录 2026-07-10 值得跟进

一句话判断

这是首次有 AI 模型独立证明长期未解决的数学猜想,子代理协作方式和证明过程值得关注,建议阅读原文评估其可信度。

核心信息

OpenAI 宣布其 GPT-5.6 Sol Ultra 模型利用 64 个子代理,在不到一小时内证明了存在 50 年的 Cycle Double Cover 猜想,并公开了提示和证明内容。

原始内容

OpenAI (@OpenAI) 转发了 Ethan Knight (@__eknight__) 的帖子: Yesterday, we made GPT-5.6 Sol Ultra generally available. Today, we're sharing that it produced a proof of the 50-year-old Cycle Double Cover Conjecture using 64 subagents in just under one hour. We're sharing the prompt and proof below. We're excited to see what you all do with Ultra!

相关动态

02

Kimi K3 在 SpreadsheetBench 2 上排名第一

Kimi K3 在 SpreadsheetBench 2 基准测试中排名第一,超越 Claude Fable 5,完成 34.8% 的 workflow 任务。该基准测试涉及 321 个专家策划任务,平均每个任务包含 11.8 个工作表和 593.5 个单元格更改,聚焦于完整的电子表格工作簿执行。

twitter关注列表2026-07-18#模型#技术突破#评测
观察
03

Mind Lab 开源长文本强化学习项目

Mind Lab 开源了一个长文本强化学习(RL)项目,支持 2M tokens 的长上下文。相比以往需要数千个 GPU 的 1M 上下文研究,该项目仅需 8 个 GPU 即可完成,大幅降低了超长上下文研究的算力门槛。

twitter关注列表2026-07-17#开源#技术突破#模型
观察
04

Kimi K3非对称竞争分析

Kimi K3在Arena前端/WebDev人类盲测中以1679 Elo排名第一,领先Fable 5(1631)和GPT-5.6 Sol(1618),但在综合智能指数中仅排第四(57.1分),落后Fable 5(59.9)和GPT-5.6 Sol(58.9)。K3定价15美元/百万输出tokens,远低于Fable 5的50美元,并计划7...

twitter关注列表2026-07-18#AI#模型#技术突破
观察
05

二年级学生Jo Nagai发现蝴蝶可遗传记忆

日本东京都二年级学生Jo Nagai注意到养育的食蚜 caterpillars 在蝴蝶化后仍保持对薰衣草的回避行为,经Georgetown大学Entomologist Dr. Martha Weiss合作完成实验:70%训练过的蝴蝶及其后代均表现出对薰衣草的遗传性回避,记忆在全变态发育中保存并遗传。

twitter关注列表2026-07-18#研究#技术突破#信息
值得跟进