一句话判断
该模型通过自行循环结合自然语言推理与自行执行的 Python 代码实现满分,且为 dots3 系列中最小的变体
核心信息
RedNote 的 dots‑note‑3.0 AI 模型在国际数学奥林匹克赛中得满分 42/42,超越去年 DeepMind 和 OpenAI 的 35/42,且仅有 7 名 666 名人类选手匹配。该模型仍在 beta,为 dots3 系列中最小的变体,公司承诺日后开源。
原始内容
相关动态
GPT-5.6 Sol解决6个Erdős问题
一位研究员使用GPT-5.6 Sol在5天内解决了6个开放Erdős问题(尝试13个,成功率46%)。他采用合同式提示,明确证明要求、排除弱结果,并指定搜索策略,包括同时探索多种路径和对抗性检查。
Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning
研究人员发现,即使在强推理模型中,长上下文下模型会无差别复制输入文本的惰性,导致准确率下降。他们提出一种基于证据感知的强化学习奖励机制,通过惩罚复制无关内容、奖励关注关键文本,将准确率提升最多4.6个百分点。
Vera Rubin NVL72 vs GB200 NVL72? Inference TCO & Architecture Analysis
Semianalysis 对 NVIDIA 的 Vera Rubin NVL72 和 GB200 NVL72 进行了推理总拥有成本和架构对比分析,涉及 Rubin LUT Based Tensor Core、Feynman 设计、机架规模性能、每兆瓦性能、每美元性能以及 PyTorch、vLLM、OpenAI Triton 等软件改进。
Cursor推出智能模型路由Router
Cursor 团队推出 Cursor Router,基于 60 万+ 线上请求训练的分类器,根据查询内容、上下文、任务复杂度、领域自动选择模型,在保持用户满意度的同时将成本降低 30-60%。Intelligence 模式用户满意度接近 Fable,成本低约 60%;Balance 模式满意度高于 Opus 4.8,成本低约 36%。单次...
AIHOT月活60万
AIHOT月活突破60万,站点完成UI升级,交互更流畅。后端实现数百信源5分钟抓取、数据清洗、结构化、预筛选、聚类展示,至少10个大模型环节,累计数百轮数据回测与标注。创始人表示永久免费,未来将持续开发新功能。