Signal Feed

#研究突破 主题信号第 5 页

围绕 研究突破 的精选动态、来源摘要和重要性判断。

动态列表

01

Full Attention Strikes Back: Transferring

Alibaba 和 Nanjing Univ 的论文提出 RTPurbo,称可在仅进行轻量适配的情况下,将百万 token prefill 速度相对 FlashAttention-2 提升最高 9.36 倍,并将 decoding 速度提升约 2 倍。论文认为标准 full-attention LLM 已包含隐藏的稀疏结构,因此无需从头重...

twitter关注列表2026年05月25日 03:53#研究突破#基础设施#基准测试
观察
02

Post-Trained MoE Can Skip Half Experts via

一篇题为《Post-Trained MoE Can Skip Half Experts via Self-Distillation》的论文提出 Zero-Expert Self-Distillation Adaptation(ZEDA),用低成本方法把已后训练的静态 MoE 模型改造成动态 MoE。作者在 Qwen3-30B-A3B 和 ...

twitter关注列表2026年05月25日 02:43#研究突破#大模型#技术突破
值得跟进
03

AI 解出 9 个开放数学题

原帖称,AI 已经解决了 9 个开放数学问题,其中一些题目已有 50 年历史,并且证明了 OEIS 的 492 个开放猜想中的 44 个。引用的转帖补充称,这是 DeepMind 团队完成的 9 个 Erdős 问题求解,流程是由 LLM 与 Lean agents 自主工作,只有在形式化验证通过后才进入人工审查。

twitter关注列表2026年05月25日 02:06#研究突破#大模型#智能体
值得跟进
04

FTL1 与衰老记忆恢复

UCSF 研究人员筛查了老年海马体中所有发生变化的蛋白,发现 FTL1 是最显著的候选蛋白,它是医生在常规血检中就会测到的 ferritin 亚基。研究在老年小鼠中移除 FTL1 后,突触重新生长、记忆恢复;反向实验中,在年轻小鼠中提高 FTL1 会让它们表现出衰老。论文发表在 Nature Aging,机制是过量 ferritin 使铁...

twitter关注列表2026年05月24日 06:52#研究突破#基础设施#行业动态
观察
05

Scaling Test-Time Compute for Agentic Codi

Meta 的论文提出,编程智能体在测试时扩展能力时,不应主要依赖更多尝试,而应把每次尝试压缩为可复用的短摘要,再用这些摘要来筛选候选和指导新一轮尝试。论文将完整尝试中的文件读取、shell 命令、错误、部分修复和放弃思路总结为主要假设、部分进展与失败点,并用 tournament 风格的选择方法在小组内比较摘要。作者在 2 个困难编程基准...

twitter关注列表2026年05月23日 22:29#研究突破#智能体#基准测试
观察
06

Natural-Language Agent Harnesses

该论文提出,Agent 的表现不仅取决于 prompt,还更依赖围绕模型的 harness。作者指出,很多 AI agent 的实际行为来自外部控制代码:规划、工具调用、记忆、重试、检查与停止条件等;在长任务中,状态丢失、验证漂移、工具返回部分证据、以及忘记中间产物等问题会导致失败。论文引入 Natural-Language Agent ...

twitter关注列表2026年05月23日 21:26#智能体#研究突破#开发者工具
观察
07

AI Detectors Fail Diverse Student Populati

作者基于 arXiv 论文《AI Detectors Fail Diverse Student Populations: A Mathematical Framing of Structural Detection Limits》指出,AI 检测器在学生写作场景中存在结构性限制:它并不是在比较“AI 文本”与固定的“人类文本”,而是在拿一...

twitter关注列表2026年05月23日 20:20#研究突破#AI安全#行业动态
观察
08

BestBlogs 早报 05-23

这期早报汇总了 10 条 AI 相关内容,重点包括 LangChain 在 Interrupt 2027 中提出 Agent 生产形态分化为长时程知识 Agent 与亚秒延迟客户体验 Agent,并发布 Langsmith Fleet,宣称内测后商机合格率提升 240%、每位 AE 每月节省 40 小时。Notion CEO Ivan Z...

twitter关注列表2026年05月23日 09:12#行业动态#产品更新#研究突破
观察
09

Advancing Mathematics Research with AI-Dri

Google DeepMind 发表论文《Advancing Mathematics Research with AI-Driven Formal Proof Search》,提出 AlphaProof Nexus:让 LLM 在 Lean 形式化证明环境中反复编辑证明、读取编译错误并继续搜索,部分子问题还可调用更强的证明工具。论文在 3...

twitter关注列表2026年05月23日 06:37#研究突破#大模型#开源
值得跟进
10

Measuring LLMs' Ability to Develop Exploits

Anthropic 的 Newton Cheng、Keane Lucas、Winnie Xiao、Nicholas Carlini 和 Milad Nasr 评测 Claude Mythos Preview 在漏洞利用开发上的能力,并将其与新基准 ExploitBench、ExploitGym 以及更新版 SCONE-bench 上的其他...

Anthropic-red2026年05月22日 08:00#研究突破#AI安全#基准测试
观察
11

Replication Radar

Marc Andreessen 转发 Greg Lukianoff 的帖子,介绍由 Harvard 的 Rhea Karty 开发、并由 @cosmos_inst 和 @TheFIREorg 支持的 Replication Radar。该项目提出用 AI 抓取论文、书籍、主张、引用、重复验证、撤稿、旧争论和失败结果,检测某个领域是否建立在...

twitter关注列表2026年05月20日 21:23#研究突破#基础设施#行业动态
观察
12

RAEv2

谢赛宁团队、Adobe Research 和 ANU 发布了 RAEv2,面向视觉重建、扩散模型、原生多模态、语义对齐、图像生成和世界模型。RAEv2 在原始 RAE 基础上提出 3 个发现:一是潜在表征不只取 pretrained vision encoder 最后一层,而是将最后 K 层特征相加,原始 RAE 对应 K=1;该改动不增...

twitter关注列表2026年05月21日 21:39#研究突破#多模态#技术突破
观察
13

OpenAI 平面单位距离问题突破

OpenAI 在 1946 年由 Paul Erdős 提出的平面单位距离问题上取得突破,称其模型自主发现了一类全新的构造。OpenAI 表示,数学界近 80 年来普遍认为最优解大致应接近方格结构,但该模型找到了优于这一直觉的新构造,推翻了这一判断。OpenAI 还称,这是 AI 首次自主解决一个数学领域中具有代表性的公开难题。

twitter关注列表2026年05月22日 06:42#研究突破#行业动态#大模型
值得跟进
14

子词分词收益分解研究

Nous Research 发布了一项研究,在 1.7B 参数的 byte-level 预训练管线中,逐一模拟 7 个关于“为什么 subword LLM 优于 byte-level LLM”的假设,涵盖计算效率、子词边界与位置的结构先验,以及优化目标。研究在 fineweb-edu 上、基于 LLaMA-3 架构完成验证,其中有 68M...

twitter关注列表2026年05月22日 07:54#研究突破#大模型#基础设施
观察
15

HBM 成为 AI 芯片最大成本

Epoch AI 指出,前沿 AI 芯片中内存是最大且增长最快的组件成本。其数据显示,高带宽内存(HBM)在 AI 芯片组件总支出中的占比从 2024 年第一季度的 52% 上升到 2025 年第四季度的 63%;按 Nvidia、AMD、Google 和 Amazon 设计的芯片统计,HBM 支出也从 2024 年约 120 亿美元增长...

twitter关注列表2026年05月22日 02:38#基础设施#行业动态#研究突破
观察
16

Crys-JEPA

Xavier Bresson 转发并介绍了与 liun_online、Kostya Novoselov、Yann LeCun 团队合作提出的 Crys-JEPA,一种用于材料设计的生成式技术。该方法通过 JEPA 构建高质量、感知能量的潜在空间,在 MP20 上取得了 47.9% 的 VSUN。原文附有 arXiv 论文链接,编号为 26...

twitter关注列表2026年05月19日 08:34#研究突破#模型发布#行业动态
观察
17

OpenAI 模型证明数学猜想

OpenAI 的通用推理模型在增加 test-time compute 后,找到了一个将 algebraic number theory 与平面几何连接起来的证明思路,并据称推翻了一个 1946 年提出的 Erdős 猜想。原文称该模型发现了一族无限构造,带来多项式级改进,且证明已由外部数学家核验;同时强调它不是为该问题专门训练的 the...

twitter关注列表2026年05月21日 20:50#研究突破#大模型#技术突破
值得跟进
18

OpenAI 数学突破

Alex Dimakis 转述 OpenAI 在 Erdős 1946 提出的 Planar Unit Distance problem 上取得突破。该问题要求在平面上放置 n 个点,使距离恰好为 1 的点对数量最大;已知构造长期只能做到近似线性增长,而此次结果被描述为可达到超线性增长 n^{1+delta},并且 Will Sawin ...

twitter关注列表2026年05月21日 15:38#研究突破#行业动态#大模型
值得跟进
19

GRAM 论文

某团队提出 GRAM(Generative Recursive Reasoning),一种带随机性的递归推理模型,声称首次通过在每个 refinement step 注入学习到的随机性,让模型能够并行探索多条 reasoning paths,而不是沿单一确定性轨迹推理。该模型参数量为 10 million,在 hard Sudoku 上准...

twitter关注列表2026年05月21日 15:14#研究突破#大模型#基准测试
观察
20

Cyber Toolkits for LLMs

Anthropic 与 Carnegie Mellon University 的 CyLab 合作开展研究,开发了名为 Incalmo 的 cyber toolkit,用于把 LLM 对攻击步骤的“思路”转换为具体电脑命令。研究显示,未针对 cybersecurity 微调的 LLM 在配合该工具后,能够对包含 25-50 台主机的网络执...

Anthropic-red2025年06月13日 08:00#AI安全#研究突破#开发者工具
值得跟进