Signal Feed

#研究突破 主题信号第 12 页

围绕 研究突破 的精选动态、来源摘要和重要性判断。

动态列表

02

本期《Superintelligence》汇集了2026年5月至4月的AI领域重大动

本期《Superintelligence》汇集了2026年5月至4月的AI领域重大动态,包括OpenAI 持续工作流的编码代理、DeepSeek V4 对NVIDIA 硬件的挑战、Anthropic 企业部署模式、AI 基础设施竞争(Google TPU、OpenAI 脱离 Microsoft)以及全球 AI 政策风险,覆盖模型发布、产业...

twitter关注列表2026年05月18日 01:03#AI模型#研究突破#行业动态
值得跟进
03

Gregor Zunic展示了一款名为'goal'的AI智能体

Gregor Zunic展示了一款名为'goal'的AI智能体,通过单一提示指令驱动构建GTA 6游戏,显示出每轮次自动实现新功能的能力,揭示了AI代理在软件开发中的高效Autonomous潜力

twitter关注列表2026年05月18日 00:06#智能体#开发者工具#研究突破
值得跟进
04

Google DeepMind 发布研究

Google DeepMind 发布研究,揭示 AI 智能体安全的新视角:将模型本身之外的网络环境作为主要攻击面,提出覆盖感知、推理、记忆等六大类的 AI 智能体陷阱框架,展示隐藏提示注入、代理劫持等攻击可达 86% 成功率,指出网页隐性内容(如隐藏 HTML 注释)可能成为风险源。

twitter关注列表2026年05月17日 16:15#AI安全#智能体#研究突破
值得跟进
05

伊利诺伊大学+清华大学等实验室的研究发现

伊利诺伊大学+清华大学等实验室的研究发现,LLM agents 在持续重写记忆时变得不可靠,导致性能显著下降,建议保持原始证据而非自动总结。

twitter关注列表2026年05月17日 15:51#智能体#记忆管理#研究突破
值得跟进
06

DAIR.AI 发布了 Theodore J Kalaitzidis 的新论文《Th

DAIR.AI 发布了 Theodore J Kalaitzidis 的新论文《The Evaluation Trap》,揭示了 AI 基准测试可能无法测量声称的能力,并引入了 Epistematics 方法论来改进评估。

twitter关注列表2026年05月17日 04:30#AI评估#基准测试#研究突破
值得跟进
07

Duke大学Fred Peng等人提出了一种名为REPR-ALIGN的新方法

Duke大学Fred Peng等人提出了一种名为REPR-ALIGN的新方法,通过在扩散语言模型训练过程中对齐隐藏状态到冻结的自回归教师模型,从而大幅提升训练效率,训练速度最高可提升4倍。

twitter关注列表2026年05月16日 22:37#模型训练#生成式AI#研究突破
值得跟进
08

Mythos(与Anthropic的Glasswing团队相关)在五天内成功破解ma

Mythos(与Anthropic的Glasswing团队相关)在五天内成功破解macOS,发现内核内存破坏漏洞,获XBOW和UK AISI等机构确认,标志着AI安全研究在苹果系统方面的重要突破。

twitter关注列表2026年05月15日 01:20#AI安全#macOS漏洞#研究突破
观察
10

英国国家AI安全研究所发现

英国国家AI安全研究所发现,Mythos和GPT-5.5在网络能力方面有重大提升,能力翻倍时间为4.5个月。

twitter关注列表2026年05月14日 00:11#AI安全#模型能力#研究突破
值得跟进
11

SenseNova-U1通过NEO-unify架构统一了多模态理解与生成

SenseNova-U1通过NEO-unify架构统一了多模态理解与生成,整合了视觉和语言任务,提升了模型的综合能力。该论文由多位作者于2026年5月12日发布,是当日最受欢迎的论文之一。

twitter关注列表2026年05月13日 20:26#多模态模型#研究突破#人工智能
观察
12

研究人员提出'Positive Alignment'概念

研究人员提出'Positive Alignment'概念,旨在开发AI系统积极支持人类繁荣,处理价值权衡并增强韧性。

twitter关注列表2026年05月12日 23:24#AI对齐#研究突破#人类繁荣
值得跟进
13

AK@_akhaliq在X平台分享论文《TMAS: Scaling Test-Tim

AK@_akhaliq在X平台分享论文《TMAS: Scaling Test-Time Compute via Multi-Agent Synergy》,提出通过多智能体协同提升推理计算能力。

twitter关注列表2026年05月12日 21:24#智能体#模型优化#研究突破
值得跟进
14

研究发现长期运行的Agent常因过早停止而失败

研究发现长期运行的Agent常因过早停止而失败,并在8项长时任务中测试了5种Harness,提出的Zenith在5/8任务上以43%成本击败最强基线。

twitter关注列表2026年05月08日 22:57#Agent调度#长时任务#研究突破
值得跟进
15

Anthropic研究员发布了Model Spec Midtraining (MSM

Anthropic研究员发布了Model Spec Midtraining (MSM)研究,通过教导AI泛化的方式解决对齐中的泛化问题。

twitter关注列表2026年05月06日 04:18#AI对齐#研究突破#泛化技术
值得跟进
16

The baseline embeds queries and documents

文章揭示了嵌入方法优化的突破性进展,通过测试时间计算实现500倍嵌入效率提升,并验证了计算量扩展的收益递减规律,揭示了多LoRA信号的门控机制特性

twitter关注列表2026年05月01日 10:15#AI技术#嵌入方法#研究突破
值得跟进
17

In new Anthropic Fellows research, we disc

Anthropic Fellows 发布关于“内省适配器”的研究,提出让语言模型在训练后自报所学行为与潜在对齐风险的方法。该工作为模型可解释性与对齐验证提供了面向开发者的技术路径。

twitter关注列表2026年04月30日 03:46#模型可解释性#对齐安全#研究突破
值得跟进