Signal Brief

TimeLens2 发布

TimeLens2 是一个通用的视频时间定位多模态大语言模型(MLLM),拥有 4B 和 8B 参数变体,在 7 个基准测试中达到 SOTA,超越了 397B 参数模型。

twitter关注列表 AK (@_akhaliq) 发布 2026-07-21 收录 2026-07-21 观察

一句话判断

TimeLens2 以 4B/8B 参数超越 397B 模型,表明视频时间定位任务上小模型通过架构优化可达到更优性能。

核心信息

TimeLens2 是一个通用的视频时间定位多模态大语言模型(MLLM),拥有 4B 和 8B 参数变体,在 7 个基准测试中达到 SOTA,超越了 397B 参数模型。

原始内容

AK (@_akhaliq) 转发了 DailyPapers (@HuggingPapers) 的帖子: TimeLens2 A generalist video temporal grounding MLLM that predicts when supporting evidence occurs in videos — achieving SOTA across 7 benchmarks with 4B and 8B variants, surpassing 397B-parameter models. https://t.co/pmMa1Ap1Ge ![photo](https://pbs.twimg.com/media/HNwHzHZaEAAzcNO.jpg)

相关动态

01

AI 30年图论猜想被推翻

Dmitry Rybin 通过 GPT 5.6 Pro 发现 Dinitz-Garg-Goemans 猜想错误,该猜想开放约30年。具体反例图显示分式流成本58,不可分裂流(容量违反≤15)成本至少60。

twitter关注列表2026-07-22#AI#技术突破#研究
观察
03

AI 推翻 30 年图论猜想

GPT 5.6 Pro 反驳了 Dinitz-Garg-Goemans 猜想(开放约 30 年),通过简单提示词(如“做个突破”)发现反例:分数流成本 58 时,不可分割流成本至少 60。

twitter关注列表2026-07-22#技术突破#AI模型#研究
观察
05

百度开源 Unlimited-OCR 再登 HuggingFace 前三

百度开源的无限制OCR模型Unlimited-OCR(30亿参数,32K上下文)再次登上HuggingFace总榜第三,被Yann LeCun转发。该模型可一次性解析100页PDF,40页后错误率低于0.11,准确率93%,GitHub Star 1.65万,HuggingFace下载量224万。技术核心是R-SWA机制,能保持恒定KV ...

twitter关注列表2026-07-22#模型发布#开源#技术突破
观察