一句话判断
TimeLens2 以 4B/8B 参数超越 397B 模型,表明视频时间定位任务上小模型通过架构优化可达到更优性能。
核心信息
TimeLens2 是一个通用的视频时间定位多模态大语言模型(MLLM),拥有 4B 和 8B 参数变体,在 7 个基准测试中达到 SOTA,超越了 397B 参数模型。
原始内容
AK (@_akhaliq) 转发了 DailyPapers (@HuggingPapers) 的帖子:
TimeLens2
A generalist video temporal grounding MLLM that predicts when supporting evidence occurs in videos — achieving SOTA across 7 benchmarks with 4B and 8B variants, surpassing 397B-parameter models. https://t.co/pmMa1Ap1Ge

相关动态
01
AI 30年图论猜想被推翻
Dmitry Rybin 通过 GPT 5.6 Pro 发现 Dinitz-Garg-Goemans 猜想错误,该猜想开放约30年。具体反例图显示分式流成本58,不可分裂流(容量违反≤15)成本至少60。
观察
02
GPT 5.6 Pro打破30年数学猜想
Dmitry Rybin利用GPT 5.6 Pro发现Dinitz-Garg-Goemans图论猜想反例,该猜想已存在约30年。
观察
03
AI 推翻 30 年图论猜想
GPT 5.6 Pro 反驳了 Dinitz-Garg-Goemans 猜想(开放约 30 年),通过简单提示词(如“做个突破”)发现反例:分数流成本 58 时,不可分割流成本至少 60。
观察
04
AI发现Dinitz-Garg-Goemans猜想反例
GPT-5.6 Pro 发现了图论中开放约30年的 Dinitz-Garg-Goemans 猜想的一个反例,该反例显示存在分数流成本58且任何不可分流量成本至少60的图。
观察
05
百度开源 Unlimited-OCR 再登 HuggingFace 前三
百度开源的无限制OCR模型Unlimited-OCR(30亿参数,32K上下文)再次登上HuggingFace总榜第三,被Yann LeCun转发。该模型可一次性解析100页PDF,40页后错误率低于0.11,准确率93%,GitHub Star 1.65万,HuggingFace下载量224万。技术核心是R-SWA机制,能保持恒定KV ...
观察