一句话判断
展示了通过测试时缩放技术将判别式嵌入模型转化为生成式任务的新方法。
核心信息
Han Xiao 通过将冻结的 jina-v5-omni 多模态嵌入模型进行测试时缩放(scaled at test time),在无需训练、无需第二模型及外部知识的硬约束下,实现了强大的开放词汇多标签 n-gram 图像打标器。
原始内容
相关动态
Yann LeCun 转发介绍 Patch Policy 架构
Gaoyue Zhou 团队提出 Patch Policy 架构,允许基于 transformer 的策略直接使用密集视觉 token,无需大语言模型,在操纵任务中比微调 7B VLA 性能高 18%,参数量仅为其 0.7%。
Artificial Analysis 评测 Thinking Machines Lab 的 Inkling 模型
Artificial Analysis 评测 Thinking Machines Lab 的 Inkling 模型在 AA-Briefcase 基准上获得 Elo 836,Rubric 得分 19.3%,低于 MiMo-V2.5-Pro(21.4%)但高于 DeepSeek V4 Flash max(18.7%)和 Gemini 3.5 ...
微软公布AI在科学发现的投入
微软与美国能源部通过#GenesisMission深化合作,投资AI基础设施、科学计算、工程专长及合作枢纽,帮助全国实验室、大学和产业合作。目标是加速AI驱动的科学发现,覆盖能源、医药和先进材料,以增强美国竞争力并创造长期价值。
Alphabet Q2 AI业绩增长
Alphabet公布Q2业绩:收入同比增长24%,Google Cloud增长82%,Gemini app月活达9.5亿,模型API处理量22B tokens/min(上季度16B+),Gemini Enterprise被90%财富100强采用。
AI 30年图论猜想被推翻
Dmitry Rybin 通过 GPT 5.6 Pro 发现 Dinitz-Garg-Goemans 猜想错误,该猜想开放约30年。具体反例图显示分式流成本58,不可分裂流(容量违反≤15)成本至少60。