一句话判断
不同于标准LLM通过增加随机性进行测试时扩展,该方法利用模型切换创造多样性,无需额外训练,为扩散语言模型提供了新的集成策略。
核心信息
研究团队在ICML2026论文中提出UnMaskFork方法,通过模型切换让多个蒙版扩散语言模型协作解答,无需额外训练即可提升编程和数学任务性能。
原始内容
相关动态
Gemini 3.6 Flash发布,具备AI代理能力,Gemini 3.5 Flash-Lite支持agentic工作流
Google推出Gemini 3.6 Flash及Gemini 3.5 Flash-Lite两模型,分别针对效率与成本效益,Gemini 3.6 Flash在编码、知识工作和多模态任务中提升效率,Gemini 3.5 Flash-Lite支持agentic工作流,输出速度可达~350token/sec
Gemini 3.6 Flash 主打更高 token 效率
Google DeepMind 推出 Gemini 3.6 Flash 模型,称其在相同成本下使用更少的 token 即可提供更高质量输出。同时发布 3.5 Flash-Lite 用于日常任务和 3.5 Flash Cyber 用于网络安全。
Artificial Analysis 评测 Gemini 3.6 Flash 和 3.5 Flash-Lite
Artificial Analysis 发布了对 Google Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 的基准测试结果。Gemini 3.6 Flash 智能指数保持 50 未变,但时间减半至 1.3 分钟,成本下降 18% 至 $0.50;Gemini 3.5 Flash-Lite 智能指数提升...
MIT researchers propose faster diffusion model sampling algorithm
MIT CSAIL 研究人员提出一种新算法,用于从扩散模型中采样,能在指数级更少的步骤中达到相同精度,该论文获得 ICML 杰出论文奖。
Octen 专为 AI agent 优化的搜索 API
Octen 发布了专为 AI agent 设计的搜索 API 栈,包括索引、排名和服务层,实现每次搜索 62ms,每 1000 次调用 1 美元,不同于传统搜索 API 的人类查询模式。