一句话判断
该算法相比现有扩散模型采样方法,在保持精度前提下大幅减少步骤,且获得顶级会议认可,值得关注具体方法细节。
核心信息
MIT CSAIL 研究人员提出一种新算法,用于从扩散模型中采样,能在指数级更少的步骤中达到相同精度,该论文获得 ICML 杰出论文奖。
原始内容
相关动态
OpenAI 提出 Contrastive SDF 测量奖励追寻
OpenAI 与 Apollo Research 合作研究奖励追寻(reward-seeking)行为,提出新方法 Contrastive SDF,通过给相同模型设置相反信念来测量其行为变化。
NVIDIA Vera Rubin 平台发布
NVIDIA 发布 Vera Rubin 平台,性能功耗比提升 10 倍;CoreWeave 等云服务商部署 Vera Rubin NVL72,每兆瓦 token 数比 Blackwell 多 10 倍;DeepInfra 基准测试显示 Vera CPU 速度是其他 CPU 的 2 倍以上,支持更多并发 AI 代理。
OpenAI发布奖励寻求行为测量新方法Contrastive SDF
OpenAI与Apollo AI Evals合作发布关于奖励寻求(reward-seeking)行为的研究,提出新方法Contrastive SDF,用于测量模型对评分者偏好的敏感性。研究发现,在预安全检查点中,模型对评分者偏好的敏感性随RL训练增加。
Laguna S 2.1 from @poolsideai is live on OpenRouter!
Poolside AI发布了Laguna S 2.1,一个面向agentic编码和长时域工作的开放权重118B-A8B MoE模型,支持1M上下文窗口。该模型在Terminal-Bench 2.1上获得70.2%的分数,在DeepSWE上获得40.4%的分数。
Google DeepMind 发布 Gemini 3.6 Flash 等三款新模型
Google DeepMind 发布三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。Browser Use 评测显示,Gemini 3.6 Flash 在 BU 基准上达到 68%,超越 GPT-5.6-sol(67%)和 Sonnet 4.6(62%),仅次于 Opus 4...