一句话判断
相比已公开信息,新增了1M上下文窗口规格及在Terminal-Bench 2.1和DeepSWE上的具体基准分数,值得跟踪其长时域编码性能。
核心信息
Poolside AI发布了Laguna S 2.1,一个面向agentic编码和长时域工作的开放权重118B-A8B MoE模型,支持1M上下文窗口。该模型在Terminal-Bench 2.1上获得70.2%的分数,在DeepSWE上获得40.4%的分数。
原始内容
相关动态
Poolside 发布 Laguna S 2.1
Poolside 发布 Laguna S 2.1 模型,总参数 118B 的 MoE 架构,每 token 激活 8B 参数,支持 1M 上下文窗口,提供思考和不思考模式,并完全开源。
Google 发布 Gemini 3.6 Flash 等三款新模型
Google 发布了 Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber 三款新模型。其中 3.6 Flash 的输出价格从每百万 token $9 降至 $7.50,生成速度从 165 tokens/s 提升至 304 tokens/s,且在 Artificial Analysis Int...
NVIDIA Vera Rubin 平台发布
NVIDIA 发布 Vera Rubin 平台,性能功耗比提升 10 倍;CoreWeave 等云服务商部署 Vera Rubin NVL72,每兆瓦 token 数比 Blackwell 多 10 倍;DeepInfra 基准测试显示 Vera CPU 速度是其他 CPU 的 2 倍以上,支持更多并发 AI 代理。
Poolside 发布 Laguna S 2.1
Poolside 发布 Laguna S 2.1 模型,118B 总参数的 MoE 架构,每 token 激活 8B 参数,支持 1M 上下文窗口及思考/非思考模式,可单卡运行于 NVIDIA DGX Spark,全面开源并已在 Hugging Face 发布权重。
Google DeepMind 发布 Gemini 3.6 Flash 等三款新模型
Google DeepMind 发布三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。Browser Use 评测显示,Gemini 3.6 Flash 在 BU 基准上达到 68%,超越 GPT-5.6-sol(67%)和 Sonnet 4.6(62%),仅次于 Opus 4...