一句话判断
关注其在 token 效率提升及速度翻倍方面的改进,对构建高性价比 Agent 工作流具有参考价值。
核心信息
Google 发布了 Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber 三款新模型。其中 3.6 Flash 的输出价格从每百万 token $9 降至 $7.50,生成速度从 165 tokens/s 提升至 304 tokens/s,且在 Artificial Analysis Intelligence Index 上得分与 3.5 Flash 持平(50分),但在 GDPval-AA 知识基准上从 1349 分提升至 1421 分。此外,Google 确认已启动 Gemini 4 的大规模预训练。
原始内容
相关动态
Poolside 发布 Laguna S 2.1
Poolside 发布 Laguna S 2.1 模型,总参数 118B 的 MoE 架构,每 token 激活 8B 参数,支持 1M 上下文窗口,提供思考和不思考模式,并完全开源。
Poolside 发布 Laguna S 2.1
Poolside 发布 Laguna S 2.1 模型,118B 总参数的 MoE 架构,每 token 激活 8B 参数,支持 1M 上下文窗口及思考/非思考模式,可单卡运行于 NVIDIA DGX Spark,全面开源并已在 Hugging Face 发布权重。
Laguna S 2.1 from @poolsideai is live on OpenRouter!
Poolside AI发布了Laguna S 2.1,一个面向agentic编码和长时域工作的开放权重118B-A8B MoE模型,支持1M上下文窗口。该模型在Terminal-Bench 2.1上获得70.2%的分数,在DeepSWE上获得40.4%的分数。
Google DeepMind 发布 Gemini 3.6 Flash 等三款新模型
Google DeepMind 发布三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。Browser Use 评测显示,Gemini 3.6 Flash 在 BU 基准上达到 68%,超越 GPT-5.6-sol(67%)和 Sonnet 4.6(62%),仅次于 Opus 4...
Grok 4.5 集成 Microsoft Outlook
Grok 4.5 现可直接在 Microsoft Outlook 中使用,支持总结邮件线程与附件、识别决策与待办任务、以用户语气起草回复、搜索网络和 𝕏,以及整理、归档、删除或标记邮件。