一句话判断
该模型速度达 350 tokens/s,适合对延迟敏感的 UI 和 agent 场景,值得关注其实际应用效果。
核心信息
Logan Kilpatrick 宣布 Google 发布 Gemini 3.5 Flash-Lite,这是最小最快的 Gemini 模型,速度近 350 tokens/s,比 Gemini 3 更智能,与 Gemini 2.5 Flash 同成本但更智能,超越 3.1 Flash-Lite。
原始内容
相关动态
Google 发布 Gemini 3.6 Flash 等三款新模型
Google 发布了 Gemini 3.6 Flash、3.5 Flash Lite 和 3.5 Flash Cyber 三款新模型。其中 3.6 Flash 的输出价格从每百万 token $9 降至 $7.50,生成速度从 165 tokens/s 提升至 304 tokens/s,且在 Artificial Analysis Int...
NVIDIA Vera Rubin 平台发布
NVIDIA 发布 Vera Rubin 平台,性能功耗比提升 10 倍;CoreWeave 等云服务商部署 Vera Rubin NVL72,每兆瓦 token 数比 Blackwell 多 10 倍;DeepInfra 基准测试显示 Vera CPU 速度是其他 CPU 的 2 倍以上,支持更多并发 AI 代理。
Laguna S 2.1 from @poolsideai is live on OpenRouter!
Poolside AI发布了Laguna S 2.1,一个面向agentic编码和长时域工作的开放权重118B-A8B MoE模型,支持1M上下文窗口。该模型在Terminal-Bench 2.1上获得70.2%的分数,在DeepSWE上获得40.4%的分数。
Google DeepMind 发布 Gemini 3.6 Flash 等三款新模型
Google DeepMind 发布三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。Browser Use 评测显示,Gemini 3.6 Flash 在 BU 基准上达到 68%,超越 GPT-5.6-sol(67%)和 Sonnet 4.6(62%),仅次于 Opus 4...
Grok 4.5 集成 Microsoft Outlook
Grok 4.5 现可直接在 Microsoft Outlook 中使用,支持总结邮件线程与附件、识别决策与待办任务、以用户语气起草回复、搜索网络和 𝕏,以及整理、归档、删除或标记邮件。