发生了什么
Google 发布 Gemini 3.5 Flash-Lite(350 tokens/s)
为什么值得关注
该模型速度达 350 tokens/s,适合对延迟敏感的 UI 和 agent 场景,值得关注其实际应用效果。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
Gemini 3.5 Flash-Lite 发布
Logan Kilpatrick 宣布 Google 发布 Gemini 3.5 Flash-Lite,这是最小最快的 Gemini 模型,速度近 350 tokens/s,比 Gemini 3 更智能,与 Gemini 2.5 Flash 同成本但更智能,超越 3.1 Flash-Lite。
打开原始来源 ↗