← 返回精选动态
精选动态

Gemini 3.5 Flash 发布

Google DeepMind 发布 Gemini 3.5 Flash(76.2%/1656 Elo/83.6%/84.2%)

更新于 2026年05月20日 08:32 5 条公开来源

发生了什么

Google DeepMind 发布 Gemini 3.5 Flash(76.2%/1656 Elo/83.6%/84.2%)

为什么值得关注

这次披露了 3.5 Flash 在多个 agentic、coding 和多模态基准上的具体分数,以及与 Gemini 3.1 Pro 和其他 frontier models 的速度差异,适合直接对照评估是否替换现有工作流。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

Gemini 3.5 Flash 发布

twitter关注列表 2026年05月20日 01:45

Google DeepMind 在 Google I/O 发布 Gemini 3.5 系列,并率先推出 3.5 Flash,定位为面向 agentic workflows 的最新模型家族。官方称 3.5 Flash 在 Terminal-Bench 2.1 上达到 76.2%,在 GDPval-AA 上为 1656 Elo,在 MCP Atlas 上为 83.6%,在 CharXiv Reasoning 上为 84.2%,并且输出 tokens/s 比其他 frontier models 快 4 倍;结合 Google Antigravity 后,速度最高可进一步提升到 12 倍。Google 还表示 3.5 Flash 已面向 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API、Google AI Studio、Android Studio、Gemini Enterprise 和 Gemini Enterprise Agent Platform 全球上线,3.5 Pro 预计下个月推出。

打开原始来源 ↗
02

Gemini 3.5: frontier intelligence with act

twitter关注列表 2026年05月20日 01:24

Google DeepMind 在 2026 年 5 月 19 日发布 Gemini 3.5 系列,首发模型为 3.5 Flash,并表示 3.5 Pro 将在下个月推出。3.5 Flash 已向 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API、Google AI Studio、Android Studio、Gemini Enterprise Agent Platform 和 Gemini Enterprise 全面开放。官方称其在 Terminal-Bench 2.1 上得分 76.2%,在 GDPval-AA 上达到 1656 Elo,在 MCP Atlas 上达到 83.6%,在 CharXiv Reasoning 上达到 84.2%,输出 tokens/s 比其他 frontier 模型快 4 倍,并在多项代理与编码基准上超过 Gemini 3.1 Pro。

打开原始来源 ↗
03

Gemini Omni 发布

twitter关注列表 2026年05月20日 01:21

Google DeepMind 发布 Gemini Omni,称其是首个可“from anything create anything”的视频模型起点,结合了 Gemini 的智能与生成媒体系统,在世界理解、多模态和编辑能力上实现提升。官方还表示,Omni 融合了对物理规律的改进理解,以及 Gemini 对历史、生物和文化的知识,可生成更符合叙事逻辑的视频内容。该模型可在不同场景、动作和光照下保持角色一致性,也能通过输入参考或自然语言应用风格、运动和特效;用户还可以对自己拍摄的视频重新想象动作、改变环境、添加新物体。首个模型 Gemini Omni Flash 已可在 Gemini App、Flow by Google 和 YouTube Shorts 中试用,API 将在接下来的几周内开放。

打开原始来源 ↗
04

New AI Tools for the Future of Science

twitter关注列表 2026年05月20日 08:22

Google DeepMind 的 Pushmeet Kohli 和 Google Research 的 Yossi Matias 发布了 Gemini for Science,一组面向科研流程的实验性工具,并在 Google Labs 与 Google Antigravity 中提供新的 Science Skills。该套件包含 3 个主要原型:基于 NotebookLM 的 Literature Insights,可检索数百万篇科学论文并生成数据表、幻灯片、报告等;基于 Co-Scientist 的 Hypothesis Generation,通过多智能体“idea tournament”生成、辩论并评估研究假设;以及基于 AlphaEvolve 和 ERA(Empirical Research Assistance)的 Computational Discovery,可并行生成并评分数千个代码变体,用于如流行病学、solar forecasting 等领域的建模测试。Google 表示这些实验将从今天开始逐步开放访问,用户可到 labs.google/science 注册,企业版能力已在 private preview 中被合作伙伴使用,文中点名 BASF 正在使用 AlphaEvolve。

打开原始来源 ↗
05

Gemini for Science

twitter关注列表 2026年05月20日 02:47

Google DeepMind 发布了 Gemini for Science,一套实验性工具,目标是帮助科学家探索更多假设、在更大规模上验证研究结果,并更方便地梳理文献。其中文提到的 2 个能力包括:基于 Co-Scientist 的 Hypothesis Generation,用多智能体“idea tournament”生成、辩论和评估新研究想法;以及基于 AlphaEvolve 和 Empirical Research Assistance 的 Computational Discovery 原型,可并行开发和评分数千种代码变体,用于更快测试复杂领域(如 epidemiology)的新建模方法。

打开原始来源 ↗
← 返回精选动态