← 返回精选动态
精选动态

Gemini for Science

Google DeepMind 公布 Gemini for Science

更新于 2026年05月20日 09:03 4 条公开来源

发生了什么

Google DeepMind 公布 Gemini for Science

为什么值得关注

这条信息不仅是产品式发布,还给出了三类科研工作流工具的具体实现方式和已进入 private preview 的企业应用对象,适合关注科研代理和科学发现工具链的人直接看原文。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

Gemini for Science

twitter关注列表 2026年05月20日 04:35

Google DeepMind 和 Google Research 发布 Gemini for Science,一组面向科研流程的实验性工具,包含三项主要能力:Literature Insights、Hypothesis Generation 和 Computational Discovery。Literature Insights 基于 Google NotebookLM,可搜索数百万篇科学论文并生成数据表、幻灯片、报告等;Hypothesis Generation 基于 Co-Scientist,通过多智能体“idea tournament”生成、辩论并评估研究假设;Computational Discovery 基于 AlphaEvolve 和 ERA,可并行生成并评分数千种代码变体,用于在流行病学、太阳能预测等领域测试建模方法。Google 表示这些实验将从今天开始逐步开放访问,企业版能力已在 private preview 中被 BASF、Klarna、Daiichi Sankyo、Bayer Crop Science 和美国国家实验室使用。

打开原始来源 ↗
02

Gemini Omni 发布

twitter关注列表 2026年05月20日 09:02

Google DeepMind 在 Google I/O 发布 Gemini Omni,这是一个原生多模态的“理解 + 生成”模型,当前主攻视频创作与编辑。它支持任意组合输入图像、文本、视频、音频来生成或编辑视频,并强调对话式多轮编辑、一致性保持、世界知识与物理直觉,以及参考图、草图、音频等“任意参考物组合”能力。原文还将 Omni 与 Veo 对比,指出 Veo 主要依赖将多模态压成文本后生成、需要更具体的逐帧提示,而 Omni 可基于意图补细节并在多轮修改中叠加上下文。

打开原始来源 ↗
03

Gemini Omni

twitter关注列表 2026年05月20日 03:17

Google AI 发布 Gemini Omni,称其为一个可从任意输入生成内容的新模型,首个场景是视频生成。该模型支持自然语言对视频进行对话式编辑,可像“视频版 Nano Banana”一样修改人物、场景和风格;同时支持将文本、音频、图片和视频组合输入,生成高质量且一致的视频。Google AI 还表示,Gemini Omni Flash 已向 Google AI Plus、Pro、Ultra 订阅用户开放,可在 geminiapp、Google Flow、Google Flow Music 使用,并可在 YouTube Shorts 和 YouTube Create 免费使用。

打开原始来源 ↗
04

Introducing Gemini Omni

twitter关注列表 2026年05月20日 03:48

Google DeepMind 团队在 Google for Developers 的视频中介绍了新的 Gemini Omni,多模态视频生成与编辑模型,并说明它相较 Veo 是一次“step change”。他们表示,Omni 支持将 image、audio、video references 组合起来,通过简单提示词实现无缝编辑,同时还讨论了 Google 在生成视频的 safety 与 transparency 方面的做法。该视频于 2026 年 5 月 20 日发布,当前观看次数为 563,来自 Google for Developers 频道,订阅者约 263 万。

打开原始来源 ↗
← 返回精选动态