一句话判断
可关注 Google 如何将大模型技术应用于视频编辑场景,以及 SynthID 水印技术在身份认证方面的实践效果。
核心信息
Google 在 Google Vids 中推出 Gemini Omni 和个人化头像功能,用户可通过简单提示生成高质量视频剪辑并创建数字化身,需要上传自拍和语音录音制作看起来和声音像自己的虚拟形象。此功能面向 Google AI Pro、Ultra 和 Workspace 商业客户开放,个人化头像仅限特定 Google 账号下 18 岁以上用户使用(部分地区),并为所有生成视频植入不可见 SynthID 数字水印以验证其 AI 生成身份。
原始内容
相关动态
OpenAI Launches Aix Shell Micro
OpenAI 发布了其首款硬件产品 Codex Micro,一款售价 230 美元的桌面控制器,用于管理工作流程。
BestBlogs 早报 · 07-18
月之暗面发布Kimi K3,2.8万亿参数,896选16的Stable LatentMoE,上下文100万token,接近Fable-5但仍落后最强闭源模型,完整权重7月27日前开源;VentureBeat调查显示54%企业已发生AI代理安全事件;xAI开源Grok Build(84万行Rust代码)并残留上传用户代码痕迹;Cursor评...
InklingMoE模型发布
Thinkymachines 发布开源 MoE 模型 Inkling,总参数 975B、激活参数 41B、上下文长度 1M,支持文本、图像、音频的可控推理。
Claude Managed Agents 支持500个技能项目升级
Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。
Astribot发布Lumo-2
Astribot发布了40亿参数的Lumo-2机器人基础模型,推理速度比前代快2.71倍,支持人类视频和多机器人身体。该模型在105个未见物体上取得更好结果,并在22项涵盖 motion prediction、memory、physical reasoning、long tasks、fine hand control的真实操作任务中表现最...