Signal Brief

Black Forest Labs 发布 FLUX 3 统一多模态模型

Black Forest Labs 发布 FLUX 3,采用统一架构同时处理图像生成、视频、原生音频和机器人动作预测。视频已开放早期访问,后续将开放权重,并与 mimic、Audi 合作在真实机器人上运行。团队认为物理世界智能与内容创作可共享同一视觉基础模型。

twitter关注列表 Berryxia.AI (@berryxia) 发布 2026-07-23 收录 2026-07-23 观察

一句话判断

该模型将内容生成与机器人动作预测统一到同一架构,值得关注其权重的开放及实际部署效果。

核心信息

Black Forest Labs 发布 FLUX 3,采用统一架构同时处理图像生成、视频、原生音频和机器人动作预测。视频已开放早期访问,后续将开放权重,并与 mimic、Audi 合作在真实机器人上运行。团队认为物理世界智能与内容创作可共享同一视觉基础模型。

原始内容

好久没有看到Flux家更新模型了啊~ FLUX 3把图像、视频、音频和机器人动作预测塞进了同一个模型。 Black Forest Labs这次直接上统一架构,一个多模态backbone同时处理图像生成、视频、原生音频,甚至能扩展到机器人动作预测。 目前视频已经开放early access,后续还会开放权重,并已经和mimic、Audi合作在真实机器人上跑起来了。 这不是简单的“多加几个模态”,是他们明确提出:物理世界的智能和内容创作,本质上可以跑在同一套视觉基础模型上。 生成一段真实的视频,和预测机器人该怎么动手,共享的是同一套对世界的理解。 https://t.co/W9HMNIMvLV https://video.twimg.com/amplify_video/2080308957898481664/vid/avc1/1280x720/b8zGcuZVtWBn3sUt.mp4?tag=14

相关动态

03

FLUX 3 将极大影响机器人智能和学习

Black Forest Labs 发布 FLUX 3 统一多模态模型,支持图像、视频、音频和动作预测。其 Self-Flow 架构使机器人微调数据减少一半,相比早期模仿视频实验,机器人训练数据减少 10 倍,通过大规模视频预训练隐式学习物理规律。

twitter关注列表2026-07-23#模型发布#多模态#技术突破
观察