Black Forest Labs 发布多模态模型 FLUX 3,面向视频领域,原生支持音频、图像生成与动作预测。该模型旨在成为视觉智能的骨干,目前官方已展示其能力与早期结果。
模型
·Black Forest Labs:Blog(网页)
FLUX 3 发布:Black Forest Labs 多模态模型,支持原生音频、图像生成与动作预测
— FLUX 3 - Real World Models: Towards Multimodal Flow Models as the Backbone of Visual Intelligence.