FLUX 3可生成20秒有声视频,奥迪工厂已用它训练机器人
币界网消息,AI公司Black Forest Labs发布了多模态模型FLUX 3,该模型能够生成最长20秒的带声视频,并首次将图像、视频和音频整合到同一模型中。FLUX 3支持文生视频、图生视频、视频改写和续写,生成时可同步加入对白、环境声和动作音效,支持多语言对白及多个片段串联。Black Forest Labs还与Mimic Robotics基于FLUX 3开发了机器人模型flux-mimic,已在奥迪工厂进行测试,完成零件分拣、部件插装等任务。当前视频版已开放早期申请,图像版将在未来数周开放,机器人版先向合作伙伴提供。开放权重版FLUX 3 dev计划年内发布。