人工智能 来源:VentureBeat 整理:feaOS 2026-07-24 07:02:05

黑森林实验室推出FLUX 3,具备生成图像和20秒带音频视频的能力

德国弗赖堡的黑森林实验室(BFL)今日推出了其多模态前沿模型FLUX 3,该模型能够根据单一提示生成图像、音频和视频片段。FLUX 3在图像、视频和音频之间进行联合训练,并且可以扩展到机器人视觉和动作预测。目前,FLUX 3 Video和FLUX 3 Action已进入“早期访问”计划,但尚未公布定价和服务水平承诺等详细信息。BFL表示,FLUX 3是通过单一架构而非单独的图像、视频和音频模型进行联合训练的,这使得企业可以将创意生成、模拟、计算机使用和机器人技术视为连接的应用。该实验室还发布了初步基准比较结果,在10秒720p文本到视频片段的早期测试中,FLUX 3在93%的情况下优于Luma Ray 3.2,在77%的情况下优于Runway Gen-4.5等竞争对手模型。然而,由于缺乏定价和性能指标细节,企业买家目前无法计算总拥有成本或独立验证视频比较结果。

ENTRY_ID: NEWS-9773 READ_MODE: SHORT_SIGNAL