Black Forest Labs 正式上线 FLUX 3 视频生成模型,单次生成最长 20 秒视频并附带原生音频,支持原生 1080p 分辨率及文生视频、图生视频、视频生视频、多镜头串联等功能。
FLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0 这条更新来自 ithome.com,发布时间为 2026-08-06,Aioga 保留原文入口以便核验。

摘要:Black Forest Labs 正式上线 FLUX 3 视频生成模型,单次生成最长 20 秒视频并附带原生音频,支持原生 1080p 分辨率及文生视频、图生视频、视频生视频、多镜头串联等功能。
背景:该模型此前曾以 Early Access 方式上线,采用统一架构联合学习图像、视频和音频。官方博文数据称,FLUX 3 在文本生成视频和图片生成视频评测中分别获得 1,135 分和 1,051 分,并在材料所列对比中超过部分模型。
Aioga 观察:Aioga 判断,FLUX 3 的核心看点在于视频、音频与多种输入方式被纳入同一模型能力框架;但现有材料仅提供官方公布的跑分与功能描述,尚不足以独立证明其在所有场景中的综合优势。

影响与后续:可能影响视频生成产品的功能竞争和成本比较,尤其是原生音频、1080p输出及视频续写等能力。其实际使用价值仍取决于生成质量、稳定性、计费方式和不同任务中的表现,材料未披露相关完整信息。 值得关注后续官方或第三方测试是否披露统一评测条件、样本范围和失败案例,并核实各模式的分辨率、生成限制与实际计费。评估产品时应分别比较文本、图片和视频输入任务,避免仅依据单项跑分下结论。
IT之家:https://www.ithome.com/ 8 月 6 日消息,Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,最长 20 秒,原生 1080p 分辨率,其性能要优于字节跳动的 Seedance 2.0 以及 Minimax 的 H3 等模型。

IT之家此前报道,FLUX 3 模型以 Early Access 方式于 7 月 23 日上线:https://www.ithome.com/0/981/137.htm, 采用统一架构联合学习图像、视频和音频。
FLUX 3 可在单次生成中输出最长 20 秒的视频,并附带原生音频。官方表示该模型支持文生视频、图生视频、视频生视频、输入视频与音频续写、关键帧转视频、多语言对话,以及多镜头串联。
根据官方博文公布的数据,该模型在文本生成视频方面,得分 1,135 分,超过 Gemini Omni Flash 和 Minimax H3 模型;在图片生成视频方面,得分 1,051 分,超过 Seedance 2.0 和 Minimax H3 模型。

Draft 模式(快速 / 经济)仅限高清(HD),文本转视频或图像转视频每秒收费 0.06 美元 (IT之家注:现汇率约合 0.41 元人民币) ,视频转视频每秒收费 0.12 美元 (现汇率约合 0.81 元人民币) 。
常规情况高清下,文本转视频或图像转视频每秒收费 0.17 美元 (现汇率约合 1.1 元人民币) ,视频转视频每秒收费 0.41 美元 (现汇率约合 2.8 元人民币) 。
全高清模式下,文本转视频或图像转视频每秒收费 0.29 美元 (现汇率约合 2 元人民币) ,视频转视频每秒收费 0.53 美元 (现汇率约合 3.6 元人民币) 。