8月5日Black Forest Labs正式上线性能更优的FLUX 3视频生成模型
等模型。日上线,采用统一架构联合学习图像、视频和音频。秒的视频,并附带原生音频。官方表示该模型支持文生视频、图生视频、视频生视频、输入视频与音频续写、关键帧转视频、多语言对话,以及多镜头串联。模型。
来自黑石实验室的FLUX 3视频生成模型被发布, 其具备20秒原生1080p画质, 在性能方面超越了多家竞品, 这款全新的模型支持文生视频模式、图生视频模式等多种不同模式, 并且还能够附带原生音频输出。
模型基本参数
针对FLUX 3, 其于8月5日正式上线, 它的最长生成视频时长为20秒, 它的原生分辨率有着1080p。在此之前, 在7月23日, 它已通过Early Access这种方式上线测试版本。
该模型运用统一架构, 对图像、视频以及音频进行联合学习, 能够于单次生成之际, 将视频输出, 并带有原生音频, 用不着另行配音。
性能表现数据
根据官方所公布的数据来看, 对于FLUX 3而言, 在文本生成视频这一方面, 其得分是1135分, 此分数超过了Omni Flash以及H3模型。并且, 在图片生成视频这一方面, FLUX 3得分1051分, 这样的得分同样超越了Kling 2.0以及H3。
该成绩表明, FLUX 3于视频生成质量层面已然伫立在行业领先的方位, 尤其是原生音频生成能力乃是其别具一格的优势所在。
支持多种生成模式
FLASH 3,支持文生视频, 支持图生视频, 支持视频生视频等多种输入方式, 用户还能够输入视频, 并输入音频进行续写, 或者通过关键帧生成视频。
多语言对话功能, 模型是支持的, 多镜头串联功能, 模型同样支持, 它可以满足复杂视频创作需求, 适合专业内容制作场景。
实际应用场景
就短视频创作者而言, FLUX 3能够迅速缔造帶音频的完备视频片段, 减掉后期配音以及剪辑步骤。营销人员可行使图生视频功能把产品图片转变为动态展示视频。
可用于教育行业的关键帧转视频功能, 能用来制作教学演示动画, 多镜头串联功能适宜制作短片或者广告片。
费用计算方式

按照视频输出的秒数来计算该模型调用的费用, 用户仅仅是对于实际生成的视频时长进行付费。并且, 不需要预付套餐费用。
按秒计费的这种方式, 对于轻度用户而言是比较友好的, 生成少量视频时成本低廉, 它适合个人创作者来使用, 也适合小团队来使用。
行业竞争格局
眼下视频生成那个范畴是竞争相当热烈的, 好多好多家厂商都于推出新一代模型这件事上努力推进着。FLUX 3呢, 依靠 20 秒的时长, 具备 1080p 的画质, 还有原生音频的能力, 从而渐渐形成了有差异的优势。
跟着模型性能持续提高, 视频生成技术正迅速得以普及蔓延, 将来兴许有无望成为内容创作的主流工具之一是也。
倘若你认为FLUX 3那具备的, 在二十秒钟时间里进行原生视频生成的能力, 就能将那些传统意义上具备视频剪辑功能的软件取而代之吗, 欢迎于评论区之中, 把你的看法分享出来, 要是你觉得它有用处, 那就请点赞, 并且分享给更多的朋友。