FLUX 3
FLUX 3 是 Black Forest Labs 的多模态生成模型,覆盖视频、音频、即将到来的图像生成,以及动作预测。公司把它描述为“一个模型服务多种模态”,而不是 FLUX.1 的纯视频续作。bfl.ai 官方页面强调风格多样的视频、可选原生音频、单次生成最长 20 秒、多语言语音,以及先草稿再精渲的智能体友好流程。产品页上图像生成标注为 “soon”。
核心功能
- 一个模型,多种模态:视频与音频现已开放;图像生成为即将推出;动作预测面向机器人,把视觉观察和文本指令变成预测结果与控制动作。
- 视频控制:文生视频、图生视频、起止帧与有序关键帧、一次生成多场景多机位、从最后一帧续写,以及片段的智能体链式拼接。
- 原生音频:可选的多语言语音、音效与环境声随画面一起生成,并强调对口型的对白。
- 草稿模式:先用低成本快速预览,再把同一提示送回去做全质量渲染。
- Self-Flow 架构:BFL 用 Self-Flow 在同一底层模型里对齐多模态生成与理解,并给出相对 flow matching 的生成误差与操作任务成功率对比。
- API、Playground 与开源权重路径:站点提供 Playground、生产 API,以及单独的开源权重授权。部署前应核对 FLUX 3 当前是否真有可下载权重,不要默认它已包含在 FLUX.2 包里。
适用场景
- 智能体视频流水线:Nous Research 的 Dillon Rolnick 描述 Hermes 先生成一个镜头、检查,再续写,从而把 20 秒片段接成更长作品。
- 产品与品牌视频:官网引用 Magnific 与 Envato,强调运动设计、产品和品牌创意,而不仅是电影感成片。
- 分镜与广告:多场景、字体排印和多语言对白适合解说、纪录片和投放。
- 机器人研究:动作预测被放在感知、仿真与执行,而不是消费级视频。
定价方案
Black Forest Labs 采用按量 API 计费,没有席位费。bfl.ai/pricing 公开计算器(2026-08-16 查阅)在 HD 草稿、文/图生视频选项下显示 FLUX 3 视频为 $0.17/秒,5 秒片段为 $0.85。分辨率、时长、草稿/正式、视频到视频都会改总价,因此把 $0.17/秒当作计算器当时显示的草稿 HD 费率,而不是万能标价。
同一页的开源权重授权仍按 FLUX.2 系列(Builder、Platform、Professional、Enterprise、Synthetic Data)说明。企业 API 客户可向销售询问量级、SLA 与组合价。
快速开始
- 打开 FLUX 3 页面,先在 Playground 试。
- 需要生产量时,在 BFL 控制台创建 API Key。
- 用草稿模式低成本探索提示,再把选中的草稿精渲。
- 做更长故事时,从最后一帧续写或把片段链式拼接,而不是一次要很长成片。
- 若需要本地权重,阅读当前开源权重条款。不要假设 FLUX 3 检查点已打进 FLUX.2 klein/dev 包。
常见问题
FLUX 3 只是视频模型吗?
不是。当前公开面是视频和音频。图像生成标注为即将推出,动作预测是面向机器人的模态。
可以下载权重吗?
BFL 为部分 FLUX 模型出售开源权重授权。FLUX 3 营销页提到 API、Playground 和“下载模型”,但公开定价页仍在详述 FLUX.2 klein 与 dev 包。规划本地部署前,先核实 FLUX 3 的具体权重提供方式。
一段能有多长?
官方文案写单次生成最长 20 秒。更长内容预期通过续写和智能体链式拼接完成。
替代方案
- Flux.1 Pro:BFL 更早的商业图像模型,只需要静帧时仍是参照。
- Veo 3:若你已在 Gemini 体系里,可看 Google 的视频生成产品。
- MiniMax:另一家提供视频与音频 API 的多模态厂商。
使用技巧
- 先出草稿:官方流程是便宜探索,再精渲。不要用全质量去搜提示。
- 按镜头写,而不是按整部电影写:20 秒片段加续写,才符合官方演示方式。
- 单独检查音频:多语言语音和对口型是卖点,也会引入失败模式。长序列拼接前先预览对白。
总结
FLUX 3 是 BFL 的一次押注:视频、音频、图像和机器人动作可以共享同一条多模态主干。若你需要智能体可控、带原生声音的短片,从官方 Playground 开始,把单次生成保持较短,确认效果后再把 API 接进更长流水线。
评论
还没有评论。成为第一个评论的人!
相关工具
MiniMax H3
www.minimax.io/blog/minimax-h3
MiniMax 于 2026 年 7 月 31 日发布的开源向多模态视频模型:文/图/视频/音频输入,768P 或 2K 输出,4–15 秒,原生立体声,按秒计费。
Seedance 2.5
seed.bytedance.com/en/seedance2_5
ByteDance Seed 的音画联合生成模型,面向 30 秒叙事、更准的参考控制、可延长两次,并提供绿幕等专业剪辑能力。
Flux.1 Dev
bfl.ai/models/flux-2
2024 年 BFL 开源权重静帧。复核:活权重是 FLUX.2 [dev]/[klein]。不是完全 MIT,也不是旗舰。
相关洞察

Grok Bot、Hermes Bot:一个人,终于配上了智囊团和秘书处
Grok Bot 进了 Cursor Pro+,Hermes Bot 能跑在 VPS 上。它们不是更聪明的聊天框。出主意的是智囊团,抓落实的是秘书处,拍板的还是你。
Windows 上把 OpenCode Go 接进 Codex,别再新开一套工具
ChatGPT 登录的 Codex 桌面版,默认选择器几乎只露出 GPT。Windows 上只开 OpenCode Go 这一家,就能把已经付过钱的 Grok、GLM、Kimi、DeepSeek、MiniMax 接回同一个 picker。密钥不出本机,原生 GPT 也不动。
锁死 Codex 的不是模型,是选择器
你已经为 OpenCode Go、Grok、Z.ai 付过钱了,但 Codex 的 picker 默认只露出 GPT。社区项目 codex-router 做的不是再教一遍安装步骤,而是把已经买过的模型能力接回选择器:密钥不出本机,原生 GPT 也不动。