FLUX 3
bfl/flux-3FLUX 3 是 Black Forest Labs 即将推出的统一多模态底座,将图像、视频、音频、语言与动作预测融于一个模型。Flux 3 API 将随各能力分阶段开放,覆盖带原生音频的文生视频、图像生成与编辑,以及物理 AI 能力。
即将到来的 Flux 3 API 为何是一次大跨越
FLUX 3 围绕图像、视频、音频、语言与动作预测的单一底座构建。以下能力来自 Black Forest Labs 的公布信息,正式发布前可能调整。
统一多模态底座
同时学习图像、视频、音频、语言与动作数据,让 FLUX 3 理解场景如何演进、哪些声音对应事件、物体如何响应运动。
视频与原生音频一体
在同一次生成中产出画面与声音——最长 20 秒片段,对白、环境音、撞击声与画面运动对齐。
多输入引导
除文字外,可用图片、关键帧、参考片段、已有音视频来塑形输出并控制转场。
更长更连贯的故事
将多次生成串联成多镜头长序列,让角色、物体、环境与风格跨场景延续。
多语言对白与可视文字
在图像和视频中放入可读的招牌、标题、标签与动态文字,支持面向不同受众的多语言对白。
物理动态与动作
从运动、声音、物体交互中学习,支撑更连贯的物理行为,并为仿真与机器人操作打下基础。
FLUX 3 视频展示
FLUX 3 API 生成的片段。打开声音可听原生多语言音频。
FLUX 3 使用场景
FLUX 3 面向高动态视频——电影感片段、广告、特效风镜头,对提示词还原与动态真实感有要求的场景。
电影感片段
带运镜和景深的胶片感镜头,2K 下依然耐看。
广告片段
提示词驱动的广告片段,还原度高——描述什么就出什么。
特效风镜头
风格化动态序列,用于片头、转场、字幕卡。
概念探索
先大量出短变体找方向,定调后再做完整渲染。
FLUX 3 对比当下主流视频模型
来自 Black Forest Labs 的 FLUX 3 公布数据:10 秒、720p 带原生音频的文生视频片段,与其他模型正面对比。
| 对比模型 | FLUX 3 偏好率 | 说明 |
|---|---|---|
| Luma Ray 3.2 | 93% | 领先幅度最大 |
| Runway Gen-4.5 | 77% | 明显领先 |
| Grok Imagine Video | 69% | 清晰领先 |
| Kling v3 Pro | 60% | 有一定优势 |
| Seedance 2.0 | 52% | 势均力敌 |
| Gemini Omni Flash | 52% | 势均力敌 |
数据为研发阶段候选模型的初步内部评估,并非独立复现的基准。样本量与评估方法尚未公开,请视为早期参考而非最终结论。
FLUX 3 API
向 /api/v1/runs 发送 POST 请求,附带 API Key 与输入参数。生成任务异步执行——轮询任务 ID 获取状态,成功后读取输出链接。
curl -s https://runbase.net/api/v1/runs \
-H "Authorization: Bearer $RUNBASE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "bfl/flux-3",
"input": { "prompt": "一张陶瓷台灯的电影级产品照片" }
}'| 参数 | 类型 | 必填 | 描述 |
|---|---|---|---|
| prompt | string | 必填 | Prompt |
| aspect_ratio | string | 可选 | Aspect ratio选项: 1:13:44:39:1616:921:9 |
| duration | number | 可选 | Duration (seconds) |
如何为 Flux 3 API 做准备
FLUX 3 即将上线,现在就绪,开放当天即可上线。
- 1
创建 Runbase 账号
注册或登录,管理 API 凭证、余额、用量与可用模型。
- 2
生成 API Key 并准备集成
创建并妥善保管 Key。鉴权、异步任务处理、回调与媒体存储都可用现有集成结构提前准备好。
- 3
上线后选择 Flux 3
官方支持后,参考最新文档,按项目需要选择视频音频、图像或其他分阶段开放的能力。
- 4
配置并提交请求
提供文字提示及支持的参考(图片、视频、音频、关键帧),选择设置,通过确认的端点提交。
- 5
追踪任务并取回结果
用返回的任务信息查询状态或接收回调,再按最新文档取回成片与用量明细。

