FLUX 3
bfl/flux-3FLUX 3 是 Black Forest Labs 即將推出的統一多模態底座,將圖像、影片、音訊、語言與動作預測融於一個模型。Flux 3 API 將隨各能力分階段開放,覆蓋附帶原生音訊的文生影片、圖像生成與編輯,以及物理 AI 能力。
即將到來的 Flux 3 API 為何是一次大跨越
FLUX 3 圍繞圖像、影片、音訊、語言與動作預測的單一底座建構。以下能力來自 Black Forest Labs 的公布資訊,正式發布前可能調整。
統一多模態底座
同時學習圖像、影片、音訊、語言與動作資料,讓 FLUX 3 理解場景如何演進、哪些聲音對應事件、物體如何回應運動。
影片與原生音訊一體
在同一次生成中產出畫面與聲音——最長 20 秒片段,對白、環境音、撞擊聲與畫面運動對齊。
多輸入引導
除文字外,可用圖片、關鍵幀、參考片段、已有影音來塑形輸出並控制轉場。
更長更連貫的故事
將多次生成串聯成多鏡頭長序列,讓角色、物體、環境與風格跨場景延續。
多語言對白與可視文字
在圖像和影片中放入可讀的招牌、標題、標籤與動態文字,支援面向不同受眾的多語言對白。
物理動態與動作
從運動、聲音、物體互動中學習,支撐更連貫的物理行為,並為模擬與機器人操作打下基礎。
FLUX 3 影片展示
FLUX 3 API 生成的片段。開啟聲音可聽原生多語言音訊。
FLUX 3 使用情境
FLUX 3 面向高動態影片——電影感片段、廣告、特效風鏡頭,對提示詞還原與動態真實感有要求的情境。
電影感片段
帶運鏡和景深的膠片感鏡頭,2K 下依然耐看。
廣告片段
提示詞驅動的廣告片段,還原度高——描述什麼就出什麼。
特效風鏡頭
風格化動態序列,用於片頭、轉場、字幕卡。
概念探索
先大量出短變體找方向,定調後再做完整渲染。
FLUX 3 對比當下主流影片模型
來自 Black Forest Labs 的 FLUX 3 公布資料:10 秒、720p 附帶原生音訊的文生影片片段,與其他模型正面對比。
| 對比模型 | FLUX 3 偏好率 | 說明 |
|---|---|---|
| Luma Ray 3.2 | 93% | 領先幅度最大 |
| Runway Gen-4.5 | 77% | 明顯領先 |
| Grok Imagine Video | 69% | 清晰領先 |
| Kling v3 Pro | 60% | 有一定優勢 |
| Seedance 2.0 | 52% | 勢均力敵 |
| Gemini Omni Flash | 52% | 勢均力敵 |
資料為研發階段候選模型的初步內部評估,並非獨立重現的基準。樣本數與評估方法尚未公開,請視為早期參考而非最終結論。
FLUX 3 API
向 /api/v1/runs 發送 POST 請求,附帶 API Key 與輸入參數。生成任務非同步執行——輪詢任務 ID 取得狀態,成功後讀取輸出連結。
curl -s https://runbase.net/api/v1/runs \
-H "Authorization: Bearer $RUNBASE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "bfl/flux-3",
"input": { "prompt": "A cinematic product photo of a ceramic lamp" }
}'| 參數 | 類型 | 必填 | 說明 |
|---|---|---|---|
| prompt | string | 必填 | Prompt |
| aspect_ratio | string | 選填 | Aspect ratio選項: 1:13:44:39:1616:921:9 |
| duration | number | 選填 | Duration (seconds) |
如何為 Flux 3 API 做準備
FLUX 3 即將上線,現在就緒,開放當天即可上線。
- 1
建立 Runbase 帳號
註冊或登入,管理 API 憑證、餘額、用量與可用模型。
- 2
生成 API Key 並準備整合
建立並妥善保管 Key。鑑權、非同步工作處理、回呼與媒體儲存都可用現有整合結構提前準備好。
- 3
上線後選擇 Flux 3
官方支援後,參考最新文件,按專案需要選擇影片音訊、圖像或其他分階段開放的能力。
- 4
設定並提交請求
提供文字提示及支援的參考(圖片、影片、音訊、關鍵幀),選擇設定,透過確認的端點提交。
- 5
追蹤工作並取回結果
用傳回的工作資訊查詢狀態或接收回呼,再按最新文件取回成片與用量明細。

