教學

如何使用 FLUX 3 AI 影片生成器:實用指南

如何使用 FLUX 3 AI 影片生成器:實用指南

使用 FLUX 3 AI 影片生成器時,先保護鏡頭中不能發生漂移的部分:場景想法、已確認的開場畫面、關鍵轉場或現有片段。然後只給出一個動作、一個鏡頭運動和一個聲音提示。本指南面向社群媒體、產品和角色短片,不把一次提示詞當成剪輯的替代品。

FLUX 3 Video 是 Black Forest Labs 公開發布的影片生成產品。它支援文字轉影片、影像/關鍵幀輸入和續寫,並可同步生成語音、音效和環境聲。截至 2026 年 9 月 1 日,它仍是預覽產品,因此在正式製作前,請先在 FLUX 3 官方文件中確認限制。

寫提示詞前,先選擇 FLUX 3 輸入模式

選擇模式時,先確定什麼內容必須在生成過程中保持不變:文字創意、已確認的靜幀、計劃中的銜接,還是源片段的最後一幀。

起點 適合的模式 最佳用途
只有文字簡報的場景 文字轉影片 新概念、B-roll、社群媒體短片開場
一張已確認的靜幀 圖片轉影片 產品鏡頭、人物肖像、開場畫面控制
鏡頭必須到達多個指定構圖 帶關鍵幀的圖片轉影片 揭示、前後對比轉場、分鏡化運動
需要再延續一個節拍的現有短片 影片續寫 延續運動、構圖、對白或環境聲

FLUX 影片提示詞指南說明,源圖會成為片段畫面,而有序關鍵幀會固定指定時刻。只有源畫面重要時才使用圖片轉影片;如果是全新的文字創意,文字轉影片是更清晰的起點。

設定小而可測試的影片簡報

先確定交付形式:9:16 的開場、16:9 的迴圈、產品揭示或續寫。文字轉影片和圖片轉影片目前可生成 5 至 20 秒,續寫可生成 5 至 15 秒。五秒片段只能容納兩三個清晰節拍,因此給它設定一個通過/失敗條件,例如可讀的標籤、完整的一句對白,或能平穩銜接的鏡頭運動。

在進行模型專屬測試前,AI 影片生成器可幫助團隊用簡短的創意草稿檢驗簡報、運動和構圖。

把 FLUX 3 Video 提示詞寫成運動鏡頭指令

把提示詞當作鏡頭指令,而不是物體清單:鏡頭 + 主體 + 動作 + 環境,再只補充真正重要的光線或聲音。文字轉影片提示詞指南建議,探索時使用短提示詞,只有鏡頭需要更強控制時才增加結構。相關鏡頭請複用相同的主體描述。

用於社群媒體開場的文字轉影片提示詞

影片提示詞:豎屏特寫,一名麵包師從石爐中取出熱迷迭香佛卡夏麵包,放在木板上。鏡頭從胸前高度緩慢推近至麵包外殼;晨間窗光、烤爐噼啪聲和輕微的陶瓷輕碰聲。結尾讓麵包居中。

產品靜幀轉圖片轉影片的提示詞

使用圖片轉影片時,讓源圖確定產品和構圖,只說明接下來發生什麼。

影片提示詞:以提供的啞光綠色旅行杯照片作為開場畫面。讓杯子剋制地旋轉 20 度,然後回到原始居中位置。保持杯子形狀、杯蓋、標誌位置、背景和左側光線不變。緩慢微距推近,加入細微的陶瓷輕響,不要新增道具或螢幕文字。

將音訊作為場景的一部分來指導

FLUX 3 會隨畫面生成音訊。聲音重要時,請寫出因果關係:杯子落下時的陶瓷輕碰、窗外的雨聲,或必須在剪輯前說完的一句臺詞。對白要寫明說話者、精確臺詞,以及是在畫面中說出還是作為旁白。

用 Draft 模式決定方向,再增強鏡頭

用 Draft 模式一次比較一個變數:鏡頭運動、產品動作、對白節奏或關鍵幀轉場。當前文件指出,Draft Enhance 會依據儲存的草稿資料把選中的預覽渲染為完整質量,而不是重新解釋提示詞。只有鏡頭通過關鍵檢查後才增強。

在合適的控制場景中使用關鍵幀和續寫

鏡頭必須經過指定構圖時使用關鍵幀:一張圖開啟片段,兩張圖定義起點和終點,更多畫面則形成簡短分鏡。現有片段的動勢、構圖和聲音需要延續到下一節拍時,才使用續寫。每次轉場都要符合物理邏輯,並在圍繞它剪輯更長影片前測試銜接點。

以剪輯師而非只以提示詞作者的方式審看片段

開啟聲音播放完整片段,再逐幀檢查風險所在:產品幾何形狀、手部接觸、對白時序、剪輯連續性,或交付尺寸下的文字。如果鏡頭失敗,請改動對應控制項——源圖、關鍵幀、時間線或鏡頭指令——而不是重寫所有內容。FLUX 3 Video 技術評測更詳細地說明了聚焦試點時應做的檢查。

在製作流程中使用 FLUX 3 AI 影片生成器

選擇能保護鏡頭的輸入,指定一個動作和一個鏡頭運動,生成 Draft,增強通過檢查的鏡頭,然後從已確認的片段開始剪輯。FLUX 3 更適合由一連串可審看的短決策組成的流程,而不是一個負擔過重的提示詞。

FLUX 3 常見問題

如何使用 FLUX 3?

根據需要保護的素材選擇輸入:全新場景用文本,構圖控制用影像或關鍵幀,續寫則用源片段。為運動、鏡頭和聲音寫一段簡短指令,生成 Draft,再增強並檢查勝出的鏡頭。

應該選擇哪種 FLUX 3 模式?

場景可以從文字開始時使用文字轉影片;開場畫面重要時使用圖片轉影片;鏡頭必須經過指定構圖時使用帶時間點的關鍵幀;需要從現有片段延續運動、構圖和音訊時使用影片續寫。

FLUX 3 Video 片段最長可以生成多久?

根據 Black Forest Labs 當前文件,文字轉影片和圖片轉影片可生成 5 至 20 秒,影片續寫可生成 5 至 15 秒。所有模式均以 24 fps 輸出 HD 或 Full HD,具體取決於所選設定及當前產品限制。

應該先使用 FLUX 3 Draft 模式嗎?

如果還在選擇創意方向,應該先用。Draft 可提供更快、成本更低的預覽。選定鏡頭後,Draft Enhance 會使用已儲存的草稿資料以完整質量渲染同一鏡頭,而不是讓模型重新理解新的生成請求。

來源: 如何使用 FLUX 3 AI 影片生成器:實用指南. PixVerse 於 2026 年 9 月 1 日釋出。文中的操作步驟、時長和已記錄的限制遵循該頁面及其引用的 Black Forest Labs 文件。

相關資源