Flux 3 - 一次生出畫面與聲音

打一段中文描述、丟一張照片、接一段既有影片或給起訖關鍵影格,就能拿到單次最長 20 秒、帶對白與音效的成片。

創作者用 Flux 3 做出來的片段

頻道開場、商品情境、課程講解、短劇分鏡與遊戲風格預告,全都從文字、照片、既有影片或關鍵影格四種起點長出來,聲音跟著畫面一起生成。

霓虹地平線揭幕

品牌宣傳

櫻桃蛋糕預告

產品短片

賽博城市發布

品牌宣傳

金色田野邂逅

電影感宣傳

動作女主登場

娛樂宣傳

便利店衝擊

品牌宣傳

頭盔特寫

產品短片

日落咖啡館宣傳

生活風格宣傳

Flux 3 影片生成能做到的事

以下四項都是這個模型本身的能力,決定了你在 VideoAI 上能一次做完哪幾道工序。

中文對白對得上表情

角色講出中文台詞的同時,臉部表情跟著語氣走,聲音與畫面裡發生的動作對得上。自媒體口播、短劇對戲、課程講解都不必事後再找配音員重錄、再一格一格對嘴。

單次 20 秒可串接

一次生成最長 20 秒的片段,發一支 Reels 或 TikTok 用單段就夠。想要完整開場、預告或一整場戲,把個別片段串接成更長的多鏡頭序列,節奏由你排。

四種起點都接得住

純文字可以起步,商品照與人物照能被動畫化或當作參考,錄好的片段可以往下續寫,起訖關鍵影格之間的運鏡與聲音則交給模型補完。手上已有的素材不必打掉重做。

畫面內文字寫得準

課程標題、商品賣點字卡這類要出現在畫面裡的文字,模型能以較高準確度渲染多種語言的字樣。通勤時靜音滑動的觀眾照樣讀得懂內容,後製補字的負擔也跟著變輕。

Flux 3 怎麼用:三步拿到成片

從挑起點到拿到成片,整個流程在 VideoAI 上跑一遍大概是這樣。

步驟 01

選一種起點

打一段中文描述做 Flux 3 文字生成影片,或上傳一張商品照、人物照做圖生影片,也可以接上一段既有影片往下續寫,或放上起訖兩張關鍵影格。四種擇一即可,照片是拿來動畫化或當參考,不是拿來修圖。

步驟 02

把台詞和畫面字寫進提示

描述鏡頭怎麼移動、角色講哪一句中文台詞、畫面上要壓哪幾個字,以及需不需要環境音與音效。對白與聲音是跟畫面一起生成的;原生音訊為可選項,不想要聲音就別在提示裡寫。

步驟 03

生成、串接、下載

拿到單次最長 20 秒的成片,滿意就下載回去用。要更長的內容就微調提示再生下一鏡,串成多鏡頭段落,串接時把鏡頭順序當成分鏡表來排。

探索其他模型

瀏覽更多用於圖片與影片創作的 AI 模型。

把手上的素材變成下一支成片

今天就先做一支 Flux 3 影片

手邊那句文案或那張商品照就夠開工,跑出一段成片再決定要不要往下串。

開始創作

動手前你可能想先問清楚

Flux 3 是什麼?和以前的 FLUX 差在哪裡?

它是布萊克佛瑞斯特實驗室在 2026 年 7 月 23 日發布的多模態模型,圖像、影片與音訊在同一個統一架構裡聯合訓練。這一頁講的是它的影片生成:畫面與聲音在同一次生成裡長出來。過去幾代 FLUX 屬於圖像模型,能力不能直接套用到這一代身上。

Flux 3 怎麼用?完全沒做過 AI 影片也上手得了嗎?

先挑一種起點——文字、照片、既有影片或起訖關鍵影格,接著在提示裡寫清楚鏡頭怎麼動、角色說什麼、畫面上要出現哪些字,然後按下生成。第一次做不必想得太複雜,把一句話的畫面描述寫具體,比堆一堆形容詞有用得多;結果不對就改提示重生。

Flux 3 免費嗎?可以先試做一支看看?

可以。VideoAI 給新用戶 10 點免費額度,這個額度就能直接生成,不必先付費。額度用完後有加油包和訂閱套餐兩種方式繼續使用。

一支 Flux 3 影片最長能做多久?

單次生成最長 20 秒。需要更長的內容時,用多鏡頭串接把個別片段接成一段完整段落,鏡頭數量由你的分鏡決定。

聲音是跟影片一起生成的嗎?可以不要聲音嗎?

是一起生成的,對白、音效與環境聲會跟畫面中發生的事件同步。原生音訊屬於可選項,如果你打算另外配自己的音樂或旁白,不寫聲音需求即可。

手上只有一張商品照或一段拍好的實況片段,能拿來做 Flux 3 圖生影片嗎?

能。單張照片可以被動畫化,也可以當成畫面參考;錄好的片段能往下續寫,畫面與聲音會一起長出來。這裡的照片是影片的輸入方式,不是拿來做圖或修圖。

一定要註冊登入才能生成嗎?

需要登入。在 VideoAI 註冊帳號後才能開始生成,登入後 10 點的免費額度會直接掛在帳號上,生成紀錄也留在同一個帳號裡。

成品有浮水印嗎?能下載並用在業配或電商廣告上嗎?

沒有浮水印,可以直接下載。用免費額度做出來的 flux ai 影片同樣能商用,頻道業配、電商廣告這類用途都沒問題。

Flux 3 影片生成|文字、圖片一次生出畫面與聲音|VideoAI