選一種起點
打一段中文描述做 Flux 3 文字生成影片,或上傳一張商品照、人物照做圖生影片,也可以接上一段既有影片往下續寫,或放上起訖兩張關鍵影格。四種擇一即可,照片是拿來動畫化或當參考,不是拿來修圖。
打一段中文描述、丟一張照片、接一段既有影片或給起訖關鍵影格,就能拿到單次最長 20 秒、帶對白與音效的成片。
頻道開場、商品情境、課程講解、短劇分鏡與遊戲風格預告,全都從文字、照片、既有影片或關鍵影格四種起點長出來,聲音跟著畫面一起生成。
霓虹地平線揭幕
品牌宣傳
櫻桃蛋糕預告
產品短片
賽博城市發布
品牌宣傳
金色田野邂逅
電影感宣傳
動作女主登場
娛樂宣傳
便利店衝擊
品牌宣傳
頭盔特寫
產品短片
日落咖啡館宣傳
生活風格宣傳
以下四項都是這個模型本身的能力,決定了你在 VideoAI 上能一次做完哪幾道工序。
從挑起點到拿到成片,整個流程在 VideoAI 上跑一遍大概是這樣。
打一段中文描述做 Flux 3 文字生成影片,或上傳一張商品照、人物照做圖生影片,也可以接上一段既有影片往下續寫,或放上起訖兩張關鍵影格。四種擇一即可,照片是拿來動畫化或當參考,不是拿來修圖。
描述鏡頭怎麼移動、角色講哪一句中文台詞、畫面上要壓哪幾個字,以及需不需要環境音與音效。對白與聲音是跟畫面一起生成的;原生音訊為可選項,不想要聲音就別在提示裡寫。
拿到單次最長 20 秒的成片,滿意就下載回去用。要更長的內容就微調提示再生下一鏡,串成多鏡頭段落,串接時把鏡頭順序當成分鏡表來排。
瀏覽更多用於圖片與影片創作的 AI 模型。

它是布萊克佛瑞斯特實驗室在 2026 年 7 月 23 日發布的多模態模型,圖像、影片與音訊在同一個統一架構裡聯合訓練。這一頁講的是它的影片生成:畫面與聲音在同一次生成裡長出來。過去幾代 FLUX 屬於圖像模型,能力不能直接套用到這一代身上。
先挑一種起點——文字、照片、既有影片或起訖關鍵影格,接著在提示裡寫清楚鏡頭怎麼動、角色說什麼、畫面上要出現哪些字,然後按下生成。第一次做不必想得太複雜,把一句話的畫面描述寫具體,比堆一堆形容詞有用得多;結果不對就改提示重生。
可以。VideoAI 給新用戶 10 點免費額度,這個額度就能直接生成,不必先付費。額度用完後有加油包和訂閱套餐兩種方式繼續使用。
單次生成最長 20 秒。需要更長的內容時,用多鏡頭串接把個別片段接成一段完整段落,鏡頭數量由你的分鏡決定。
是一起生成的,對白、音效與環境聲會跟畫面中發生的事件同步。原生音訊屬於可選項,如果你打算另外配自己的音樂或旁白,不寫聲音需求即可。
能。單張照片可以被動畫化,也可以當成畫面參考;錄好的片段能往下續寫,畫面與聲音會一起長出來。這裡的照片是影片的輸入方式,不是拿來做圖或修圖。
需要登入。在 VideoAI 註冊帳號後才能開始生成,登入後 10 點的免費額度會直接掛在帳號上,生成紀錄也留在同一個帳號裡。
沒有浮水印,可以直接下載。用免費額度做出來的 flux ai 影片同樣能商用,頻道業配、電商廣告這類用途都沒問題。