Flux 3 - セリフと効果音まで同時生成

テキストや写真1枚から、必要なら音声付きで最長20秒の動画をVideoAIで作れます。

Flux 3で作られた動画を見る

キャラの一枚絵からゲームの告知まで、映像と音声が同じ生成から出た作例です。

ネオンホライズン公開

ブランドプロモーション

チェリーケーキ予告

プロダクトフィルム

サイバーシティ発表

ブランドプロモーション

黄金の野原との遭遇

シネマティックプロモーション

アクションヒーロー登場

エンタメプロモーション

コンビニスマッシュ

ブランドプロモーション

ヘルメットのクローズアップ

プロダクトフィルム

サンセットカフェプロモーション

ライフスタイルプロモーション

セリフも音も、Flux 3の動画生成で

Flux 3のAI動画生成は、映像と音、そして画面に出る文字までを一度でまかないます。flux ai 動画の作り方として、まず入り口を選びます。

日本語のセリフと表情

喋らせたいセリフを書き添えると、その声と口元・表情の動きが噛み合ったカットが返ってきます。多言語のセリフに対応しているので、日本語の告知や挨拶を収録なしで用意できます。

映像と音声をひとつの生成で

足音、衣擦れ、環境音といった音を、画面の中で起きている出来事に合わせて映像と一緒に出せます。音声は付けるかどうかを選べるオプションなので、必要なカットだけ音付きで出して、後から音を当てる工程を省けます。

4つの入り口

テキスト、イラストや写真、撮影済みのクリップ、始点と終点のキーフレーム。Flux 3 テキストから動画を起こすこともできますし、手元の1枚を動かす対象としても参照としても渡せます。キーフレームを置けば、その間のカメラワークは任せられます。

画面内の日本語テキスト

複数の言語の画面内テキストを高い精度で描けるため、テロップを入れた解説カットがそのまま読める形で仕上がります。ミュート前提で流れるXやTikTokでも、中身が伝わります。

写真1枚から、3ステップで1本に

Flux 3 動画生成は、入り口を決めてセリフを書き添えるところから始まります。

ステップ 01

入り口を選ぶ

VideoAIでFlux 3を選び、テキストを書くか、イラストや写真、手元のクリップ、始点と終点のキーフレームのいずれかを渡します。初めての1本なら、すでに持っている画像1枚から動かすのが一番早く形になります。

ステップ 02

セリフとテロップを書く

動きやカメラの流れに加えて、喋らせたい日本語のセリフと、画面に出したいテロップの文言をそのまま書き添えます。音声を付けるかどうかもこの段階で決められます。

ステップ 03

生成して、繋ぐ

1回の生成でつくれるのは最長20秒なので、出てきたカットを確認したうえで、必要なら複数のカットを繋いで多カットのシーケンスに伸ばします。仕上がったらダウンロードして、XやYouTube、TikTok、ニコニコ動画へそのまま出せます。

他のモデルを見る

画像や動画制作に使える追加の AI モデルを確認できます。

手元の設定画から一本試す

手元の1枚から、Flux 3で動かす

最初の1本は、机の上の写真か台本の一節から、Flux 3 無料の枠で始められます。

今すぐはじめる

はじめる前に、よくある疑問

Flux 3 とは、どんなモデルですか?

2026年7月23日に公開された、画像・映像・音声をひとつのアーキテクチャの中で一緒に学習させたマルチモーダルモデルです。それぞれを別々のモデルでつなぐのではなく、同じ設計の中でまとめて扱うところに特徴があります。このページで扱うのは、そのうちの動画の生成です。

Flux 3 使い方はどうなりますか?動画を作ったことがなくても大丈夫ですか?

手順は3つだけです。VideoAIでFlux 3を選び、テキストか画像などの起点を渡し、動きとセリフを書いて生成します。編集ソフトの知識は要りません。うまくいかなければ、書き方を変えてもう一度生成すれば済みます。

Flux 3は無料で試せますか?ログインは必要ですか?

はい、新規登録の時点で10クレジットの無料枠が付き、その範囲でこのモデルの生成を試せます。生成にはログイン(アカウント登録)が必要です。枠を使い切ったあとは、クレジットのチャージパックとサブスクリプションプランの2通りから選べます。

1本あたり、どれくらいの長さのFlux 3 動画になりますか?

1回の生成でつくれるのは最長20秒です。それより長い尺が欲しいときは、生成したカットを繋いで多カットのシーケンスに組み上げます。ティザーや告知トレーラーは、この繋ぎ方で作ります。

音声は映像と一緒に出ますか?あとから付け直す必要はありますか?

映像と同じ生成の中で音も出せるので、別工程で当て直す必要はありません。セリフや効果音、環境音は画面で起きている出来事に合わせて生成されます。音声はオプション扱いなので、無音で書き出したいカットでは付けずに出せます。

イラスト1枚しかありませんが、そこから動かせますか?

動かせます。Flux 3 画像から動画を起こす場合、その1枚を動かす対象そのものとしても、雰囲気の参照としても使えます。もちろん、テキストだけ、撮影済みのクリップの続き、キーフレームの指定からでも始められます。

日本語のセリフを喋らせることはできますか?

できます。多言語のセリフに対応しており、声と画面の中の動きや表情を対応させるところがこのモデルの得意分野です。喋らせたい文言と場面の描写をプロンプトに書き添えて方向づけてください。

書き出した動画にウォーターマークは入りますか?仕事の案件にも使えますか?

ウォーターマークは入りません。10クレジットの枠で生成した分もそのままダウンロードでき、商用利用も可能です。クライアント案件や収益化しているチャンネルの動画に組み込んでも問題ありません。

Flux 3で動画生成、セリフも効果音も同じ一回で|VideoAI