水族館トンネルを泳ぐリゾートモデル
水中の髪、光、布の動きを、静止画ではなく連続運動で確認。
プロンプトを見る
沖縄の大きな水族館トンネル。31歳の成人日本人女性モデルが上品な黒のワンピース水着と薄い白い布を身につけ、水中を一度だけゆっくり回転して魚の光を受ける。水中カメラが横から追い、髪と布が自然に流れる。顔、衣装、体の比率を固定。泡と水の音、文字とブランドなし。
MiniMax H3 Maxは、MiniMax H3をfalが追加学習した動画モデルです。テキスト、開始画像、複数の参考画像から、動き・台詞・環境音をまとめた短編を高速に生成できます。
成人女性職人の手元から、光るガラス作品が完成するまでを一続きに。
掲載動画はGazoulabがMiniMax H3 Maxで生成したオリジナル作例です。公式ショーケースは使用していません。
人物・ファッション、コスプレ、アニメ、商品、食、動物や生活場面まで、用途ごとに動作、カメラ、終わり方を変えた指示を掲載しています。
水中の髪、光、布の動きを、静止画ではなく連続運動で確認。
沖縄の大きな水族館トンネル。31歳の成人日本人女性モデルが上品な黒のワンピース水着と薄い白い布を身につけ、水中を一度だけゆっくり回転して魚の光を受ける。水中カメラが横から追い、髪と布が自然に流れる。顔、衣装、体の比率を固定。泡と水の音、文字とブランドなし。
既存作品に寄せない成人キャラクターと、音楽に合わせた細かな手の動き。
オリジナルの成人アニメ女性DJ、29歳、短い赤茶髪、青緑のイブニングスーツ。東京のレコードショップでレコードを選び、ターンテーブルへ置き、針を落として短いリズムに合わせて肩を揺らす。カメラはジャケットの手元から顔、店内のネオンへ一度だけ移動。成熟した造形、学校表現なし、自然な店内音。
二人の視線、ろくろの回転、手の位置を同時に保つ会話例。
京都の静かな陶芸工房。30代の成人日本人女性二人がろくろを挟み、一人が器の縁を整えながら『焼き上がりが楽しみですね』と話し、もう一人がうなずいて釉薬を選ぶ。カメラは回る粘土から二人の表情へゆっくり横移動。土、ろくろ、衣服、手を固定。会話、工房の反響、窓の雨音。
金属、歯車、光の反射だけを動かし、商品形状を守る。
無地の機械式腕時計を透明な台へ置いた高級商品マクロ。秒針が一度進み、内部の小さな歯車が連動し、朝の光がサファイア風防を横切る。カメラは文字盤から内部機構へゆっくり寄る。時計の輪郭、針、金属、ガラスを変えない。小さな機械音、文字、ロゴ、ブランドなし。
人物以外の大きなスケールと、煙・光・車輪の同期を検証。
瀬戸内の夕暮れの造船所。赤い貨物列車がゆっくりカーブへ入り、クレーンの影を横切り、車輪の火花が一瞬だけ見える。低い線路脇カメラが一定速度で追従し、最後に海と工場全体を広く見せる。鉄、煙、海風、車輪と遠い汽笛の音。文字、ロゴ、人物の顔なし。
車内の反射、人物の表情、短い台詞を一つのショットに。
終電前の渋谷、雨のタクシー車内。27歳の成人日本人女性会社員が窓のネオン反射を見て、運転手へ『この角で大丈夫です』と穏やかに伝え、ドアを開けて夜へ降りる。後部座席の横顔からミラー越しの運転手、濡れた街へ一度だけフォーカス移動。自然な日本語、ワイパー、車内の低い環境音。傘、ブランド、看板文字なし。
H3 Maxは、短い指示を守りながら人物・商品・音を一度に組み立てたいカットに向いています。(確認日:2026年9月2日)
768pを基準に、動作と音の方向性を短時間で確認できます。
台詞、環境音、効果音を場面の順に書くと、演出意図をまとめやすくなります。
複数画像の役割を分けて書くと、人物と商品を同じカットへ配置できます。
2Kが必要な場合はMiniMax H3、短い768pを高速に回す場合はH3 Maxを選びます。
無音素材が必要な場合は生成後に音声を編集で外してください。
高速な768p試作はH3 Max、2KやWaveSpeedの既存運用はMiniMax H3が候補です。
| 比較軸 | MiniMax H3 Max | 別の選択肢 |
|---|---|---|
| 生成速度 | H3 Max:高速・5〜15秒 | MiniMax H3:標準速度 |
| 解像度 | 480p / 768p | 768p / 2K |
| 参考画像 | 最大5枚・人物/商品/背景 | 最大5枚・WaveSpeed経由 |
現在Gazoulabで選べる入力・出力と、掲載している生成作例を基準に、実制作で役立つポイントを整理しています。
画像から動画では、動かしたい対象が小さすぎない横長画像を用意します。この基準画像のように顔、衣装、道具の輪郭が読み取れると、動作指示へ集中できます。

H3 Maxは音声を動画と一緒に生成します。台詞、環境音、効果音を場面の順番に合わせて書くと、後から音を足すより意図が伝わりやすくなります。

768pで構図と動きを固め、必要なカットだけ2Kへ上げると試行回数を確保できます。解像度を上げても、曖昧な動作指示そのものは改善されません。

歩いて振り返るだけではスクロールを止められません。固定したい要素の点灯、水しぶき、衣装の旋回など、縮小表示でも読める変化を冒頭へ置きます。

モデル自身の能力と、Gazoulabが提供する操作体験を混同せずに整理しました。
他社モデルを混ぜず、H3 Maxの対応値だけを表示します。
企画段階はテキスト、顔や衣装を固定したい場面は開始画像へ切り替えられます。
解像度と秒数に合わせ、共有計算器と同じクレジットを表示します。
入力、エラー、料金、ログイン後の復元まで日本語で完結します。
未ログインでも入力と画像を保存し、認証後に自動送信できます。
同じ企画内容をKlingやSeedanceでも試し、カットごとに向くモデルを選べます。
下の値は説明用の飾りではありません。生成パネルの選択肢、必要クレジット、実際に送る設定はすべて同じ対応表を参照しています。
| 項目 | テキストから動画 | 画像から動画 |
|---|---|---|
| 長さ | 5〜15秒(1秒刻み) | 5〜15秒(1秒刻み) |
| 解像度 | 480p / 768p | 480p / 768p |
| 比率 | 21:9〜3:4(1段階刻み) | 開始画像に合わせる |
| 音声スイッチ | 常時ネイティブ生成 | 常時ネイティブ生成 |
| 終了画像 | — | 任意で追加可能 |
| おすすめ | 構図や場面をゼロから作る | 顔、衣装、商品形状を開始画で決める |
最初から最長・最高解像度にせず、短い初稿から一つずつ変えるのが近道です。
ゼロから作るならテキスト、人物や商品を守りたいなら開始画像を選びます。
主体の動作、カメラ、音、固定要素の順に、1カットへ詰め込みすぎず書きます。
顔、手、物理表現、音を最初から最後まで確認し、次は秒数か動作のどちらか一つだけ直します。
モデル名ではなく、完成させたい仕事から選べるように整理しています。
衣装、武器、マントと効果音を含む短い演目案を作りたい人。
冒頭の動きが強い6〜15秒素材を縦横比別に試したい人。
液体、ガラス、布などの質感を確認しながら商品カットを設計したい人。
成人キャラクターの歌唱、演奏、環境音を一度にラフ化したい人。
カットごとに、音、動き、長さ、アニメ表現の向き不向きがあります。
料金、仕様、権利、公式サービスとの関係を、断定しすぎず具体的に説明します。
falがMiniMax H3を追加学習した動画モデルです。Gazoulabではテキスト、開始画像、参考画像から5〜15秒の動画を生成できます。
別のモデルです。H3 Maxはfalの追加学習版で、プロンプト追従と生成速度を重視した構成です。
480pと768p、5〜15秒に対応しています。まず768pの5秒で動きを確認し、必要なカットだけ長くする使い方がおすすめです。
H3 Maxは映像とネイティブ音声を一緒に生成するモデルで、現在のAPIには音声だけを切る設定がありません。
Gazoulabでは最大5枚です。人物、衣装、商品、背景をImage 1、Image 2のようにプロンプトで指定できます。画像枚数による追加料金はありません。
指定できます。話者、短い台詞、声の調子、発話タイミングを具体的に書き、生成後は発音と口の動きを確認してください。
ページの閲覧と入力は無料ですが、動画生成には表示されたクレジットを使用します。必要数は解像度と秒数で変わります。
いいえ。Gazoulabは複数の生成モデルを利用できる独立サービスです。
H3 Maxは高速生成向けに調整されていますが、混雑状況と設定によって待ち時間が変わります。
利用前にfal、MiniMax、Gazoulabの最新規約を確認し、入力素材に必要な権利を確保してください。