沖縄のウォーターファッション
水の抵抗、パレオの動き、人物の顔を同じショットで確認。
プロンプトを見る
沖縄の高級リゾート広告。31歳の日本人女性がコーラル色のワンピース水着とアイボリーのパレオで浅瀬から立ち、勢いよくターンして夕日の中へ水滴を飛ばす。横方向の追従カメラ。顔、水着、パレオを固定。波、水しぶき、控えめなリゾート音楽。
MiniMax H3で、テキストまたは開始画像から映像とステレオ音声を一度に生成。人物の動き、カメラ、台詞や環境音までを1つのプロンプトにまとめ、日本語の画面からそのまま試せます。
最初の1秒で武器が点灯し、旋回から着地までを1カットで構成。
掲載動画はGazoulabがMiniMax H3で生成したオリジナル作例です。公式ショーケースは使用していません。
同じ人物を並べただけの作例ではありません。成人ファッション、コスプレ、アニメ、商品、食、動物や生活場面まで、目的ごとにプロンプトを変えています。
水の抵抗、パレオの動き、人物の顔を同じショットで確認。
沖縄の高級リゾート広告。31歳の日本人女性がコーラル色のワンピース水着とアイボリーのパレオで浅瀬から立ち、勢いよくターンして夕日の中へ水滴を飛ばす。横方向の追従カメラ。顔、水着、パレオを固定。波、水しぶき、控えめなリゾート音楽。
成熟したアニメ表現で、歌声と演奏を同じテンポに合わせます。
夕暮れの屋上ライブ。27歳の成人女性シンガー、短い赤茶髪、ティールのイブニングドレス。ベースの指元から歌手へ移動し、『夜風に乗って』と歌った後、成人ミュージシャン全体と街並みを見せる。顔、衣装、楽器を保つ。
声、口元、楽器、室内の残響を一緒に企画した作例です。
京都を思わせる現代的なジャズラウンジ。28歳の日本人と欧州系のルーツを持つ女性歌手がシルクリボンを受け止め、マイクへ向いて『次の曲、聴いてください』と自然に話す。ピアノから歌手へ滑らかに移動。自然な口の動きと室内音。
人物以外にも、商品形状と液体の動きを分けて指示できます。
黒い浅水面に、無地の長方形スモーキーガラス香水瓶が2cmだけ落下。王冠状の水しぶきが一度だけ広がり、最後は中央で静止する。ボトル、銀色キャップ、ガラス比率を完全に保ち、水と反射だけを動かす。ラベル、文字、ロゴなし。
高速な全身運動とカメラ移動を1つずつ整理した例。
北海道の冬。33歳の日本人女性スノーボーダーが新雪を鋭くカービングし、雪煙をレンズへ飛ばして小さなジャンプへ入る。低い横追従カメラ、自然なボード物理。顔、ゴーグル、白と青のウェアを固定。
魅力人物だけに偏らず、生活音と間で物語を作る例です。
終電後の小さな東京のラーメン店。年配の男性店主が湯気の立つ丼を成人会社員へ滑らせる。丼と手元から感謝の会釈へ移り、雨の窓へピントを送る。雨、換気扇、器が木に触れる音、『ありがとう』の小声。
モデル名だけを置き換えた説明ではなく、現在のGazoulab接続で実際に選べる入力と出力に合わせています。
画像から動画では、動かしたい対象が小さすぎない横長画像を用意します。この基準画像のように顔、衣装、道具の輪郭が読み取れると、動作指示へ集中できます。

H3は音声を動画と一緒に生成します。台詞、環境音、効果音を場面の順番に合わせて書くと、後から音を足すより意図が伝わりやすくなります。

768pで構図と動きを固め、必要なカットだけ2Kへ上げると試行回数を確保できます。解像度を上げても、曖昧な動作指示そのものは改善されません。

歩いて振り返るだけではスクロールを止められません。武器の点灯、水しぶき、衣装の旋回など、縮小表示でも読める変化を冒頭へ置きます。

モデル自身の能力と、Gazoulabが提供する操作体験を混同せずに整理しました。
他社モデルを混ぜず、H3の対応値だけを表示します。
企画段階はテキスト、顔や衣装を固定したい場面は開始画像へ切り替えられます。
解像度と秒数に合わせ、共有計算器と同じクレジットを表示します。
入力、エラー、料金、ログイン後の復元まで日本語で完結します。
未ログインでも入力と画像を保存し、認証後に自動送信できます。
同じ企画内容をKlingやSeedanceでも試し、カットごとに向くモデルを選べます。
下の値は説明用の飾りではありません。生成パネルの選択肢、必要クレジット、実際に送る設定はすべて同じ対応表を参照しています。
| 項目 | テキストから動画 | 画像から動画 |
|---|---|---|
| 長さ | 4〜15秒(1秒刻み) | 4〜15秒(1秒刻み) |
| 解像度 | 768p / 2k | 768p / 2k |
| 比率 | 21:9〜3:4(1段階刻み) | 開始画像に合わせる |
| 音声スイッチ | 常時ネイティブ生成 | 常時ネイティブ生成 |
| 終了画像 | — | 任意で追加可能 |
| おすすめ | 構図や場面をゼロから作る | 顔、衣装、商品形状を開始画で決める |
最初から最長・最高解像度にせず、短い初稿から一つずつ変えるのが近道です。
ゼロから作るならテキスト、人物や商品を守りたいなら開始画像を選びます。
主体の動作、カメラ、音、固定要素の順に、1カットへ詰め込みすぎず書きます。
顔、手、物理、音を完走で確認し、次は秒数か動作のどちらか一つだけ直します。
モデル名ではなく、完成させたい仕事から選べるように整理しています。
衣装、武器、マントと効果音を含む短い演目案を作りたい人。
冒頭の動きが強い6〜15秒素材を縦横比別に試したい人。
液体、ガラス、布などの質感を確認しながら商品カットを設計したい人。
成人キャラクターの歌唱、演奏、環境音を一度にラフ化したい人。
カットごとに、音、動き、長さ、アニメ表現の向き不向きがあります。
料金、仕様、権利、公式サービスとの関係を、断定しすぎず具体的に説明します。
MiniMaxが開発した音声付き動画生成モデルです。Gazoulabではテキストまたは開始画像から4〜15秒の動画を生成できます。
同じMiniMax系ですが別のモデルです。このページと生成画面はMiniMax H3だけを対象にしています。
現在のGazoulabでは768pと2Kを選べます。生成画面には、実際に利用できる設定だけを表示しています。
現在のH3は映像と音声を一緒に生成し、音声だけを切る設定には対応していません。そのため、使用できない音声スイッチは表示していません。
はい。開始画像を必須として、任意で終了画像も指定できます。出力比率は開始画像に合わせて決まります。
可能です。話者、短い台詞、声の調子、発話タイミングを書き、生成後は発音と口の動きを必ず確認してください。
ページの閲覧と入力は無料ですが、動画生成には表示されたクレジットを使用します。必要数は解像度と秒数で変わります。
利用前にMiniMaxとGazoulabの最新規約を確認し、入力画像、音声、人物、衣装デザインに必要な権利を確保してください。
いいえ。Gazoulabは複数の生成モデルを利用できる独立サービスで、MiniMaxの公式サイトではありません。
主体の動作を1つ、カメラ移動を1つに減らし、まず768pの短い動画で確認してください。