速度は制作手順を変える
構図と動きを試し、一つの指示だけを変えて、長く待たずに複数のテイクを比較できます。
既存の MiniMax H3 ワークスペースと明確に分けた H3 Max 専用ページです。
時間構成、カメラ、動作、音響まで指定した詳細なプロンプトから動画を生成します。
モードを選び、必要な素材と演出指示を追加して MiniMax H3 Max 動画を生成します。
MiniMax H3 Max は MiniMax H3 を基盤に速度を重視したAI動画ジェネレーターです。テキスト、画像、参照素材から5〜15秒の映像と同期ネイティブ音声を扱います。
H3 Max は MiniMax H3 の追加学習版です。このワークスペースは H3 Max リクエストのみを送信し、現在は 768P と 1080P 出力に対応します。

MiniMax H3 Max は、プロンプト追従性、美的な仕上がり、映像と音の反復速度を高めた MiniMax H3 の追加学習動画バリアントです。
ショット指示、開始画像と任意の終了画像、または画像・動画・音声の参照から始められます。カメラ、動作、台詞、環境音、音楽を一つの制作指示にまとめます。
構図と動きを試し、一つの指示だけを変えて、長く待たずに複数のテイクを比較できます。
H3 Max は5〜15秒、480P・768P・1080Pです。MiniMax H3 は4〜15秒と2Kの別ワークフローです。
簡潔な設定で、指示、素材、映像、音声を一つの制作判断につなげます。
被写体、場所、動作、カメラ、光、台詞、音を一つのプロンプトに記述します。6種類の比率で横長、標準、正方形、縦長に対応します。
開始画像と任意の終了画像を使います。画像がキャンバスを決め、プロンプトが動きと視聴覚の遷移を指示します。
5秒から15秒まで選択できます。短いテイクは一つの見せ場、長いテイクは展開や反応、段階的な動きに向きます。
480Pはラフ確認、768Pは反復と精細さの両立、1080Pは選んだテイクの大きな出力に使います。
台詞、環境音、効果音、音楽、無音を映像と一緒に設計します。
画像で人物やスタイル、動画で動き、音声でサウンドを示します。各参照に明確な役割を与えます。
静止画は同一性とデザイン、動画は動き、音声は演技とリズムを担当し、プロンプトが時間軸で結びます。

商品画像で形状と素材を維持し、参照動画で見せ方を導き、時間指定した音で質感と最後のブランドビートを強調します。

顔、衣装、環境を画像で固定し、台詞とルームトーンを定義して、視線、反応、カメラ距離、最終フレームを演出します。

参照動画で身体のリズムを制御し、静止画で人物とスタイルを定義。音楽、9:16構図、読みやすい最終ホールドを加えます。
納品形式を決め、適切なH3入力方式を選び、各参照に一つの役割を与え、映像と音を同じ時間軸で演出します。
5〜15秒と実際の公開比率を選び、開始動作、転換点、最後の1秒に見せるものと聞かせるものを定義します。
構図重視ならテキストと開始・終了フレーム、同一性、実演モーション、話し方、音の方向を継ぐならマルチモーダル参照を使います。
画像は人物または環境、動画は動き、音声は声またはテンポと明記し、矛盾する素材を除外します。
同一性、接触表現、カメラ動機、口のタイミング、台詞、環境音、音楽、最終フレームを確認し、768Pまたは1080Pの結果をダウンロードして編集へ進みます。
どちらも H3 系ですが、長さ、解像度、反復の進め方が異なります。
| ワークフロー | MiniMax H3 Max | Hailuo 2.3 | 制作上の効果 |
|---|---|---|---|
| 主な重点 | 速度重視の追加学習版 | オープンウェイト基盤モデル | Max は高速比較、ベース H3 は固有の制作仕様に向きます。 |
| 入力構成 | 5〜15秒 | 4〜15秒 | 4秒は既存の H3 ワークフロー専用です。 |
| 音声出力 | 480P / 768P / 1080P | 768P / 2K | Max は H3 の2K設定を引き継ぎません。 |
| 解像度 | テキスト、フレーム、参照 | テキスト、フレーム、参照 | 入口は共通でも、パラメータと価格契約はモデル固有です。 |
マルチモーダルな音画演出にはH3、確立したテキスト・画像動画生成設定にはHailuo 2.3を選びます。
見える出来事、参照の役割、カメラ、台詞、環境音、効果音、音楽、最終フレームを記述します。
スタイル語より先に尺、比率、プラットフォーム、視聴者、目的を書きます。
どの画像が同一性、どの動画が動き、どの音声が声やリズムを制御するか指定します。
5〜15秒を開始、展開、最終ホールドに分け、観察可能な動作を書きます。
画角、レンズ感、移動、速度、何を見せるための動きかを定義します。
台詞、環境音、効果音、音楽を分け、開始、強さ、画面との関係を書きます。
人物、商品形状、衣装、光の方向、文字、最終フレームを列挙します。
各指示を映像または音で検証できるため、修正範囲が明確になります。
納品仕様 12秒、16:9の高級商品映像。ネイティブステレオ音声。 参照役割 @画像1はボトル形状とラベル領域を制御。@動画1はゆっくりした手の動きだけを制御。@音声1は話し方だけを制御。 時間軸 0〜4秒——85mmマクロで結露を横移動。静かな室内音とガラス音。 4〜9秒——引きながら手がボトルを30度回す。落ち着いた短い台詞。 9〜12秒——固定ヒーローショット、琥珀色リムライト、短い音楽の解決。 不変条件 ボトル比率、キャップ高、ラベル、カメラ軸、光の方向を維持。字幕と余分な物体は禁止。
同一性、実演モーション、聞こえる演技、開始から終了への明確な流れが必要な短尺動画に適しています。
5〜15秒にフック、実演、台詞、触感音、商品最終フレームをまとめます。
マクロ、手持ち、使用シーン、最終ホールドまで形状と素材を維持します。
同一性、視線、反応、台詞、口の動き、環境音、カメラ距離を統合します。
9:16で構図を作り、動画参照で演技を導き、モバイルで読みやすく締めます。
動作アクセント、カメラリズム、雰囲気、最終ビートを音声参照に合わせます。
商品、人物、構造、タイミングを保ちながら会話言語を変更します。
モデルの位置づけ、生成方法、長さ、解像度、音声、プロンプト、MiniMax H3 との違いを簡潔に説明します。
尺、開始・終了フレーム、参照役割、カメラ、台詞、環境音、サウンドを設定し、MiniMax H3 Maxワークスペースで生成します。
