MiniMax H3 / qwen-image プロンプトビルダー

ビルド対象を選び、セクションごとに内容を入力します。リファレンス素材は「存在」と「用途」だけを指定します(画像・動画・音声そのものはどこにも送信されません)。 「プロンプト生成」を押すと、入力内容のみをお手元のGemini APIキーで送信し、対象モデル用の英語プロンプトを生成します。 入力内容はこのブラウザ内にのみ保存されます(保存先は下の「保存先」で選べます)。

ビルド対象

Gemini APIキー(BYOK)

キーはこのブラウザのストレージ(下の「保存先」で選んだセッションストレージまたはローカルストレージ)にのみ保存され、このアプリのサーバーには一切送信されません。 生成時はブラウザから直接 Google の API に対して通信します。キーと保存先はすべてのビルド対象で共通です。 キーは Google AI Studio で無料発行できます。

1. 被写体 (Subjects)

動画に登場する人物・キャラクターを定義します。リファレンス素材の「用途」からここで定義した被写体を紐づけられます。 最終的なプロンプトでは "Subject 1" "Subject 2" のように登録順の連番で参照されるため、ここでの名前はあくまで人間が見分けるための呼び名です。

名前・呼び名のつけ方: 短く、他の被写体と重複しない一意な呼び名にしてください(例: 「ボーカル」「ギタリスト」「案内役の女性」)。 外見・服装・声質などの詳細情報は名前欄ではなく下の説明欄に書いてください。 またシーン描写・カメラワーク・その他の指示の欄で同じ人物に言及する際も、ここで付けた名前を一貫して使うと、Geminiが被写体と記述内容を正しく対応付けやすくなります。

2. シーン・詳細描写

場所、行動、照明、雰囲気、時間経過など。日本語で構いません(生成時に英語へ変換されます)。

3. カメラワーク

アングル、動き、レンズ感、カット割りなど。空欄でも構いません。

4. 台詞・歌詞(リップシンクさせたい音声内容)

口の動きを同期させたいテキストです。歌詞・セリフをそのまま入力してください。

5. サウンドスケープ・BGM

背景音、環境音、BGMの雰囲気など。無音にしたい場合もその旨を書いてください。

6. その他の指示

7. リファレンス素材(存在チェックのみ・内容は解析しません)

ComfyUIの「MiniMax H3 リファレンスから動画へ」ノードの入力枠に合わせています。 素材そのものはアップロードせず、「あり/なし」のチェックのみを行います。用途と、必要なら紐づく被写体を選んでください。

タグ付けの仕組みについて 生成されるプロンプトでは、「あり」にチェックした素材だけが <Picture N> / <Video N> / <Audio N> の形式でタグ化されます。 チェックしていないスロットはプロンプトに含まれません。

生成結果