ブログに戻る

Monalisa-1 の出力を一貫させる参照画像ワークフロー

参照画像、制約条件、プロンプト構造を使って、人物・製品・ライティングを一連のビジュアルアセットで統一する方法。

Monalisa-1 の出力を一貫させる参照画像ワークフロー

Monalisa-1 は、明確な制約がある制作シーンに最も適しています。プロンプトは主体を説明するだけでなく、視覚的な契約を定義すべきです。アイデンティティ、参照画像、ライティング、マテリアル、レンズ、そして最終画像が使われる場所です。

まず不変条件を決める

バリエーションを生成する前に、変更できない要素を明確にします。人物ビジュアルでは、顔の形、髪型、服装、レンズ言語が該当します。製品キャンペーンでは、パッケージ構造、ラベルの可読性、マテリアルの質感、ブランドカラーが該当します。

最初のプロンプトには、これらの不変条件を明確に記述します。その後は、背景、トリミング、季節、感情など、一度に1〜2つの次元だけを変更します。

方向性と詳細を分ける

安定した Monalisa-1 プロンプトは通常、3つの部分で構成されます。

  1. ビジュアルの方向性:感情、ターゲット、シーン、用途。
  2. 保護すべき詳細:アイデンティティ、製品の造形、ロゴの位置、色、ライティングの連続性。
  3. 出力形式:アスペクト比、トリミング、解像度、余白、配信チャネル。

これにより問題の切り分けが容易になります。出力にドリフトが発生した場合、ブリーフ全体を書き直すのではなく、保護すべき詳細だけを調整できます。

参照画像の段階を構築する

参照画像が1枚でも役立ちますが、複数レイヤーあるとより安定します。まず主体の参照を追加し、次にスタイルやマテリアルの参照を追加し、方向性が安定したら構図の参照を追加します。

チームにとっては、最良の方向性を再利用可能なブリーフとして保存します。これにより、元のビジュアル言語を失うことなく、キービジュアル、ソーシャルメディア用トリミング、サムネイル、EC画像を生成し続けることができます。