「カフェにいる美しい女性」とだけ入力したとします。
それでも画像は出ますが、重要な判断のほとんどをAIに任せています。
どんなカフェ?昼か夜か?顔のアップか全身か?カメラを見るのか?窓からの柔らかい光か、ネオンか?写真かイラストか?
良い画像Promptは、魔法の呪文というより撮影や制作のブリーフに近いものです。
まず5つの層で考える
実用的な順番は次の通りです。
- 主役(Subject) — 誰、または何を見せたいか
- 場面(Scene) — どこで、いつ起きているか
- 構図(Composition) — どの距離、角度で切り取るか
- 光(Lighting) — 光源と雰囲気
- スタイル/媒体 — 写真、水彩、3D、広告ビジュアルなど
たとえば、
夕方の静かな東京のカフェで一人で本を読む女性。目線より少し低い位置からのミディアムショット。背後の窓には雨。暖かい店内灯。自然なエディトリアル写真。
のようにすると、AIが勝手に決める範囲を減らせます。
感情だけでなく、画面に見えるものを書く
「寂しい」は抽象的です。
「隅のテーブルに一人だけ座り、周囲の椅子は空いていて、雨の窓を見ている」と書けば、寂しさを作る視覚的な手がかりになります。
「高級感」も同じで、素材、余白、照明、家具など、画面に現れる要素へ分解すると伝わりやすくなります。
少しのカメラ用語で構図が変わる
専門家になる必要はありません。次のような語だけでも役立ちます。
- close-up
- medium shot
- full-body shot
- wide shot
- eye level
- low angle
- top-down
- shallow depth of field
- centered composition
これらは「何をどのくらい大きく見せるか」の指示です。
長いPromptほど良いわけではない
「ミニマルなのに物が多い」「柔らかい均一光なのに強いスポットライト」のように、条件同士が衝突すると結果は不安定になります。
重要度の高い情報を先に明確にしましょう。
文字以外のコントロールも使う
ツールによっては、Negative Prompt、参考画像、アスペクト比、スタイル参照、マスク編集などがあります。
これらは自然言語Promptより安定する場合があります。Promptだけですべてを制御しようとしないことも大切です。
失敗した部分だけを直す
人物は合っているのに構図が違うなら、構図だけを直します。
構図は良いのに雰囲気が弱いなら、光や色を変えます。
毎回Promptを全部書き換えると、何が効いたのか分かりません。
人物そのものが生成ごとに変わる問題は、Promptの長さではなく一貫性の問題です。次の第015回で扱います。
再利用できる型
[主役] + [場面] + [構図/カメラ] + [光] + [スタイル] + [重要な制約]
全部を毎回書く必要はありません。何が未指定なのかを見つけるための型です。
今日の一文
良い画像Promptは、長さではなく、画面に必要な判断を明確に伝えられているかで決まります。
コメント
質問、感想、補足したいことがあれば、ここに残せます。
まだコメントはありません。1Fになってみませんか。