画像プロンプトの書き方
クイックテンプレートから手書きプロンプト、精密な編集まで、キャラクターの画像をもっと良くする方法。
fuckd.ai チームによる記事 ·
Generate Mediaのすべての画像は、キャラクターの肖像画から始まります。このガイドではその仕組みを説明し、最も速い方法から最も細かく制御できる方法まで、3つのプロンプト方法を紹介します:テンプレート、自分で書くプロンプト、Edit Imageです。
画像が作られる仕組み
モデルはキャラクターをゼロから描くわけではありません。肖像画を参照して、ポーズ、服装、背景を描き直します。そのため、顔や体格、髪の色を説明する必要はありません。肖像画がすでに画像モデルにキャラクターを見せているからです。
Settings → Model で2つのモデルから選べます:
Muse(デフォルト)はKreaの派生モデルで、露骨で写実的なディテールに最適化されています。キャラクターの類似性はやや低いですが、最高の画質を提供します。
Morph(Premium)はQwenアーキテクチャをベースにした、画像編集用の汎用大規模モデルです。キャラクターの肖像画に忠実なので、顔や体の変化が少ないです。グループチャットでは最大3人を1枚の画像に収められます。完全な露骨シーンには苦手な場合があります。
どちらも1枚につき6 Spunkです。
ステップ1:テンプレートから始める
良い画像を得る最速の方法は、3つのピッカー(Pose、Outfit、Scene)です。各カードは手書きでテスト済みのプロンプトで、それぞれに複数のバリエーションがあるため、同じカードでも毎回少し違った仕上がりになります。
Generate Media を開いて Create Image を選択します。
キャラクターを選択します。
Pose を選びます。
Outfit を選びます。
Scene を選びます。
必要に応じて、Extra detail に特定のタトゥーやピアス、ムード、カメラアングルなどを追加します(Premium)。
Generate を押します。
カスタムのPose、Outfit、Scene
ピッカーに合うものがなければ、Custom を選んで自分で入力します。カードのように短く簡潔に:
Pose:
ベッドにひざまずいて、肩越しに振り返るOutfit:
赤いシルクの着物、はだけた状態(「着ている」と書く必要はありません。自動で補われます)Scene:
夕日の屋上プール
プロンプトエンハンサーはオンにしたまま
プロンプトエンハンサー(Settings → Optimize prompt)はデフォルトでオンです。リクエストがモデルに届く前に、選択した項目と追加の詳細を1つの完全なシーン説明に書き換えます。ポーズや表情、手の動き、服の状態、シチュエーションに合った小道具、場面に合った照明を追加します。あなたが頼んだことは維持され、何もトーンダウンしません。
テンプレートを使っている間はオンにしておきましょう。選択のリストをシーンに変えるのはこの機能です。
ヒント:編集モードで変更する前に、同じ選択セットで数回生成してみてください。各カードには複数のバリエーションがあり、エンハンサーも独自のバリエーションを追加します。
ステップ2:自分でプロンプトを書く(Premium)
テンプレートが何をもたらすか分かったら、完全にコントロールできます。キャラクターを選択し、ピッカーをスキップしてプロンプト全体を自分で書いてください。
最も生々しい結果を得るには、エンハンサーをオフにします。モデルには入力したテキストがそのまま届き、何も追加されません。
含めるべきもの
完成した画像を現在形で1段落で説明します。おおよそこの順番で:
ショット: セルフィー、鏡越し、全身、クローズアップ、POVなど。
ポーズと表情: 体の動き、視線、手の動き。
服装: 各アイテムを色と素材とともに指定し、着方も説明します。例:「白いシャツ、半分ボタンが外れて片方の肩から落ちかけている」。
背景: 場所と2〜4つの小道具。例:「しわくちゃのシーツ、ベッドサイドランプ、本の山」。
照明: 光の方向。例:「サイドウィンドウからの柔らかい昼光」。
エンハンサーをオフにした場合の、手書きのクイックプロンプト例:
入力:
彼女はセルフィーを撮っている、ひざまずいて舌を出して誘惑的に、ビッチな大学生の服を着て改善版: ハイアングルのスマホ自撮り、カメラに向かって腕を伸ばしている。彼女はしわくちゃの寮のベッドにひざまずき、いたずらっぽく舌を出し、レンズを見つめている。グレーの大学パーカーを片方の肩から落として、ローライズのデニムショートパンツを履いている。後ろには壁にストリングライト、教科書の山、バンドのポスター。ベッドサイドのデスクランプからの暖かい光。
ショットを明示し、ポーズと表情を具体的にし、「ビッチな大学生の服」を色やフィット感のある具体的なアイテムに置き換えています。背景と小道具、光源も追加しています。約380文字で、700文字の制限内に収まります。
以下は、エンハンサーが短いリクエストをどのように変換するかの例です。効果的なディテールのレベルが分かります:
入力:
キッチンで君を見せてモデルが受け取る内容: モダンなキッチンに立つ若い女性、大理石のカウンターに寄りかかって少し微笑み、白のクロップドタンクトップとデニムショートパンツを着ている。サイドウィンドウからの柔らかい昼光、後ろのカウンターにはやかんとマグカップ。
プロンプトは約700文字以内に抑えてください。Morphは800文字を超えると切り捨てます。
含めないべきもの
キャラクターの見た目。 髪の色、年齢、民族、身長は肖像画から来ます。それらを別の指定で説明すると矛盾が生じます。そばかす、タトゥー、ピアスなどの永続的なディテールを追加するには、キャラクター作成時に Custom Physical Details または Custom Face Details に入力すれば、すべての画像に反映されます。
「masterpiece、8k、ultra-detailed」などの品質ワード。 これは初期のStable Diffusionタグに由来し、データセット内の高画質画像にアクセスするために使われていましたが、現代のモデルでは使われていません。
「〜しないで」という表現。 モデルは「何を見せないか」という指示を無視する傾向があります。代わりに画像に何があるかを説明し、避けたいものは
Settings → Negative prompt(最大200文字)に入力してください。
ステップ3:Edit Imageで仕上げる(Premium)
画像がもう少しで完璧、という場合、最初からやり直す必要はありません。Edit Imageは作成済みの画像を取得し、指定した部分だけを変更します。
Edit Image を選択します。
変更したい画像を選びます。
変更内容を説明するか、新しい服やシーンを選びます。
Generate を押します。
Morphでは、編集はQwenの編集モデルで実行され、画像の一部を変更しながら残りを保持するように設計されています。元の画像を参照するので、「同じベッド」「彼女のネックレス」など、画像内の物を指して、何を変更し何を維持するかを指定できます。
編集の言葉の選び方
変更内容を指示として始めます:
髪を艶やかな鮮やかな青に変えて、長さとスタイルはそのまま。次に、何を維持するかを指定します:
同じポーズ、同じベッド、同じ照明。一度に1つの変更だけ行います。大きな変更1回より、小さな変更を数回連続で行う方が効果的です。
ヒント:精密な変更には、編集前にプロンプトエンハンサー(
Settings → Optimize prompt)をオフにしてください。モデルは指示をそのまま受け取るため、指定した部分だけを変更し、残りはそのまま保持します。
キャラクターの顔や体が変わってしまう場合
画像がキャラクターからずれ始めた場合(顔が違う、痩せた体格など)、モデルを Morph に切り替えてください。Museは各画像をより新しく描くため、露骨なディテールが増えますが、特徴がずれる可能性があります。Morphはキャラクターの肖像画に常に戻り、そこから顔と体を再構築するため、変化がはるかに少ないです。これはEdit Imageでも同じように機能します。
クイックフィックス
画像が漠然としている: 背景、小道具、照明を追加するか、エンハンサーをオンに戻します。
エンハンサーが希望と違う変更をした: より具体的に指定するか、オフにしてプロンプト全体を自分で書きます。
不要なものが頻繁に出る: Negative promptに追加します。
顔や体がキャラクターと一致しない: Morphに切り替えます。
ほぼ完璧だが少し違う: 再生成する代わりにEdit Imageを使います。
編集が指定以上に変更した: エンハンサーをオフにして編集をやり直します。
生成に失敗した: 生成に失敗した場合の対処法 をご覧ください。