XVI Site

クリエイト活動に関する情報を掲載

AIイラストに、どうやって伝える?――プロンプトについて考えてみる

AIイラストを使っていると、こんな経験をすることがあります。

「ちゃんと指定したのに、思った通りにならない」

「もっと詳しく書けば伝わるはず」とプロンプトを長くしたら、かえっておかしくなった。

「右手」と書いたのに、なぜか左手に持っている。

「こちらを見て」と指定したのに、全然違う方向を見ている。

そして、まったく同じプロンプトを使ったはずなのに、今度は違う絵が出てきた。

AIイラストを始めたばかりの頃は、こうした現象に戸惑う方も多いのではないでしょうか。

今回は、そんなAIイラストの「プロンプト」について、少し考えてみたいと思います。


◆ そもそも「プロンプト」って何?

AIイラストを生成するとき、AIに対して「こんな画像を作ってほしい」と伝えるために入力する文章があります。

それが「プロンプト」です。

例えば、

  • 女の子
  • 赤い髪
  • 青い服
  • 笑顔
  • 海辺

といった言葉を組み合わせることで、AIに作ってほしい画像のイメージを伝えていきます。

また、AI画像生成では「こういうものは描いてほしくない」という指定をするネガティブプロンプトが使われることもあります。

こちらは、例えば「ぼやけた画像」「低品質」「余分な指」など、生成してほしくない要素を指定するためのものです。

つまり、非常に単純化すると、

通常のプロンプト=「こうしてほしい」

ネガティブプロンプト=「こうしてほしくない」

という考え方になります。

ここだけを見ると、とても簡単そうですよね。

ところが、実際に使ってみると、そう単純ではありません。

 


◆ 詳しく書けば書くほど、思い通りになる?

AIイラストを始めたばかりの頃、私はこんなふうに考えていました。

「自分の頭の中にあるイメージを、できるだけ詳しく文章にすればいいのでは?」

これは、一見すると理にかなっています。

例えば「女の子」とだけ指定するよりも、

「長い赤髪の少女。青いドレスを着て、海辺に立っている。右手には花を持ち、こちらを向いて笑っている。夕暮れの柔らかな光が差し込んでいる……」

と細かく指定したほうが、イメージは具体的になります。

実際、ある程度具体的に指定することは重要です。

しかし、ここには少し面白い問題があります。

プロンプトは、長ければ長いほど良いとは限らない。

指定する条件が増えれば、それだけAIに要求することも増えます。

人物のポーズ、顔の向き、視線、手の位置、服装、背景、光、カメラの位置、構図……。

一つ一つは問題なくても、それらすべてを同時に成立させようとすると、条件同士がうまく噛み合わなくなることがあります。

そして最終的に、

「こんなに細かく書いたのに、なんでこうなったの?」

という結果になることがあります。

これは、プロンプトが「設計図」ではないからなのかもしれません。

人間が設計図を見る場合、そこに書かれている条件を一つずつ確認しながら、完成形を組み立てることができます。

しかし、画像生成AIへのプロンプトは、少なくとも人間が文章を読むような感覚で、そのまま処理されているわけではありません。

そのため、「指定を増やせば、必ず指定した分だけ正確になる」とは限らないのです。


◆ 「右」と「左」も、意外と難しい

AIイラストを使っていると、個人的にかなり気になるのが「右」と「左」です。

例えば、

「女性の右手に剣を持たせる」

と指定したとします。

人間なら、普通は「女性本人から見て右手」と考えるでしょう。

ところが画像生成AIでは、これが必ずしも人間の意図通りになるとは限りません。

キャラクターから見た右なのか。

画像を見る側から見た右なのか。

画像の中の右側なのか。

そもそもAIは、人間が考えるような「右」「左」という空間概念を、同じ意味で扱っているのでしょうか。

こう考えてみると、単純な言葉に見えて、実はかなり複雑です。

これは「右」「左」に限った話ではありません。

  • 前にいる
  • 後ろにいる
  • こちらを見る
  • 相手を見る
  • 横を向く
  • 背中を向ける

こうした指示も、文章だけで人間の頭の中にある三次元的な状況を正確に伝えるのは、意外と難しいものです。

例えば、

「妹が姉のほうを見て拍手する」

と書いたとしても、AIが生成する画像では、妹がカメラを見ていることがあります。

姉を見ているようで、実際には少し違う方向を見ていることもあります。

人間からすれば、

「いや、姉はそっちじゃないよ!」

となるわけです。

これも、AIが「文章を読んで、その場面を人間と同じように頭の中で再現している」と考えると、非常に不思議な現象です。


◆ 同じプロンプトでも、同じ絵にはならない

さらに面白いのが、同じプロンプトを使っても、毎回同じ画像が生成されるとは限らないことです。

例えば、

「赤い髪の少女が海辺で笑っている」

という同じ文章を何度も入力したとしても、毎回まったく同じ画像が出てくるわけではありません。

髪型が変わったり、表情が変わったり、ポーズが変わったり、背景の雰囲気が変わったりします。

「同じ指示を出したのだから、同じ答えになるのでは?」

と思うかもしれません。

しかし、画像生成AIは一般的なプログラムとは少し違います。

普通のプログラムなら、同じ入力に対して同じ処理をすれば、基本的には同じ結果が返ってくるというイメージがあります。

一方、画像生成AIでは、同じプロンプトであっても、さまざまな条件によって結果が変化します。

モデル、LoRA、各種設定、参考画像、そして生成時のランダム性など、さまざまな要素が関係します。

そのため、私はプロンプトを、

「完成する画像を直接指定する命令文」

というより、

「AIに対して、作ってほしい画像の方向性を伝えるための言葉」

と考えたほうが分かりやすいのではないかと思っています。


◆ 「プロンプト通りにならない=失敗」なのか?

では、プロンプト通りの画像が出てこなかった場合、それは失敗なのでしょうか。

私は、必ずしもそうではないと思っています。

もちろん、「このポーズにしたい」「このキャラクターにしたい」という明確な目的がある場合は、意図通りにならなければ困ります。

しかし、生成結果を見て、

「なぜこうなったんだろう?」

と考えてみると、そこからAIの性質が少しずつ見えてきます。

「この指示はうまく伝わらなかった」

「ここまで細かく指定すると、別の部分がおかしくなる」

「この構図は文章だけでは伝えにくい」

「だったら、参考画像を使ったほうがいいのでは?」

こうやって試行錯誤していく。

実際、私自身も、どうしても文章だけではポーズや構図が安定しない場合には、別の方法で参考画像を作って、それを利用することがあります。

つまり、

「プロンプトだけですべてを解決しようとしない」

という考え方も、一つの方法なのだと思います。


◆ 一つのプロンプトですべてを説明する必要はない

これは、前回の記事で書いた「キャラクターのブレンディング」とも少し似ています。

AIに一つの方法ですべてをやらせようとすると、思わぬところで問題が発生することがあります。

だったら、作業を分けてしまえばいい。

例えば、

  • キャラクターは参考画像で指定する
  • ポーズも参考画像を利用する
  • 背景は別の工程で作る
  • 細かい部分はInpaintingなどで修正する
  • 最後は画像編集ソフトで整える

という方法です。

これは「これが正解」という話ではありません。

私自身が実際に試してみて、「この部分はAIに任せるより、別の方法で処理したほうがうまくいく」と感じた結果です。

AIイラストには、必ずしも一つの正解があるわけではないのだと思います。


◆ プロンプトは「AIへの命令」ではなく「AIとの対話」?

AIイラストを始めたばかりの頃は、プロンプトを「AIへの命令文」のように考えていました。

「こう書けば、こういう絵が出てくる」

そう思っていたわけです。

ところが、実際に使っていると、少し違って見えてきます。

プロンプトを書く。

生成する。

結果を見る。

「ここが違う」と思う。

プロンプトを変える。

もう一度生成する。

また結果を見る。

この繰り返しです。

そう考えると、プロンプトを書くことは、AIに一方的に命令することというより、

「自分のイメージを、AIにどう伝えれば理解してもらえるのかを探す作業」

なのかもしれません。

そして、AIの出してきた結果を見ながら、こちらの伝え方も変えていく。

そういう意味では、プロンプトは「AIとの対話」の一部と考えることもできるのではないでしょうか。


◆ 最初から完璧なプロンプトを書く必要はない

AIイラストをこれから始める方にとって、「プロンプト」という言葉は、少し難しそうに感じるかもしれません。

英単語をたくさん覚えなければいけない。

順番が重要なのではないか。

長く詳しく書かなければいけない。

そんなふうに考えてしまうかもしれません。

しかし、私は最初から完璧なプロンプトを書く必要はないと思っています。

まずは自分が作ってみたいものを、普通の言葉で書いてみる。

そして生成してみる。

「ここが違うな」と思ったら、そこを直してみる。

それでもダメなら、別の方法を試してみる。

その繰り返しでいいのではないでしょうか。

むしろ、

「思った通りにならなかった」

という経験こそ、AIイラストを知るための材料になると思います。

「なぜこうなったんだろう?」

と考えてみる。

そこから、少しずつAIの特徴が分かってきます。


◆ AIイラストは「伝え方」を探すことも面白い

今回、プロンプトについていろいろ書きましたが、結局のところ、私が一番面白いと思っているのはここです。

AIイラストでは、

「何を描くか」だけではなく、「どう伝えるか」も作品づくりの一部になる。

同じイメージを持っていても、伝え方を変えるだけで結果が変わる。

逆に、どれだけ詳しく説明しても、AIにとって処理しにくい指定なら、思った通りにならないこともある。

だからこそ、生成された画像を見て、

「どうしてこうなった?」

「じゃあ、こう伝えたらどうなる?」

と試してみる。

その試行錯誤自体が、AIイラストの面白さの一つなのだと思います。

AIイラストは、プロンプトの「正解」を覚えれば終わり、というものではないのかもしれません。

むしろ、自分の頭の中にあるイメージを、どうすればAIと一緒に形にできるのか。

その方法を探していくことこそが、AIイラストを楽しむ一つの方法なのではないでしょうか。


今回も、あくまで私自身がAIイラストを実際に使ってきた中で感じたこと、考えたことをまとめてみました。

これからAIイラストを始めてみたい方にとって、「ちょっと試してみようかな」と思うきっかけになれば嬉しいです。

また、すでにAIイラストを使っている方にとっても、普段何気なく使っている「プロンプト」について、少し考えるきっかけになればと思います。