【Midjourney入門🔰】プロンプトの書き方や基礎・応用・コツを解説。
こんにちは、AI FREAKです。
前回のnoteではMidjorneyの登録方法から、簡単な使い方までご紹介しました。
上記を見てもらいつつ、Midjourneyを使ってみると、AI画像を作ることができると思います。
ただ、実際にAI画像を作ってみると、
狙い通りの画像を作るのって意外とむずいな…?
質がなかなか上がらないけど、なんでだろう…?
のような悩みに直面する方も多いかと思います。
そこで今回はそれらの悩みを解消すべく『Midjourneyプロンプトの基礎や応用』について、詳しく解説していければと。
Midjourneyの基礎がわかれば、基本的にどんな画像でも作れます。


そうなるためには、やっぱり基礎が大事なんでよね。
私は2年間近くMidjourneyをほぼ毎日触ってました。
そこで気付いた事は、
ただ漠然とプロンプトを試すより、一度基礎からしっかりと理解した方が良い
という事です。
文字にすると当たり前ではあるんですが、基礎をおざなりにしている方も意外と多いのではないでしょうか。
というわけで早速、基礎知識をみていきましょう!
プロンプトの構成を理解しよう

さて、質の高いAI画像を作るにはやはり『プロンプト』が最重要です。
そしてプロンプトにはある種、型のようなものがあります。
具体的にはこんな感じです。

上記はMidjourney公式が出している情報を日本語訳したものです。
上記のように『主題』『媒体』『環境』などを、明確に記して上げると、狙った画像が作りやすくなります。
サンプルとしてこちらの画像をご覧ください。

こちらは上記の型を参考にしつつ、作った猫です。
使用した具体的なプロンプトは、
cat wizard, fantasy art, glowing staff, cinematic lighting, 4k, highly detailed
こちらです。
このプロンプトのそれぞれを分解してみるとこんな感じ。
1️⃣ cat wizard, 2️⃣ fantasy art, 3️⃣ glowing staff, 4️⃣ cinematic lighting, 5️⃣ 4k, highly detailed
1️⃣ 主題: cat wizard (猫の魔法使い)
2️⃣ 補足: fantasy art(ファンタジーアート調)
3️⃣ アイテム: glowing staff(光る杖)
4️⃣ 雰囲気: cinematic lighting(映画のような照明)
5️⃣ 画質: 4k, highly detailed
これが基本的な型のようなものですね。
キーワードを羅列しているだけなのに、驚くほどそれっぽい猫魔法使いのイラストが出てきていますよね。
これを例えば文章で「猫が魔法使いになっていて杖が光っていて…」と長々と書いても良いのですが、カンマ区切りの方がベターです。

catをdogに変えただけでこんな画像を作れます。
構成をしっかり理解していれば、変更を加えたい場合も明確に指示出しができますよね。
もうひとつ例を見てみましょう。

1️⃣ 主題: retro futuristic city
2️⃣ スタイル: cyberpunk, neon lights, 1980s anime style
3️⃣ トーン: high contrast
これもやっていることは同じですね。
例えば主題の部分をretroからfutureに、cyberpunkをsteampunkに変えて上げるだけでも雰囲気が変わります。

上記のように、ある程度型があった方が、部分的な変更も楽なんですよね。
そういった意味でも、まずは基礎に習うことが重要だと思います。
よくあるプロンプトのNG例
色々な方から「Midjourneyでうまく画像が作れません…」という相談を受けるのですが、多くの人は
プロンプトがやたらと長い
という印象があります。
「指示はとにかく多い方がいい!プロンプトを盛り込もう!」と思い込んでいる人が、結構多いのではないでしょうか?
上手く作用していれば勿論良いですが、基本的にはMidjourneyにあれこれ大量に要素を詰め込みすぎると、AIが混乱します。
結果「何を重視すればいいのかわからない…」となるので、出力される絵も狙いとは異なるものができがちです。
まずは主題+スタイル+補足の3〜5個くらいのキーワードに絞り、その後調整するスタイルを試してみましょう。

主題: wolf warrior (狼の戦士)
補足: tribal armor (部族風の鎧), dark fantasy, gloomy atmosphere
例えばこのくらいシンプルでも、上記のようなクオリティの画像が作れます。
これ以上細かい要素を足しすぎると、AIが「狼なのか戦士なのか、どんな装飾品がどの部位に…?」と混乱しやすいので、まず最初の型を作りましょう。
好きなパーツをプロンプトに追加していくようにすると、学びながら狙った絵に近づけることができます。
否定形ではなく肯定形で書く
これも重要事項です。
そして、知らない人が実は多いと思います。
Midjourneyは「○○を描かないで」といった否定文をあまり上手に処理できません。
むしろそのように書いてしまうと、その要素が反映されがちです。
具体例を見ていきましょう。

noと書いているのに、思いっきり山が描かれてしまっています。
ai的には「あ、プロンプトに人間と文字と山の要素を見つけたぞ」と勝手に拾われて、画像にしてしまうんです。
一方で以下の画像をご覧ください。

こちらの画像には山などの要素はありませんね。
これはMidjourneyのルールにある書き方に沿っているからです。
不要なものはそもそも書かないか『--noパラメーター』で除外しましょう。
『--no item1, item2, item3, item4』
という書き方をすると、しっかりその要素を排除してくれます。
これは基礎的な構文ルールなので、覚えておいて損はないです。
数値を入れる・構図を指定する
「主人公が1人」「風景にビルが3棟」など、具体的な数値を入れるとMidjourneyが解釈しやすくなります。
構図に関しても「close-up」「wide shot」「bird’s-eye view」など視点を明記すると、狙いどおりの画面構成を得やすいです。

数: three female warriors
構図: standing in a row, full body, side view (3人が横に並んだ全身像、横向き)
雰囲気: dramatic lighting
動き・アクションの要素を加える
静止画でも「running」「jumping」「flying」などの動詞を入れると、アニメ的な躍動感が出やすくなります。

髪がなびき、動きのある絵になりやすいです。
最初のうちは棒立ちばかり作ってしまいがちですが、動きがあるだけでショート動画に組み込むときも映えますね。
まとめ:基本事項を押さえたら、試行錯誤のフェーズ
今回はMidjourneyのプロンプトの書き方を中心に、ショート動画にも活かせるテクニックやコツをお伝えしました。
基礎的な部分は、上記をしっかりみていただければ、それなりに網羅できるはずです。
次回のnoteは『理想の画像を作る方法やコツ』というテーマになります。
ぜひこちらも参考にしてみてください。
もし今回のnoteが参考になったという方がいれば「いいね」等していただけると励みになります。
ではまた別のnoteでお会いしましょう!
