メインコンテンツへスキップ
見出し画像

Midjourneyで遊んでみた:(Text To Image)

    1.概要

     2022年8月現在ではテキストから画像を生成するAIが話題になっており、それに伴い倫理感や作者の権利に関する話題などが活発化されております。

    テキストから画像を生成するAIが続々と登場している。DALL-E2、Imagen、Parti、Midjourney、stable diffusionなどが世界中で話題になったので,今後は参入人口が急拡大し、さらに多くのAIが登場し、クオリティがさらに高まり、同程度の質のモデルのコストが劇的に下がり、生成速度も桁違いに改善される

    — 小猫遊りょう(たかにゃし・りょう) (@jaguring1) August 15, 2022

     下記は別記事ですが、今回はMidjourneyで遊んでみました。

    2.確認事項

    2-1.事前対応1:Discardのアカウント作成

     Midjourneyはチャットサービスの「Discord」(slackやteamsみたいなアプリ)上で使用する必要があるためDiscardのアカウント作成を作成します。

    画像

    2-2.事前対応2:Midjourneyから招待をうける

     公式紹介のURLに入るとMidjourneyから招待を受けることが出来ますので「招待を受ける」ボタンを押しておきます。

    We're officially moving to open-beta! Join now at https://t.co/O1Qnl6hMgn. **Please read our directions carefully** or check out our detailed how-to guides here: https://t.co/R0ZpVsyz8a. Most importantly, have fun!

    — Midjourney (@midjourney) July 13, 2022
    画像

    2-3.無料回数の確認

      無料枠の場合は25回実施できます。なお

    画像

    2-4.Midjourneyのコンテンツフィルター

     追って

    3.Midjourney実演

     使用方法を紹介します。詳細は公式Docsをご確認ください。

    3-1.テキストの入力方法:/imagine

     ログインすると下図左の画面になりますので「NEWCOMER  ROOMS」から適当な部屋を選択します(下図はnewbies-2を選択)。
     部屋を選択するとチャットの下にテキストを入力する画面が出ます。

    画像

     次にテキストボックスに"/imagine"と入力して「space, tab, enter」キーのどれかを押すとPromptボックスが出現します。Promptボックス内に出力したいテキストを入力してEnterを押すと画像が生成されます。

    画像

    3-2.残使用回数の確認:/info

     使用回数の確認は”/info”と入力してEnterを2回押すと出力できます。

    画像

    3-3.出力結果の確認:受信ボックス

     チャットルームでは様々な人が投稿しているため数秒で自分のチャットが埋もれます。自分の出力を確認するには「右上の受信ボックス」、「言及」を選択することで結果が確認できます。

    画像

    3-4.画像の変更:高解像度化、同種作成

     重要事項として「本機能を使用すると1回分の使用としてカウント」されますのでご注意ください。

    画像

     画像を出力すると複数のボタンが選択でき各動作は下記の通りです。

    【ボタンの機能】
    ●U1~U4(Upscale):選択した位置にある画像を高解像度(1024x1024)で出力
    ●V1~V4(Variation):選択した位置にある画像の別種類を作成
    ●矢印ボタン:もう一度新しく4枚の画像を生成する

    画像

     Uボタン選択で得られた画像には更に別のオプションが付与されます。

    【ボタンの機能】
    ●Make Variations:上記Vボタンと同じ動作
    ●Upscale to Max:さらに解像度を拡大(1664x1664)
    ●Light Upscale Redo:細部を描き込まずに高解像度な画像を生成し直す

    画像

    3-5.結果の保存

     結果の保存は画像を選択(左クリック)して、その上から「右クリック」->「名前を付けて画像を保存」を選択すると保存できます。

    画像

    4.出力結果

     出力結果および入力テキストは下記の通りです。同じテキストで複数の出力があるのは3-4節にあるUやVボタンを押しまくったためです。

    • new world after any human has been gone

    • Blue world without any creatures

    new world after any human has been gone - @KIYO (fast)

    画像

    Blue world without any creatures - @KIYO (fast)

    画像

    Blue world without any creatures - @KIYO (fast)

    画像

    Blue world without any creatures - Upscaled by @KIYO (fast)

    画像

    Blue world without any creatures - Upscaled by @KIYO (fast)

    画像

    Blue world without any creatures - Upscaled by @KIYO (fast)

    画像

    https://s.mj.run/YlIWOnRJquA Blue world without any creatures - @KIYO (fast)

    画像

    Blue world without any creatures - Upscaled by @KIYO (fast)

    画像

    https://s.mj.run/k20vwSABW1k Blue world without any creatures - @KIYO (fast)

    画像
    画像

    https://s.mj.run/YlIWOnRJquA Blue world without any creatures - @KIYO (fast)

    画像

    Blue world without any creatures - Upscaled by @KIYO (fast)

    画像
    画像

    5.所感

     細かい所感はDALL-E2の記事に記載しておりますので、今回はDALLとの比較をコメントします。

     同じテキストを入力しても返ってくる画像は全く違うものであり、モデルの構造や学習させる内容で全く異なる出力が出るのは非常に面白いです。
     厨二病を患っている私からしたら「Blue world without any creatures 」で得られた画像は圧倒的にMidjourneyの方が好きでした。これが学習やモデルのせいなのか作成者のバイアス・好みがかかっているかはわかりませんが、このAIがどのように成長していくかは楽しみです。


    参考資料

    あとがき

     あとはstable diffusionだけ!

     


     
     

    KIYO

     
     
    普段は製造業で企画/開発/設計しております。記事はプログラミング・機械学習、IoT関係の記事をメインで作成し、なるべく1つの記事で知りたいことを網羅していきます。内容は学術的より実装・アウトプット(ほしくなるもの)を重視して作成しています。 面白そうな仕事があればやりたいです!

    あなたへのおすすめ