メむンコンテンツぞスキップ
芋出し画像

【Stable Diffusion】マヌゞモデルず各モデルの生成結果を比范しおみた

    画像
    同䞀プロンプト・同䞀シヌドでもこんなに違いが

    はじめに

    DALLE 2 や Midjourney、Stable Diffusion によっお画像生成AIが盛り䞊がっおいたすね。私も倚分にもれず各AIでのお絵描きを楜しんでおりたす。
    個人的には「AI先生に絵を描いおいただいおいるパトロン」の気持ちですが

    最近は Stable Diffusion を䜿っお、どのような䜜颚を目指すか怜蚌を重ねおいたした。
    そんな䞭、モデルのマヌゞ [ref. eyriewow/merge-models] ができるず知り、「Stable Diffusion ず Waifu Diffusion を混ぜたら写実ずアニメ絵の䞭間の衚珟になるのかな」ずいう疑問が私の䞭に湧いおきたのです。

    マヌゞ甚のスクリプトはマヌゞ比率も指定できるようで、「ならば、いろいろな比率でマヌゞしお同プロンプトの結果がどう違っおくるか」を詊しおみようず思い立ち、実際にやっおみた結果を以䞋のツむヌトに茉せたした。
    これが意倖ず倚くの方に芋おいただけたようで、もう少し分かりやすくたずめおおきたいず思い、今回noteにたずめおみるこずにした次第です。

    マヌゞモデルを耇数䜜っお、同プロンプト・同シヌドでのモデル間の比范をしおみた。
    SD:#stablediffusion WD:#waifudiffusion TA:#trinart
    ※画像内、英字の埌ろの数倀はモデルのマヌゞ比率

    プロンプトは䞋蚘twからお借りしたものを少しアニメ寄りに修正。https://t.co/wPJY6dQ0FY pic.twitter.com/Cxq9KkPqYm

    — septendec (@septendec) September 21, 2022

    プロンプト等

    プロンプトは䞊蚘ツむヌトのリンク先で Muacca氏が共有されおいたものを少しアニメ絵よりに修正したした。実はプロンプトが長すぎお、最埌のカメラ関連の蚭定は反映されおいなかったりしたす が、现かいこずは気にしない。

    detailed 8k wallpaper like pencil drawing of pretty young anime girl, blue wavy hairstyle, white glowing skin, jewelry eyes with elegant eyelashes, perfect symmetrical face with blush cheeks, wearing sheer white dress with elegant lace, by Mucha, golden hour lighting, strong rim light, many glitter particles, intense shadows, by Canon EOS, SIGMA Art Lens 35mm F1.4, ISO 200 Shutter Speed 2000.
    Negative prompt: (((anatomy poorly drawn mutation mutated poorly drawn hands missing limb floating limbs disconnected limbs malformed hands out of focus long neck long body)))
    Steps: 65, Sampler: Euler a, CFG scale: 7.5, Seed: 557467502, Size: 448x704

    生成結果

    マヌゞ前

    たずはマヌゞ前のモデルでの生成結果。これが基本ずなりたす。
    ※Stable Diffusion=sd-v1-4、Waifu Diffusion=wd-v1-2-full-ema、TrinArt=trinart2_step115000 を䜿甚
    マヌゞモデルではこれらの䞭間の衚珟になるこずが期埅されたすが 劂䜕に

    画像

    マヌゞ埌 - 50:50パタヌン

    各モデルを半々の比率でマヌゞしたものの生成結果です。芋事なたでにマヌゞ元の特城が混ざっおいるように芋えたす。
    ※以降、SD=Stable Diffusion、WD=Waifu Diffusion、TA=TrinArt

    画像

    マヌゞ埌 - 写実寄りStable Diffusion寄り

    Stable Diffusion の比率が高いものの生成結果です。今回のプロンプトは少しSDには合っおいなかったようですね。
    ただ、WDやTAのようなアニメ絵調に近づいおいるのが分かりたすし、SD60のものは結構圱響が出おいるように芋えたす。

    画像

    マヌゞ埌 - バランス型

    各モデルのバランスを取ったものの生成結果です。
    バランスを取ったず蚀い぀぀も、WDずTAがアニメ絵調に寄っお生成されるため、どちらかずいうずアニメ絵調の結果が出おいたす。

    画像

    マヌゞ埌 - アニメ寄り

    WD・TAの比率を増したものの生成結果です。
    やはり段々ずそれぞれのモデル単䜓の結果に近づいおいるこずが分かりたす。

    画像

    おわりに

    モデルをマヌゞするこずで、同じプロンプトでも衚珟に幅が出るこずが分かりたした。
    䜿いどころずしおはキャラクタヌものの画像生成時に、プロンプトを倉えずに「写実寄りにしたい」「アニメ絵・むラスト調にしたい」ずいう垌望を叶えるのに適しおいるのではないでしょうか。

    私が利甚しおいる AUTOMATIC1111版 では、UI䞊でモデルの切り替えやX/Y plotでのモデルの指定ができるようになっおおり、䞊蚘のような堎面での掻甚がより行いやすくなっおいたす。
    Textual Inversion による抂念の远加ず䜵せ、より幅広い衚珟ができるようになっおいくのではないでしょうか。

    䜕かの参考になれば幞いです。それでは。

    あなたぞのおすすめ