メインコンテンツへスキップ
見出し画像

Midjourney v7とRunway Gen-4による高品質な動画生成のワークフロー/最新モデルの組み合わせ - Blog 2025/04/05

    今週は、Runway Gen-4とMidjourney v7がリリースされ、慌ただしい日々でした(OpenAIの新しい画像生成モデルも今週でしたね)。1週間前は「MidjourneyとRunwayは冬眠中」などと言ってたのですが、両方とも最新モデルになってしまいました。
    今日は、この2つを組み合わせて検証動画を作ってみました。

    関連記事:


    検証動画はこちら。
    1週間前なら、KLING v1.6やGoogle Veo 2でしか生成できなかったレベルの動画が、Midjourney v7とRunway Gen-4で可能になりました。

    • 再生時間:30秒

    • 画像生成:Midjourney v7/動画生成:Runway Gen-4

    無制限プランがあるRunwayが、KLING v1.6やVeo 2並の表現力を持ったのは嬉しい。ドラマ生成で大幅なコストダウンが期待できそう。

    画像
    v7で生成した日本人の男性


    それでは、どのように作業を進めたのかメモしておきます。
    やり方は昨日と同じですが。

    作業開始。

    v7のドラフトモードでビジュアルイメージを探ります。
    指示を出しながら、Midjourneyにプロンプトを書かせて確認していきます。
    まさに、Midjourneyとのコラボレーションワークです。
    ※音声モードに切り替えて、音声でMidjourneyに指示した方が早いですね…

    プロンプト:

    Casual Y2K fashion. Short hair.

    画像
    Y2Kファッションのカジュアルな服装。ショートヘアー

    プロンプト:

    The background is white.

    画像
    背景は白

    プロンプト:

    Japanese.

    画像
    日本人

    プロンプト:

    She is holding a toy gun.

    画像
    おもちゃの拳銃を構えている

    プロンプト:

    She was wearing ski goggles.

    画像
    スキーゴーグルを着用

    プロンプト:

    The background is pink.

    画像
    背景はピンク色

    プロンプト:

    A large number of soap bubbles are floating in the air.

    画像
    大量のシャボン玉が浮遊している

    最終的にMidjourneyが生成したプロンプト:

    A Japanese person in casual Y2K fashion, short hair, vibrant colors, early 2000s style, trendy accessories, playful mood, holding a toy gun, wearing ski goggles, pink background, large number of soap bubbles floating in the air, dynamic and nostalgic atmosphere.

    ノーマルモードに切り替えます。
    Midjourneyが生成したプロンプトをベースにして、パラメータを付加し、自分の意図したイメージに近づけます。
    自分のパーソナライゼーションプロファイルを適用したら期待した結果になりました。やはり、自分好みのプロファイルが強いです(他人とのプロンプトの共有は難しくなりますが)。

    画像
    Midjourneyが生成したプロンプトをベースに仕上げ作業

    A Japanese person in casual Y2K fashion, short hair, vibrant colors, early 2000s style, trendy accessories, playful mood, holding a toy gun, wearing ski goggles, pink background, large number of soap bubbles floating in the air, dynamic and nostalgic atmosphere. --ar 4:3 --style raw --p --stylize 50 --v 7

    自分でプロンプトを書くより、詳細に指示して、Midjourneyに考えさせた方がイメージに近くなりますね。
    プロンプトの書き方を理解できても、私のように語彙力が乏しく専門用語、流行語の知識がない人は、適切なプロンプトを書けないので…


    Runway Gen-4に生成した画像をアップロードして、動画を生成します。

    画像
    Runway Gen-4

    プロンプト:

    She is shooting a toy gun. A large number of soap bubbles are spurting out of the muzzle.

    画像
    生成された動画

    AIが次の動きを予測できない場合は、プロンプトを調整しますが、不得意な動きならリファレンス画像を変更します。Midjourneyで数種類の画像を用意しますので、まずは適正なリファレンスかどうか検証した方が早い。

    一球入魂(完璧な画像を一つだけ用意して試行錯誤する行為)は、やめた方がよいです。AIモデルには得意・不得意がありますので。


    画像
    Midjourney v7 + Runway Gen-4(生成動画のスクリーンショット)


    更新日:2025年4月5日(土)/公開日:2025年4月5日(土)

     
     
    Je m'appelle Creative.Edge (je suis japonais). Je réalise des films indépendants en utilisant l'IA générative.