メインコンテンツへスキップ
見出し画像
Photo bygarakutax

画像・動画生成AIプロンプト設計テクニック集(2025年4月最新:自分用)

  • 割引あり

自分用メモです。

ツールごとに分け、以下の観点を含めて整理

  • プロンプトの基本構造とベストプラクティス

  • 特定のスタイル、構図、ライティング、色彩表現などを実現するテクニック

  • うまく受け入れられないプロンプトや制限、その回避方法

  • 各ツール特有のプロンプト構文、パラメータ、設定項目

  • 表現力を高めるためのアスペクト比や特殊タグの使い方

ChatGPTプロジェクトにそのまま突っ込める形式にしてもらった。

画像・動画生成AIプロンプト設計テクニック集(2025年4月最新)

本ガイドでは、Midjourney、Runway、Kling、Nijijourney(にじジャーニー)、Luma の各生成AIツールについて、画像・動画生成におけるプロンプト設計と表現テクニックを網羅的に解説します。ツールごとに以下の項目に沿って整理し、具体例やベストプラクティスを紹介します。

  • 1. ツールの概要(得意分野・主な用途)

  • 2. プロンプトの基本構造と書き方(画像・動画別の違い)

  • 3. よく使われる構文・タグ・パラメータの詳細解説

  • 4. 実現できる表現(スタイル・構図・光・質感・カメラ設定など)と指定方法

  • 5. 出力品質や応答性を高めるベストプラクティス

  • 6. 禁止ワード・制限・生成拒否されやすい表現と回避方法

  • 7. 上級テクニック(ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

  • 8. 他ツールとの違いや応用的な連携活用例

それぞれのツールについて、短い段落やリストを活用しながらポイントを整理します。必要に応じてスクリーンショットや参考リンクも交えて、**最新の情報(~2025年4月)**に基づくテクニックをわかりやすく解説します。


Midjourney(ミッドジャーニー)

1. ツールの概要(何が得意か、主な用途)

Midjourneyはディスコード経由で利用する高品質な画像生成AIサービスです。短いテキストから高度に芸術的・写真的な画像を生成でき、コンセプトアートの作成、イラストデザイン、写真風画像の生成など幅広い用途で使われています。実写風からイラスト風まで多彩なスタイルを得意とし、プロンプトに対する出力の美麗さ・クオリティの高さで定評があります。 (Legacy Features – Midjourney) (Legacy Features – Midjourney)

Midjourneyはバージョンアップを重ねており、2024年末にリリースされたVersion 6/6.1ではプロンプト理解力や画像の細部表現が一段と向上しました (Version – Midjourney) (Version 6.1)。例えば、V6.1では手や顔など人物の整合性向上、高解像な質感表現、新しい高品質アップスケーラーが導入され、「全体的にこれまで以上に美しい画像」を生成できるようになっています (Version 6.1) (Version 6.1)。最新モデルではテキスト文字を画像内に描く能力も改善され、引用符付きで単語を指定すれば看板などに文字列を描画することも可能になりました (Version 6.1)。

Midjourneyは手軽さと高品質を兼ね備えているため、プロのデザイナーから趣味のイラスト愛好家まで幅広いユーザーに利用されています。想像上の風景、キャラクターデザイン、商品コンセプトのビジュアル化など、「まず一枚のイメージを形にしたい」という場面で威力を発揮するツールです。

2. プロンプトの基本構造と書き方

Midjourneyでは、ディスコード上で「/imagine」コマンドに続けてプロンプト(テキスト描写)を入力すると画像が生成されます。基本構造は「描きたい対象やシーンの説明 + 希望するスタイル要素 + (必要に応じて)パラメータ指定」という形です (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。プロンプトは英語が推奨ですが、日本語で入力してもある程度の解釈はされます(精密な制御のため英語利用者が多いです)。

  • 主題の記述: まず**「何を描くか」**を明示します。例:a castle on a hill at sunset(夕日に照らされた丘の上の城)。

  • 詳細な描写: 次に見た目の形容を加えます。色彩や雰囲気、質感、環境などを具体的に述べます。例:surrounded by blooming cherry blossoms, golden hour lighting(満開の桜に囲まれ、ゴールデンアワーの光が差している)。

  • スタイルや技法: 画風やカメラ設定を追加して出力のテイストを指定します。例:cinematic, ultra-realistic, shallow depth of field(シネマティックで超現実的、浅い被写界深度) (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。

  • 追加パラメータ: フォーマット指定やモデル指定など特別なパラメータが必要なら、--パラメータ名 値の形式で追記します(詳細は後述)。

プロンプト例:

/imagine prompt: A castle on a hill at sunset, surrounded by blooming cherry blossoms, golden hour lighting, cinematic composition, ultra-realistic, 8K detail --ar 16:9 --stylize 750 --no people

上記の例では、「丘の上の城」という主題に対し、桜や夕日・シネマ風の描写を加え、アスペクト比16:9(--ar 16:9)や高い芸術性(stylize 750)を指定し、人を含めないようネガティブ指定(--no people)しています。Midjourneyはコンマ区切りや接続詞でキーワードを並列しても解釈可能ですが、文章として自然につなげても構いません。いずれにせよ簡潔かつ具体的に描写することがポイントです。

3. よく使われる構文・タグ・パラメータの詳細解説

Midjourneyには、出力を制御するための各種パラメータや記法が用意されています。プロンプト末尾に追加するこれらのオプションを使いこなすと、構図やスタイルの微調整が可能です (Legacy Features – Midjourney)。代表的なものをいくつか紹介します。

  • アスペクト比(--ar): 画像の縦横比を指定します。デフォルトは1:1正方形ですが、--ar 16:9(横長)や--ar 9:16(縦長)など自由に設定可能です (Legacy Features – Midjourney)。例:ポスター用途なら縦長、壁紙なら横長に指定。

  • スタイライズ(--stylize または --s): 美的な独自解釈の度合いを調整します (Stylize - Midjourney)。数値範囲0~1000で指定し、値が高いほどAIのアート的創造性が強く出ます (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。低いとプロンプト指示通り忠実に描写します。デフォルトは100ですが、例えば--s 0ならシンプルで平坦な描写、--s 1000なら細部まで装飾的で奥行きある絵になります (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。

  • 品質(--quality または --q): 画像生成にかける計算量を調整します。--q 2が高品質モードで、標準の--q 1より時間がかかりますがディテールが増します (Version – Midjourney) (Version 6.1)。逆に--q 0.5は粗めで高速。V6.1では--q 2指定でよりテクスチャ豊かな出力になるよう改良されました (Version 6.1)。

  • スタイル(--style): Midjourney独自の作風プリセットを指定します。例えばv5世代のNijiモデルでは--style cute(可愛らしい)、--style scenic(背景重視で叙情的)などがありました (Legacy Features – Midjourney)。V6では--style rawが用意されており、AIの美的補正を抑えて生のプロンプトに忠実な描写にするモードです (Version – Midjourney)(Discordでは--rawと同義)。

  • Chaos(--chaos): 構図のランダム性を設定します。0で安定、値を上げると予想外のアレンジが出やすくなります (Legacy Features – Midjourney)。例えば同じプロンプトで様々なバリエーションを見たい場合に--chaos 50などと指定します。

  • Seed(--seed): 乱数シード値を固定することで再現性を確保します (Legacy Features – Midjourney)。特定のシード値を指定すると、同じプロンプトから毎回ほぼ同じ構図の画像が得られます(微小な変化はあります)。アイデアの比較検証に便利です。

  • ネガティブプロンプト(--no): プロンプトに含めたくない要素を指定します。例えば--no textとすれば文字が入らない傾向になり、--no peopleで人物を除外できます。Midjourney独自の簡易なネガティブ指定で、Stable Diffusion系のような別欄はありませんが、**「○○を入れないで」**と明示できます (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。

  • 画像プロンプト(Image Prompt): テキストの代わりに画像URLを入力して参照させることも可能です (Version – Midjourney)。/imagineコマンドに画像リンクを貼り付け、その後にテキストで指示を加えると、画像の雰囲気や内容を反映した出力が得られます。**Image Weight(--iw)**で参照画像の影響度を調整することもできます (Version – Midjourney)。

これら以外にも、改行区切りで複数プロンプトを与えるマルチプロンプトや、一度のリクエストで複数のバリエーションを得るパーミュテーション機能など、上級者向けの構文もあります (Version – Midjourney) (Version – Midjourney)。基本的にはMidjourney公式ドキュメントのパラメータ一覧に載っているものはDiscordのプロンプトで指定可能です。まずはアスペクト比とスタイライズ値あたりから試し、徐々に他のパラメータも組み合わせてみると良いでしょう。

4. 実現できる表現と指定方法(スタイル・構図・光・質感・カメラ設定など)

Midjourneyは、ユーザーの指示次第で多彩な表現スタイルを実現できます。以下に具体例と指定のコツを挙げます。

  • 画風・アートスタイル: 油絵風、水彩画風、アニメ調、3DCG風など、様々な画風を再現可能です。プロンプトに**「in the style of ○○」や「○○風の」**と加えるだけでなく、著名な画家や作品名を入れてもそれらしいテイストになります(例: Van Gogh styleでゴッホ風タッチ)。ただし著作権やコミュニティガイドラインに触れる特定のキャラクター名などは避けましょう。Nijiモデルを使う場合は後述のようにアニメ絵に特化したスタイルになります。

  • 構図・視点: カメラアングルやレンズ効果を言葉で指定できます。例としてfrom a low angle(ローアングルから)、bird’s-eye view(俯瞰視点)、close-up portrait(接写ポートレート)などです (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。さらに35mm photographやfisheye lensなど具体的なレンズ名・写真用語を入れるとそれらしいパースやボケ感が出ます。

  • 光と雰囲気: ライティングは画作りの重要要素です。cinematic lighting(映画のような照明), soft diffused light(柔らかく拡散した光), golden hour(日の出/日の入り時の黄金色の光)などを盛り込んで雰囲気を調整します。暗いシーンならdramatic shadows(劇的な影)やvolumetric lighting(光芒が見える表現)も有効です。

  • 質感・ディテール: intricate details(緻密なディテール), ultra-detailed, 8K texture, realistic skin textureのようなフレーズで質感の精細さを要求できます。V6世代では質感表現がさらに強化されており、小さな模様や素材感もより精細に描写できます (Version 6.1)。例えば金属質ならbrushed metal surface、ファンタジーならethereal glowなど対象に応じた言葉を選ぶと良いでしょう。

  • カラー・トーン: 色調もプロンプトで誘導できます。vibrant colors(鮮やかな色彩), pastel tones(パステルトーン), monochrome palette(モノクロ)等々。さらにanalog film photoや80s retro colorsのように時代や媒体を示すと、それっぽい色味やノイズが再現されます。

以上のような要素を組み合わせれば、「サイバーパンク風」「中世ファンタジー調」「スタジオ撮影のポートレート」など自由自在な表現が可能です。Midjourneyは基本モデル自体が非常に多様な美的スタイルを内包しており、プロンプトで方向付けすれば大抵の絵柄に対応してくれます。特に映画のワンシーンのような構図やフォトリアルな質感は得意領域で、カメラ用語や環境描写を丁寧に入れることで驚くほどリアルな情景が得られます。

5. 出力品質や応答性を高めるベストプラクティス

Midjourneyで満足いく結果を得るためのコツやベストプラクティスをまとめます。

  • 具体的かつ簡潔なプロンプト: 漠然とした指示よりも、具体的な情景描写を心がけます。ただし長すぎる文章も望ましくありません。要点となるキーワードを並べ、重要な特徴(例: 色、時間帯、スタイル)を盛り込んだ1~2文程度が理想です。あれもこれもと詰め込みすぎると焦点が定まらず、逆に極端に短いと解釈が曖昧になります。適度な情報量で明確に指示しましょう。

  • プレビューとリトライ: Midjourneyは同じプロンプトでも複数バリエーションを返してくれます。まず生成された4候補を見比べ、気に入ったものをアップスケール(詳細化)したり、もう一度リトライしてみましょう。一度で完璧な結果が得られなくても、段階的に詰めることで理想像に近づけます。試行錯誤の過程で気づいた点はプロンプトに反映していきます。

  • 段階的な詳細追加: シンプルなプロンプトから開始し、徐々に詳細を増やす方法も有効です (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。例えば最初は「a dog」程度でプレビューし、次に「a brown Labrador dog sitting on a porch」のように具体化します (Gen-2 - Prompting for Text to Video | Runway Academy)。さらに「golden hour lighting, 35mm photo」とスタイル要素を加える、といった具合に少しずつ洗練させていきます。一気に長文を書くより、変更点の効果を確認しながら調整できるメリットがあります。

  • パラメータの活用: 前述した各種パラメータも活用しましょう。特に--stylizeでAIの創造性を調節するのは有用です。「思い通りにならない」と感じたら一度--stylize 0付与で忠実モードにしてみる、逆に**「凡庸すぎる」ときは--stylizeを上げる**といった使い分けができます。また--seed固定で微修正したり、--uplight(ライトアップスケーラ)と--upbeta(ベータ版アップスケーラ)の違いを試すことで、微妙な画質調整も可能です。最新V6.1ではデフォルトで新アップスケーラになっています (Version 6.1)。

  • Personalization機能の活用: 2024年から導入されたパーソナライゼーションでは、自分の好みの画像にMidjourney上で評価を付けることで、出力傾向を個人最適化できます (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。特にWeb版では「Rank Image Aesthetics」で好みの作風を学習させることが可能です (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。これを行うと自分の好みに近いテイストで画像が出やすくなるため、頻繁に使うなら設定しておくと良いでしょう。

さらに、Midjourney公式サイトのギャラリーやコミュニティも積極的に活用しましょう。他のユーザーが公開しているプロンプト例は貴重な学習リソースです。気に入った作品のプロンプトを参考に、自分の表現したい内容に合わせてアレンジしてみることで、プロンプト設計の引き出しが増えます。

6. 禁止ワード・制限・生成拒否されやすい表現とその回避方法

Midjourneyにはコミュニティガイドラインが定められており、暴力的・卑猥なコンテンツや公序良俗に反する指示は強く制限されています。具体的には、以下のような内容はプロンプトの段階でブロックされたり、意図的に生成が歪められたりします (Community Guidelines – Midjourney) (Community Guidelines – Midjourney)。

  • ゴア表現(流血や残虐描写): 血液、切断された四肢、死体の損壊など極度に暴力的・グロテスクな要素は厳禁です (Community Guidelines – Midjourney)。「血まみれ」「内臓」「残虐な殺傷シーン」といった単語はブロック対象になります (The Complete List of Banned Words In Midjourney (Updated))。ホラー表現をしたい場合でも、直接的な流血描写は避け、暗示的な表現(例えば「赤い液体」など婉曲な語)に留める必要があります。

  • 性的・わいせつな内容: 全裸や性的行為の描写、フェチ的な要素も禁止されています (Community Guidelines – Midjourney)。特に未成年に関する性的な想像は厳禁で、検出されれば即座に拒否されます (Community Guidelines – Midjourney)。プロンプト中の露骨な性的キーワード(性的器官の直接名など)は通りません。セクシーな雰囲気を出したい場合でも、直接的表現を避け「官能的な」程度の婉曲表現に留め、それ以上は求めないようにしましょう。

  • 差別的・攻撃的表現: 人種差別用語、ヘイトスピーチ、公序良俗に反する罵りや侮辱も禁止です (Community Guidelines – Midjourney)。特定の人種や宗教を貶めるような内容はもちろん、暴力を煽動する政治的プロパガンダの生成も許されません (Community Guidelines – Midjourney)。

  • 実在の人物: 有名人や政治家など実在人物の画像生成は、ハラスメントやデマ拡散に繋がる恐れがあるため規約で制限されています (Community Guidelines – Midjourney)。特に本人を中傷・風刺するような利用は禁止です。公共の場で誰でも閲覧できるコミュニティでは、実在人物の肖像生成は避けましょう。

  • その他拒否されやすい語: 薬物関連(違法ドラッグ名など)、過激な暴言、テロや犯罪を示唆するような単語も赤旗となります。またMidjourneyでは色名の“black”ですら文脈次第でNGとなるケースが報告されています (Banned word : r/midjourney - Reddit)(「Black person」が薬物スラングと誤判定された等)。紛らわしい単語の使用にも注意が必要です。

回避方法: 基本的にMidjourneyのルールに抵触する表現は避けるべきですが、意図せず禁止ワードに触れてしまう場合があります。その際は言い換えが有効です (Full Banned Words List in Midjourney Prompts - AI Fire) (Key Phrases to Avoid When Using Midjourney | by Muhammad Zikri)。例えば「血」を暗示したいなら「赤い液体」「血痕ではなく暗い染み」といった表現にする、性的でも下品にならない言葉遣いにとどめる、などです。ただし運営の意図としては安全なコンテンツのみ生成させる方針ですので、無理にフィルタを回避するのは推奨されません。

万一プロンプト投入時にエラーやブロックメッセージが出た場合、そのプロンプトにはNG要素が含まれているということです。該当語を削除するか別表現に替えて再度試しましょう。コンテンツフィルタを迂回しようと故意にスペルを変える等の行為は利用規約違反となり得るので注意が必要です (Community Guidelines – Midjourney)。健全な創作の範囲内で工夫するようにしてください。

7. 上級テクニック(ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

Midjourneyは基本的にプロンプト設計のみで出力を操作しますが、いくつか上級者向けのテクニックがあります。

  • ネガティブプロンプトの工夫: 先述の--noパラメータによるネガティブ指定はシンプルですが強力です。不要要素を明示する他、「不要な傾向を抑える単語」も入れてみましょう。例えばリアル人物を描く際に不安なら--no text, watermark, signature(文字や透かしを除外)を加えると、画像内に余計な文字列が出にくくなります。また風景画で人物が紛れ込むのを避けたいなら--no people, --no humansと複数指定も可能です(スペースで区切り連続指定できます)。

  • 反復による重み付け: Midjourneyでは同じ単語を繰り返すと重要度が上がるとされています。例えば「very very detailed」などとすると多少詳細さの強調になるという報告があります。ただし不自然なプロンプトになる場合もあるので多用は禁物です。代わりに**重み値(Weighted Prompt)**を使う方法もあります。キーワードの後に「::重み値」を付けることで、その語句への比重を調整できます。例:a portrait of a lion::2 elegant background::0.5(ライオンの肖像を強調し、背景は控えめに)といった具合です。重み値は標準が1で、それ以上なら強調、0~1なら抑制となります。

  • リミックス(Remix): Midjourneyには生成済み画像に手を加えて再生成するRemix機能があります。Variation(変化)を作る際にプロンプトを編集できる機能で、Discordの/settingsでRemixを有効にすると利用可能です。これを使えば、一度出た画像に対してプロンプト文を微調整し、構図は活かしつつ要素を足したり引いたりできます。段階的に画像を育てるイメージで、非常に便利なテクニックです。

  • /describeコマンドの活用: 画像をMidjourneyに分析させてプロンプトを自動生成する/describeコマンドも上級者には有用です。手持ちの参考画像を与えると、それを説明する4種類のプロンプト案が返ってきます。これを叩き台にプロンプトを組み立てたり、自分のイメージに近い例を探すことができます。言わば逆引きプロンプト機能で、自分では思いつかなかった表現キーワードが得られることもあります。

  • 他モデルとの比較とLoRA的制御: Midjourney自体はユーザーが学習カスタマイズ(LoRAやDreamBoothのような微調整モデル適用)を行うことはできません。しかし、MidjourneyにはNijiモデルなど別モデルへの切替オプションがあります(後述)し、またOpenAIのDALLEやStable Diffusion系といった他の生成AIを補完的に使うという手もあります。例えば特定のキャラクターの顔を忠実に描きたい場合、Midjourneyでは微調整ができないためStable Diffusion+LoRAで顔を生成し、それを画像プロンプトにMidjourneyへ与えて雰囲気を補完するといった応用も可能です。

以上のように、Midjourney単体でも高度な使いこなしができますが、必要に応じて補助AIツールやプロンプトエンジニアリングを駆使することで、より思い通りの結果に近づけることができます。

8. 他ツールとの違いや応用的な連携活用例

Midjourneyは静止画生成に特化したサービスであり、同じ画像系のStable DiffusionやDALL-Eと比べて手軽さと画質に優れています。一方で動画生成機能はありません。そこで、他のツールと組み合わせることで新たな表現の幅が生まれます。

まとめ: Midjourneyはまず高品質な静止画生成を担い、その出力をもとに他のAIツールで動きを与えたり別媒体に展開するのが効果的です。それぞれのツールの強み(Midjourneyの静止画クオリティ、RunwayやKlingの動画化、Lumaのリアル映像レンダリングなど)を活かし、組み合わせることで創作の幅が飛躍的に広がります。


Runway Gen-2(ランウェイ)

1. ツールの概要(何が得意か、主な用途)

RunwayはAI動画生成の分野で先駆的なプラットフォームであり、特に2023年に公開されたGen-2モデルによってテキストや画像から直接動画を生成することを実現しました (The Complete Guide To Runway Gen-2 AI Video Tool)。Runway自体はWeb上で動作する統合クリエイティブツールで、画像生成AI(Stable Diffusion系)や動画編集機能も含まれていますが、目玉は数秒程度の短い映像クリップをAIで生成できる点です (The Complete Guide To Runway Gen-2 AI Video Tool)。

Runway Gen-2は「If you can imagine it, you can generate it(想像できるものは何でも生成できる)」をモットーに掲げ、文章で書いた情景をそのまま動画化するような使い方を想定しています (The Complete Guide To Runway Gen-2 AI Video Tool)。たとえば「夕暮れの森を駆け抜ける白い馬」のようなプロンプトから、そのシーンの数秒間の動画を生成できます。クリエイターや映像作家がストーリーボードの作成や、映像のイメージ確認に使うケースが増えており、アイデア段階のプロトタイピングに強いツールと言えます。

Gen-2は様々な入力モードを備えており、テキストだけでなく画像や映像を入力に利用できるのも特徴です (The Complete Guide To Runway Gen-2 AI Video Tool) (The Complete Guide To Runway Gen-2 AI Video Tool)。またRunwayは生成だけでなく、結果をタイムラインに並べて編集したり、他のエフェクトAIと組み合わせたりと制作全般を完結できるプラットフォームになっています (The Complete Guide To Runway Gen-2 AI Video Tool) (The Complete Guide To Runway Gen-2 AI Video Tool)。商用利用も可能で、生成した動画の権利はユーザーに帰属するため安心して作品に組み込めます (The Complete Guide To Runway Gen-2 AI Video Tool) (The Complete Guide To Runway Gen-2 AI Video Tool)。

主な用途としては、ミュージックビデオの一部シーン制作、広告やSNS向けの短編映像、映画やアニメのコンセプトムービー作成、アート作品としての実験映像などが挙げられます。特に実写と架空の融合や抽象的な表現が得意で、文章では表現しにくいイメージを映像化することで新たなインスピレーションを得る用途に適しています。

2. プロンプトの基本構造と書き方(テキスト・画像モードの違い)

Runway Gen-2では、テキストプロンプトを入力して動画生成を行う場合と、画像を入力してそれを動かす場合で若干アプローチが異なります。ただ基本的な考え方はMidjourney同様、「何を・どういう風に」を言語で的確に伝えることです。

**テキストから動画(Text to Video)**の場合:

上記の例では、「夜明けの霧の森を駆ける白馬」という内容に、シネマ風照明やハイスピード撮影の描写を加えています。このように映画のシーンを文章化する感覚で書くとよいでしょう (Text-to-Video: How to Write Prompts in Runway | by Rob Young | The Neuralist | Medium)。

**画像+テキストから動画(Image to Video / Text+Image)**の場合:

プロンプト例(画像+テキスト):
1枚の海岸の写真を入力し、テキストにwaves gently lapping the shore, sunset light reflecting on water(波が岸に穏やかに打ち寄せ、夕日の光が水面に反射している)と記述すると、静止画の海岸が夕焼けの雰囲気のまま波打ち際だけ動くような動画が得られます。

注意: Runwayのプロンプトも基本は英語が想定されています。日本語UIや入力自体は可能ですが、生成AIの内部モデルは英語訓練のため、複雑な指示は英語で書く方が正確です。また映像の場合時間軸の表現(例えば「徐々に近づく」「最後にカメラがパンする」等)は現時点で細かく制御しづらいです。あくまで「こういう光景が見える動画」という静止画的発想でプロンプトを作成し、細かな動きはツール側に任せる形になります。

3. よく使われる構文・タグ・パラメータの詳細解説

Runway Gen-2自体はMidjourneyのように明示的な「--パラメータ」をプロンプトに追加する形式ではありません。しかし、プロンプト内で利用すると効果的なキーワードや、UI上で選択できるオプションがいくつか存在します。それらを活用することで出力映像のスタイルをコントロールできます。

  • スタイルプリセット: Gen-2のプロンプト入力欄の下部にはスタイルプリセットが用意されています (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。例えば「cinematic」「8mm film」「sketch」などボタン一つで追加でき、プロンプト末尾に付加されます。手軽に特定の質感を付与できるので、目的に合うものがあれば使ってみましょう(自分で同様の単語を入力してもOKです)。

  • カメラショットや画角: テキスト内で撮影手法を指定すると映像に反映されます (Gen-2 - Prompting for Text to Video | Runway Academy)。例:an extreme close-up(極端な接写), wide angle shot(広角ショット), POV perspective(主観視点)など。映像らしい表現が欲しい場合、これらカメラ用語を取り入れると雰囲気が出ます。

  • 質感・フィルムの種類: Runwayは質感面でも多様な生成が可能です。old VHS style(古いVHS風)やwatercolor animation(水彩アニメ風)のように媒体や画材を入れると、映像全体にそのテイストがかります。またsmooth textureやgrainy filmと書くことで、滑らかさや粒状感をコントロールできます (Gen-2 - Prompting for Text to Video | Runway Academy)。

  • 時間・動作に関する語: 映像では動詞表現も重要です。例えばslowly rising(ゆっくり上昇する), swaying in the wind(風に揺れている)といったフレーズを入れると、その動きが起きている動画になる可能性が高まります。ただし長い物語的記述は苦手なので、一つのクリップで表現したい主たるアクションを1つに絞って述べるのがコツです。

  • ネガティブなニュアンス: Runwayには直接的なネガティブプロンプト欄はありませんが、プロンプト内で「without ○○」のように書くことで多少は反映される場合があります。またblank background(背景を空っぽに)など望む結果を間接的に指定する方法もあります。ただ全体的にMidjourneyほど細かなネガティブ制御は難しいため、不要要素が出た場合は再生成するほうが早いことも多いです。

  • 高度な設定項目: Runway Gen-2にはUI上で調整できるAdvanced Settingsもあります。例えばSeed値の固定やアップスケーリング、**補間フレーム挿入(Interpolation)**などです (The Complete Guide To Runway Gen-2 AI Video Tool)。これらは生成後の編集工程に影響する設定で、シード固定は同じプロンプトでブレない結果を得るのに役立ち、補間は映像を滑らかにするためにフレームを自動生成してくれます。

また、Runway Gen-2には8つのモードが存在することにも留意しましょう (The Complete Guide To Runway Gen-2 AI Video Tool)(基本的にはUI上で選択)。主なものは以下の通りです (The Complete Guide To Runway Gen-2 AI Video Tool) (The Complete Guide To Runway Gen-2 AI Video Tool)。

  • Mode 01: Text to Video – テキストから直接動画を生成

  • Mode 02: Text + Image to Video – テキストと1枚の画像を組み合わせて動画生成

  • Mode 03: Image to Video – 画像一枚を動かして動画化(テキストなしでも可)

  • Mode 04: Stylization – 既存動画にテキスト/画像でスタイル付与(Gen-1に近い機能)

  • Mode 05: Storyboard – ラフなモックアップ画像を連続したアニメーション動画にレンダリング

  • Mode 06: Mask – 入力動画中の特定物体をマスクしてテキストで変化させる編集

  • Mode 07: Render – マテリアルなしの3Dレンダーに質感を与える用途

  • Mode 08: Customization – ユーザーがモデルを微調整(ファインチューニング)する高度機能

一般的な動画生成はMode 01〜03を使います。それ以外は映像編集的な機能で、例えばStoryboardは連続するプロンプト画像をAIが補完して動画化するもので、MaskやRenderは既存映像を加工するツールです。Customizeは限定的なα機能で、自分専用のモデルを訓練できる可能性を示唆しています (The Complete Guide To Runway Gen-2 AI Video Tool)(2025年4月時点では一部ユーザ向けか研究段階と思われます)。

4. 実現できる表現と指定方法(スタイル、構図、光、質感、カメラ設定など)

Runway Gen-2で生成できる映像表現は、一枚絵に動きが付くことでさらに多彩になります。指定方法と併せて主な表現の例を紹介します。

  • 映画風シーン: 最も得意なのは「映画のワンシーン」のような表現です。シネマティックな照明(cinematic lighting)、特定の撮影手法(aerial drone shotなど)を指定することで、ハリウッド映画のB-rollのような映像が得られます (Text-to-Video: How to Write Prompts in Runway | by Rob Young | The Neuralist | Medium) (Gen-2 - Prompting for Text to Video | Runway Academy)。例えば「荒野を行く車」をa lone car driving through a desert highway, filmed from a helicopter, golden hour sunとすれば、夕日に照らされた荒野をヘリから捉えた映像が生成されます。

  • アニメーション・手描き風: Gen-2は実写風だけでなくアニメ調や手描き風にも対応可能です。プロンプトに2D animationやStudio Ghibli style等と入れると、色彩や線画調が変わります。またstop-motion clay animation(ストップモーションクレイアニメ風)のように、質感を変えることでユニークな映像も作れます。ポイントは具体的な作品名や技法名を出すことです。映像モデルはそれらのスタイルを学習しているため、かなり忠実に似せてきます。

  • 幻想的・超現実的表現: Runwayは抽象的な表現も比較的得意です。dreamlike(夢のような), surreal landscape(シュールな風景)などのキーワードや、サルバドール・ダリのような画家名を入れてみると、静止画AIでは得難い動きのある超現実シーンが生成できます。例えば「空に浮かぶ島々がゆっくり回転する様子」など、静止画では伝わりづらい不思議な動きを直接指定できるのが強みです。

  • 質感と素材感: Runwayの映像はノイズやブラーなど質感表現に現れるAI的ゆらぎが特徴でもありますが、逆にそれを活かしてvaporwave aesthetic(ヴェイパーウェーブ的美学), glitch art style(グリッチアート風)といった指定も面白い効果を出せます。映像全体に独特の色ずれやノスタルジックな質感が付与され、アートビデオ的な仕上がりになります。

  • 音の無い映像: 生成結果には音声は含まれません。あくまで無音の動画クリップです。必要に応じて後から音楽や効果音を付ける想定で使います。Runway自体に音声生成機能はありませんが、外部の音響AIや素材を合わせることで、一層説得力のあるコンテンツに仕上げられるでしょう。

指定方法としては、Midjourneyと同様に上記の要素をテキストに盛り込めばOKです。ただし実際の映像として矛盾がないよう注意しましょう。例えばextreme close-up of a face, wide angle shotのように同時に成立しない指定は避けます。また動画の長さはGen-2では数秒(標準4秒前後)なので、一度に表現できる内容は限られます。欲張らず1ショットで映える情景を切り取る発想でプロンプトを作ると良い結果が得られます。

5. 出力品質や応答性を高めるベストプラクティス

Gen-2で高品質な動画を得るためのコツ、そして効率よく作業するためのポイントを紹介します。

  • 短く焦点を絞ったプロンプト: 動画生成の場合、静止画以上にプロンプトの簡潔さが重要です。長々と書くとモデルが理解できずチグハグな結果になることが多いため、「一場面の情景描写+スタイル」が1文、多くても2文程度に留めましょう (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)。例えば前述の「白馬が森を駆ける」シーンなら、それ以上余計なストーリー(騎手や目的など)は書かず情景に徹します。物語を語るというよりは、「カメラが捉えた数秒の映像」を記述するイメージです。

  • プレビューと再生成: Runway Gen-2はプレビュー機能があります (Gen-2 - Prompting for Text to Video | Runway Academy)。非常にシンプルなプロンプトでまずプレビューし、だいたい狙った雰囲気か掴んでから詳細化するのも良いでしょう。また、生成結果にはランダム性があるので、何度か再生成して比較することも大切です。同じプロンプトでも微妙に異なる映像が出ますから、その中から気に入ったものを選べます。思ったものと違えばプロンプトを修正して再トライしましょう。

  • 時間とコストに注意: 高品質な映像生成にはそれなりの時間と計算資源を要します。Runwayは有料クレジット制で、デフォルト設定の数秒動画でも生成に数十秒~数分を要します (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。プロンプトが長文になると5~6分以上かかる例も報告されています (無料で使える動画生成AI「Dream Machine」ってなに?実際に使いながら詳しく解説します! | 株式会社LIG(リグ)|DX支援・システム開発・Web制作)。そのため、試行錯誤する際は荒削りな設定で素早くアウトプットを見て、最終出力だけ高品質にするようメリハリをつけると良いです。具体的には、短いプロンプト+低解像度でアイデア検証し、OKであればアップスケールをONにして再生成する、といった流れです (The Complete Guide To Runway Gen-2 AI Video Tool)。

  • シード固定とバリエーション: 毎回結果が変わるのを避けたい場合、Seed値を固定できます (The Complete Guide To Runway Gen-2 AI Video Tool)。また生成したクリップに若干のバリエーションを出した別テイクを作りたい場合は、シードを変えて再度生成するとよいでしょう。同じ設定でシード違いの出力を複数用意し、ベストを選ぶこともできます。Runwayは標準ではランダムシードですが、設定で指定可能です。

  • エディタ機能の活用: Runwayには結果をそのまま編集できる動画エディタが内蔵されています (The Complete Guide To Runway Gen-2 AI Video Tool)。複数クリップを繋いだり、必要な部分だけ切り出すのも簡単です。AI生成結果は往々にして不要なシーンや瞬間が含まれることもあるため、エディタでトリミングして繋ぐことでテンポの良い映像に仕上げられます。また、Gen-2のクリップに対してさらに**他のエフェクトAI(背景除去、色補正など)**を適用することもワンクリックで可能です。総合的に活用してブラッシュアップしましょう。

さらに、コミュニティから学ぶことも大切です。他のユーザーがRunwayで作成した作品や共有しているプロンプトを参考にすることで、新たな発想や技術を得られます。公式のRunway AcademyやMediumの記事では、具体的なプロンプトのテクニックやユースケースが紹介されています (Gen-2 - Prompting for Text to Video | Runway Academy) (Gen-2 - Prompting for Text to Video | Runway Academy)ので、一度目を通してみるのもおすすめです。

6. 禁止ワード・制限・生成拒否されやすい表現とその回避方法

Runway Gen-2も他のAIサービス同様、安全性と倫理に配慮したコンテンツガイドラインがあります。Midjourneyほど詳細な公開情報はありませんが、基本的には暴力・性的・差別的な表現は避けるべきです。また、動画である分、実在人物のフェイク映像(ディープフェイク)などは厳しく禁じられている可能性があります。

  • 暴力・流血: 人物が傷つくような過激な暴力シーンや血まみれの映像は生成されにくく、最悪プロンプト拒否されるでしょう。フィルタにかからなくても、AIが忖度してぼかした表現になる場合が多いです。ホラー風景を生成する場合も、過剰な流血語は避けることを推奨します。

  • エロティック・わいせつ: ヌードや性的表現も厳しく制限されます。特に動画だと露骨さが増すためか、かなり早い段階でフィルタリングされるでしょう。露出の少ない浪漫的な表現に留め、直接的な性描写は行わないのが無難です。

  • 差別・ヘイト: これも当然禁止です。人種や属性を蔑視するような単語はプロンプトに入れないようにします。

  • 誤情報や著名人: 実在の有名人を登場させるプロンプト(例:「米大統領が○○している映像」)なども、ディープフェイク抑止の観点からNGとなるはずです。Runwayは研究者やクリエイター向けのツールですが、社会悪用は厳に慎むよう求められています。政治的扇動やフェイクニュース目的の映像生成は規約違反となるでしょう。

  • 商標・キャラクター: 有名キャラクターや商標物も著作権の問題で明示的には避けるべきです。これらをプロンプトに入れると生成がブロックされるか、無関係な結果になる可能性があります。

回避と対処: 基本的にRunway側で不適切と判断されるとエラーが出るか、または単に望まない抽象映像に置き換えられます。Midjourney同様、別の言い回しで遠回しに表現する手はありますが、フィルタを欺くような行為は推奨されません。どうしても意図するシーンがセンシティブに絡む場合、事後処理で表現するのも一つです。例えば出力映像をダウンロード後、別ツールで加工して血糊を加えるなど、人間側で責任を持って演出する方法です。いずれにせよ、Runwayはプロな現場利用も想定しているためコンプライアンス遵守が大前提です。疑わしいラインのテーマは避け、安全な範囲で創意工夫しましょう。

7. 上級テクニック(ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

Runway Gen-2では、Midjourneyほど細かなプロンプト操作は提供されていませんが、映像生成特有の上級テクニックがあります。

  • キーフレームによるストーリー表現: Storyboardモードを活用し、複数のキーフレーム画像を用意してそれらを繋ぐ手法です。例えば漫画のコマ割りのように重要シーンの画像をMidjourney等で作り、それらを順にGen-2に与えることで所定の順序で場面転換する動画が得られます (The Complete Guide To Runway Gen-2 AI Video Tool)。これにより、単発のシーンだけでなく簡易な物語展開をAIで補完できます。上級者はシーン毎にプロンプトを工夫し、クリップを複数生成してから動画エディタ上で切り替えていくことで、より長尺の映像作品を作っています。

  • モーションブラシ: Gen-2の機能ではないですが、類似の手法としてモーションブラシがあります。例えばKlingでは画像内の要素に動きの軌道を手描き指定できる機能が登場しています (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。Runwayではまだ実装されていませんが、今後手動でモーションを指定できる機能(テキストではなくブラシやキーフレーム指定)は研究されています。現時点でできることとしては、入力画像を工夫することです。動かしたいものとそうでないものをはっきり分けた画像を用意すると、AIは動きと静止部分を判別しやすくなります。

  • 外部ツールとの組み合わせ: Gen-2の弱点を補うために、Stable DiffusionのControlNetなど外部技術と組み合わせる例もあります。例えば、Gen-2で得た動画の各フレームを抽出し、Stable Diffusionのimg2imgで画質向上・ノイズ低減する、といった方法です。これらを自動化すればGen-2の連続性とSDの静止画精度を両立できます。高度なユーザは独自スクリプトでフレーム単位に補正をかけたりしています。Runway自体も研究版のGen-3などで動画の長尺化・高解像化を進めていますが、現状ではマニュアルな工夫でクオリティアップする余地があります。

  • ファインチューニング(将来的なLoRA類似機能): 前述のモード08 “Customization” はユーザー自身がモデルを調整する可能性を示しています (The Complete Guide To Runway Gen-2 AI Video Tool)。2025年4月現在一般には開放されていませんが、これはまさにLoRA的なカスタムモデルをRunway上で扱えるようにする構想です。将来的に自分の描きたいキャラやアートスタイルを数枚の画像から学習させ、Gen-2で動かすこともできるようになるかもしれません。その際には、学習した固有スタイルをプロンプトで呼び出す高度なテクニック(例えば「」のようなトークンを使う)が必要になるでしょう。

現時点でGen-2を極めるには、映像制作の知見とAIの癖理解の両方が求められます。映像文法(カット割りやカメラワーク)を知り、それをいかにテキストで表現するかというスキルです。また結果のブレを許容しつつ良い部分を採用する取捨選択も重要です。上級者ほど「AIに任せる部分」と「自分でコントロールする部分」を切り分け、創造性と制御性のバランスを取っています。

8. 他ツールとの違いや応用的な連携活用例

Runway Gen-2は動画生成ツールの中でも使いやすさと多機能さで際立っています。他のツールとの比較、および組み合わせ活用例を見てみましょう。

総じて、Runwayはクリエイティブ制作のハブとなり得る存在です。単体でも強力ですが、他ツールと連動させることでその価値は倍増します。得意領域を理解し、適材適所で使い分けながら、創作の可能性を広げていきましょう。


Kling(クリング)

1. ツールの概要(何が得意か、主な用途)

Kling AIは中国の動画プラットフォーム企業「快手(Kuaishou)」が開発した最先端のテキスト to ビデオ生成AIです (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。2024年に登場し、英語のテキストや画像から高品質な短編動画を自動生成できるサービスとして注目を集めています (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。最大の特徴は、リアルな人物を含む映像を比較的安定して生成できる点で、「最強の動画生成AI」と評されることもあります (Kling AI徹底解説:リアルな人物が作れる最強動画生成AI|ChatGPT研究所)。最新バージョンのKling AI 1.6では、1080pフルHD解像度・最大10秒間の動画を生成可能となっています (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン) (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。

Klingはウェブブラウザから利用でき、メールアドレス登録のみで日本からでも無料で使用できます (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。初回登録時にクレジット(ポイント)が付与され、動画生成ごとに消費する仕組みです (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。例えば5秒動画ならモデル1.0で10ポイント、高品質モデル1.5では20ポイント消費といった具合です (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。無料ユーザーでも月毎にクレジットがリフレッシュされるため、ある程度継続利用も可能です (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。

得意分野としては、実写風の人物・風景動画が挙げられます。Klingは3D時空間的な注意メカニズムにより、生成中の各フレーム間の整合性を保つよう工夫されており、特に人の顔や体の崩れが少ないとされています (Kling AI徹底解説:リアルな人物が作れる最強動画生成AI|ChatGPT研究所)。そのため、モデル撮影のような人物映像、あるいは街並みや自然風景のショートクリップなどで威力を発揮します。実際、2分程度の長尺動画も試験的に生成できたという報告もあり(※実用ではまだ短編が中心)、今後さらなる発展が期待されています (Kling AI徹底解説:リアルな人物が作れる最強動画生成AI|ChatGPT研究所)。

主な用途は、映像制作のコンセプト生成、SNS投稿向けショートビデオ、バーチャルインフルエンサーやゲーム内ムービーの素材などです。中国発ということもあり、モバイル動画アプリやSNS動画との相性が良く、縦長9:16や正方形1:1といったフォーマットの指定も容易です (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。プロンプト次第でリアル系からアニメ調まで表現可能なので、クリエイターが素早く動画モックアップを作るのに重宝するでしょう。

2. プロンプトの基本構造と書き方(動画・画像ごとに異なる場合)

Kling AIではテキストプロンプトとオプション設定を組み合わせて動画を生成します。基本的な書き方は英語で詳細に情景を記述する点で他と共通ですが、インターフェース上で指定する項目がいくつかあります。

テキストから動画(Text to Video)の場合:

  1. ダッシュボードで「Text to Video」を選択し、テキストプロンプト入力欄に生成したい動画内容を英語で詳述します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。このとき、一つのシーンを描写する文章になるよう意識します。複数シーンを詰め込まず、5秒程度の中で起こる出来事をシンプルに書きます。

  2. 続いて**設定項目(Settings)**を調整します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。ここでCreativityや長さ、画角などを選択できます(詳細は後述)。

  3. ネガティブプロンプト欄も用意されており、不要な要素が明確にあればここに英語で記述します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。形式はMidjourneyとは異なり、専用のテキストボックスに箇条書きで記入する形です。

  4. 「Generate」を押せば生成開始です (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。キューに入るため多少待ち時間が発生しますが、生成中は進捗バー等が表示されます。

画像から動画(Image to Video)の場合:

  1. 「Image to Video」を選択し、ベースとなる静止画をアップロードします (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。この画像の内容に沿って動画化されます。

  2. 次にプロンプト欄に、その画像をどのように動かしたいかを記述します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。例えば止まっている車の写真を入れ、「車が発進して走り出す様子」と書けばその動きを作ろうとします。

  3. ネガティブプロンプトも任意で設定し、「Generate」を実行します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。完了するとダウンロード可能な動画が得られます (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと) (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。

基本構造はやはり「シーンの主題 + 状況/動きの説明 + スタイル要素」です。KlingはCreativity(創造性)とRelevance(忠実性)という2軸パラメータを持つため、プロンプトは必要十分な情報を入れるのがポイントです。詳細を詰め込みすぎるとRelevanceが高くとも破綻する恐れがありますし、情報が乏しすぎるとCreativityが高い場合に解釈がブレます (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと) (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。例えば、「a man walking down a bustling city street at night, neon signs, cinematic atmosphere」といった具合に、誰が/何を(男が夜の繁華街を歩く)と環境・雰囲気(ネオン看板、シネマティックな空気)をバランスよく記述します。

プロンプト例(Text to Video):

A young woman stands on a windy cliff by the sea at sunset, her dress and hair flowing in the breeze, cinematic lighting, dramatic sky

この例では「若い女性が海辺の崖に立っている」というシーンと、「風で髪や服がなびいている」という動的要素、さらに「夕日・シネマ風照明・劇的な空模様」という雰囲気を盛り込んでいます。5秒程度なら女性が風に吹かれて立っている情景がちょうど収まる内容です。

3. よく使われる構文・タグ・パラメータの詳細解説

Klingのプロンプト入力自体は自由記述の英語テキストですが、生成設定項目としていくつか独自パラメータがあります。これらを理解し適切に調整することで、狙い通りの動画に近づけます。

以上が主要な構文・パラメータです。加えてプロンプト内で使われる語彙としては、Midjourney等と同様にcinematicやdramatic lighting、ultra-realisticなどが頻出します。Klingは現実志向のモデルなので、プロンプトも現実の映像を説明するように書くと良い結果になりやすいです。例えば人物の服装や周囲の物体など細かく書くほど、ちゃんと反映してくれます (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン) (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。逆に抽象画的な指示にはまだ弱い印象があるため、ファンタジー系なら背景まで具体的に描写するなどフォローしましょう。

4. 実現できる表現(スタイル、構図、光、質感、カメラ設定など)とその指定方法

Klingで表現できるスタイルは多岐にわたります。主だったものを取り上げ、それぞれどう指定すれば良いか説明します。

  • 実写風・フォトリアル: Klingの真骨頂はフォトリアルな映像です。昼夜や天候まで細かく設定可能で、例えばon a rainy night in Tokyo, neon lights reflecting on wet streetsのように書けば、雨の夜の東京の実写風ムービーが生成されます。人もa close-up of an elderly man smilingとすれば、シニア男性が笑うアップ映像になるでしょう。リアルさを追求する場合、プロンプトには質感要素(服の素材、肌の特徴など)も書き込むと良いです。例えばwrinkles on his face are softly litのように細部まで指定すれば、モデルはそれを尊重しようとします。

  • 映画・ドラマ調: cinematicキーワードやカメラ設定を活かして、映画のワンシーンのような表現が可能です。master shot of two people arguing in a kitchen, handheld camera feelなどと書けば、手持ちカメラ風の揺れた映像で口論シーンが生まれるかもしれません。カラーグレーディングもwarm color gradingやdark, high contrast lightingといった記述で雰囲気を変えられます。Klingはシネマ的な構図が得意で、Creativityを上げると勝手に映画的演出を足してくれることもあります。

  • アニメ・イラスト調: ベースは実写系ですが、プロンプト次第でアニメ風にもできます。例えばin the style of a 2D anime, vibrant colorsと加えると、キャラ描写がセル画調になる場合があります。NijiJourneyほど洗練されていないかもしれませんが、セル調と3Dの中間のような映像も作れます。また3D game cinematicとすれば、ゲームのカットシーン風(CGアニメ調)の表現になります。リアル人物は避けたい場合、an anime girl with pink hairのように容姿をアニメっぽく誇張して書くのも手です。

  • ファンタジー・SF: ファンタジー世界の映像化も可能です。ただしドラゴンや魔法のエフェクトなど複雑な要素は、Creativityを高めにしないと出づらいかもしれません。例としてa knight in armor stands before a towering dragon, fiery embers in the air, epic fantasy artといったプロンプトで挑戦できます。Klingの安定性からすると、人間の騎士はかなりリアルに、ドラゴンは少しぼんやり生成されるかもしれません。こういう場合、静止画を補助に使うのがおすすめです。Midjourneyなどで描いたドラゴンのいる絵をImage to Videoにして「炎の粒子が舞う」など動きをつけると、ファンタジー感のある動画にできます。

  • 質感・雰囲気: soft focus lensやshallow depth of fieldなどカメラ的質感も指定可能です。例えばボケ味の効いた映像にしたければ被写界深度浅めに言及し、bokeh lights in background(背景に玉ボケ)等を書くと、かなり写真・映像らしい質感になります。またfilm grainを加えればフィルムノイズ感が出るでしょう。音の無いサイレント映画風にしたいならgrainy black and white footage, 1920s film styleなどとすれば、モノクロざらつき映像になる可能性があります。

  • 構図: 構図はテキストで伝えるのが難しいですが、wide shot(広角)、medium shot(中距離の腰から上ショット)、close-up(顔アップ)くらいは意識しましょう。被写体との距離感を明示するだけでフレーミングが定まります。また前述のCamera Movement指定を併用して、開始~終了までカメラがどう動くかも意図を持って選ぶと、映像表現の幅が広がります。

指定方法のポイント: Klingは詳細記述を嫌がりません。むしろ具体的に書くほど結果が良い傾向です (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。例えば人物なら性別・年齢・服装・表情まで書き、背景も場所・時間帯・天気まで書く。そうするとRelevance重視なら忠実に、Creativity側でも大筋は外さずに生成してくれます。曖昧に「美しい風景」ではなく「青い花が咲く丘陵地の朝靄」と書く、といった具合です。モデルの安定性が高いので、細部まで盛り込んでも破綻しにくい印象があります。とはいえ過度な欲張りは禁物で、一つのクリップで表現しきれない内容(時間経過や長いストーリー)は、複数クリップに分けるべきです。

5. 出力品質や応答性を高めるベストプラクティス

Kling AIでより良い結果を得るためのテクニックや、スムーズに使うコツを紹介します。

  • 英語で詳細に書く: 繰り返しになりますが、プロンプトは英語で具体的にが基本です。日本語で書いてもうまくいくケースもありますが、微妙なニュアンスは伝わりません。特にKlingは中国製ですがUI含め英語が標準なので、素直に英語を使いましょう。辞書を引きつつでも、細部まで描写する価値があります。「詳細に」といっても長文ではなく、箇条書き風にキーワードを並べても構いません(例: an old library interior – dust particles – ray of sunlight through window – static camera のように句点やダッシュで区切る)。

  • Creativity/Relevanceの試行: 初回は中間値付近で生成し、その結果を見て「もっと冒険してほしい」or「堅実にしてほしい」を判断します。例えば人物の顔が変に変形した場合はCreativityが高すぎるので下げる、逆にプロンプト通りだが面白みがないならCreativityを上げる、と調整します (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと) (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。このパラメータ調整一つで出力の傾向が大きく変わるため、目的に応じた最適バランスを探るのが重要です。

  • 複数バリエーション生成: Klingでは一度に4つの動画を同時生成する機能があります (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。これはクレジット消費も4倍になりますが、時間を節約したいとき有用です。設定を変えずとも、自然なランダム性で構図や細部が異なる4本が得られます。大量出力して後から選ぶ戦略も取りやすいでしょう。また、モデルバージョン違いで比較するのもおすすめです。1.0と1.5(1.6)で同じプロンプトを試し、どちらが好みか確認します (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。1.0は早いが粗め、1.5/1.6は遅いが安定・高精細といった特徴があるので、シーンによって使い分けられます。

  • 待ち時間対策: Klingは人気のためか、時間帯によって生成待ちが発生します。報告では、サービス初期には生成に数時間待たされた例もありました (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)が、その後改善し数分程度になっています (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。しかし負荷が高まれば再び待つ可能性があります。ベストプラクティスとして、出力が急がない場合は混雑時間を避ける(深夜や早朝に実行する)ことや、一度に長尺・高品質を要求しすぎないことが挙げられます。5秒でまず結果を見て、良ければ10秒版を発行する、といった手順で無駄を省きましょう。

  • ネガティブプロンプトの活用: Klingはネガティブ指定欄が充実しているので、気になる欠点はあらかじめ潰すのが吉です。よくあるのは「生成画像内に変なテキストやUIが紛れ込む」「人物の指がおかしい」などです。これらをtext, watermark, UI, extra fingersのように列挙しておきます。特に文字列混入は、AIが勝手に数字や看板を書き込むことがあるので消したい場合はtextは入れておくと安心です。入れすぎも良くないですが、気になるものは遠慮なく指定しましょう。

  • 外部編集: 出力された動画は必要に応じて外部で編集・補正しましょう。例えば若干フレームレートが低いと感じたらAI補間ツール(Flowframes等)で60fps化する、色味を動画編集ソフトで調整するなどです。Klingの画質自体は高いですが、より滑らかにしたり、複数クリップを繋ぐ作業は人手で行う前提でいると柔軟に活用できます。

最後に、コミュニティ情報の活用も重要です。Klingは比較的新しいサービスなので、ユーザー間でノウハウが共有されています。日本語記事やSNSでもプロンプト例が公開されていますので(例えばnote記事のプロンプト集 (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)など)、それらを試してみて自分の引き出しに加えてください。

6. 禁止ワード・制限・生成拒否されやすい表現とその回避方法

Klingも基本的な倫理ガイドラインは他社サービスと同じと考えられます。特に中国企業のサービスということで、中国国内の規制も影響している可能性があります。以下の点に注意しましょう。

  • ヌード・アダルト: 性的なコンテンツは厳しく禁止されます。露出の高い服装程度なら生成されることもありますが、明確なわいせつ表現や裸はプロンプト時点で弾かれるでしょう。健全な表現に留め、ランジェリーや性的シーンは避けるべきです。回避策としても、これらは禁止域なので行わないのが賢明です。

  • 過激な暴力・政治: グロ映像やセンシティブな政治的内容もNGです。中国発ということで政治指導者やデモ暴動のシーンなどは特に避けましょう。生成されないだけでなく、アカウント停止など重い処分の可能性もあります。暴力シーンについては、軽いアクション程度(例えば「ヒーローが悪者と戦う」くらい)は許容されるかもしれませんが、流血は避けるべきです。

  • 中国関連のタブー: 他国サービス以上に、中国政府や社会に関するデリケートな話題はNGです。天安門や特定の宗教・民族問題など、プロンプトに入れないこと。英語で書いても検知される可能性があります。

  • 特定実在人物: これも避けるべきです。著名人のフェイク動画生成はどのプラットフォームでも禁止ですし、Klingでも同様でしょう。キャラクターについても版権ものはやめましょう。

  • 生成物の公開: 厳密には禁止ワードではないですが、生成した動画を公開・商用利用する際は規約を確認してください。Klingは商用可と明記されていないため、安全策としてクレジット表記や確認を取る方がよいでしょう。中国企業なので問い合わせ対応に時間がかかることも想定されます。

回避方法: 違反コンテンツに触れないことが第一です。その上で、どうしても引っかかりやすい表現を含む場合は婉曲表現にすることです。例えば銃撃戦を描写したければ「people chasing and dodging each other」など撃つや銃といった単語を避け、動きで表現する手があります。また、エラーにならなくてもAIの内部判断で意図と異なる結果になることがあります。例えば露出度を下げて勝手に服を着せたり、暴力表現をマイルドにするなどです。これは避けようがないので、AIの忖度を受け入れつつ調整するしかありません。どうしてもNGギリギリのテーマを扱う必要がある場合、別のAIや手作業でカバーすることも検討しましょう。

総合すると、Klingは比較的オープンに使えますが、中国基準+一般的AI倫理のルール下にあります。コンテンツに配慮し、安全で創造的な利用を心がけてください。

7. 上級テクニック(例:ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

Klingを使いこなす上での上級テクニックや周辺ツールとの併用方法を紹介します。

  • モーションブラシの活用: Kling独自の新機能としてモーションブラシがあります (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。これは画像を動画化する際に、画像中の特定要素(人物や物体)の動きの軌跡をユーザーが描いて指定できる機能です (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。例えば空の写真で雲の部分をドラッグして軌道を描けば、そのように雲が動く動画になります。非常に強力な機能で、AI任せではなく人の意図で動きを作れる点が画期的です。上級者は静止画を用意し、このモーションブラシで細かい演出を付け加えたりしています。ただし2024年時点ではUIの一部で実装され始めた段階なので、常に利用できるかは状況によります。使える場合はぜひ試してみましょう。

  • 画像二枚から動画(Start→End): Klingでは2枚の画像をつなぐ動画を作ることも可能です (画像→動画がタダ&簡単ってマジ?生成AI・KLINGの使い方教えます | ライフハッカー・ジャパン)。Standardモードでエンドフレーム利用とあるように、開始画像と終了画像を与えて、その間を補完する映像を生成できます (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。例えば人物の異なるポーズ2枚を与えると、そのポーズ変化を滑らかに繋ぐ動画が得られます。これは事実上AIによるモーフィング動画であり、連続した動作をより長く表現するのに役立ちます。上級者ならMidjourney等で連続画像をいくつか作り、それを順次Klingで繋いで長いアニメーションを作ることも可能でしょう。

  • マルチモーダルなアプローチ: Klingは映像生成に特化していますが、音声は付与できません。そこで、出来上がった動画に音声AIでナレーションやBGMを付けるのも上級テクです。映像に合わせて音響を整えると、一気に作品らしくなります。CapCutなど別アプリで合成することになりますが、最近はAIで効果音を自動生成するツールも出てきています。複数のAIを連携させて一つのコンテンツを制作する視点を持つと良いでしょう。

  • プログラムによる一括生成: Klingは現状API公開は無いようですが、ブラウザ操作を自動化して大量のプロンプトを投入する猛者もいるかもしれません。ただ先述のとおり利用規約で自動操作が禁じられている可能性もあるため注意です。もし将来的に公式APIが出たら、Python等からバッチで映像パターンを大量生産→選別というワークフローも考えられます。コンテンツ量産にはそういった自動化も上級者は検討するでしょう(※執筆現在は手動UI操作が前提)。

  • 他AIとの併用: LoRA的制御という点では、Kling自体はユーザーがモデルに学習を追加できません。しかし、事前に画像生成AIで理想の1フレームを作り、それをKlingで動画化というのは既に多用されています。例えばアニメキャラの決め絵をNijijourneyで生成→Klingで「髪が風になびく」動画にする、現実人物の写真を他AIで生成→Klingでまばたきや微笑みの映像にする、などです。将来的にはKlingもカスタムモデルを許可する可能性もありますが、現時点では他AIで補完する方が柔軟です。必要に応じてStable DiffusionのControlNet(特にOpenPoseなど)で動きの骨格を設計し、それを画像シーケンスとしてKlingに与えるなど高度な組み合わせも考えられます。

Klingは比較的新しい分、ユーザー側で創意工夫する余地も大きいです。上級者はKlingだけで完結させるのでなく、画像AIや編集ソフト、音声AIなどあらゆるツールと組み合わせて最終アウトプットを追求しています。Klingを核として映像制作パイプラインを構築する発想を持つと、よりプロフェッショナルな成果物に近づけるでしょう。

8. 他ツールとの違いや応用的な連携活用例

最後に、Klingと他の生成AIツールとの違い、および組み合わせ活用の例をまとめます。

  • 他ツールとの違い:

  • 応用的な連携活用例:

    • Midjourney/Niji → Kling: これは定番の組み合わせです。MidjourneyやNijiで作った高品質イラストをKlingで動かす手法です。具体例として、Nijiで描いたオリジナルキャラクターの全身図をKlingに与え、the character turns around and smiles(振り向いて微笑む)とプロンプトすれば、アニメ風キャラが動く動画が完成します。セルルックを完全再現とはいきませんが、静止画だけでは伝わらないキャラクター性が表現できます。

    • Kling → Runway編集: Klingで生成した複数のクリップをRunwayのエディタに取り込み、一本の動画作品に仕上げる例です。例えばKlingで風景・人物など各カットを個別に作り、Runwayでシーケンスを並べてトランジション(場面転換効果)やテキストテロップを追加します。こうすることでKlingの高画質とRunwayの演出力を両取りできます。最終書き出しもRunway上でできるため、ワークフローがスムーズです。

    • Luma → Kling補完: 逆の発想で、Lumaで出力したリアル映像に、KlingのImage to Videoで不足部分を補完する例も考えられます。例えばLumaはシーン全体はすごく綺麗だが人物の顔がやや不鮮明だ、といった場合、Luma動画の最初のフレームを取り出し、その人物顔をMidjourneyで補正した画像をKlingで動画化し、元映像と合成するといった高度な処理です。これはかなり発展的ですが、複数AIの結果を合成してベストを尽くすアプローチになります。

    • オフライン用途: Klingの生成結果はMP4等の動画ファイルとしてダウンロードできます (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと) (Kling AI完全攻略:誰でも使える簡単マニュアル&厳選プロンプト集|ぽけっと)。このためインターネット接続が不要な場所でも再生可能です。例えばゲーム開発で背景動画として組み込む、プレゼン資料に埋め込む、といった素材的な利用もしやすいです。RunwayやMidjourneyと組み合わせ、プロダクトのあらゆる視覚要素をAI生成素材で統一するといった実験もされています。

まとめ: Klingは単体でも強力ですが、他ツールと連携することでさらに活用の幅が広がります。特に画像AIとのハイブリッドはクリエイティブ業界でもトレンドで、静止画で詰めたデザインを動画AIで動かすというワークフローが現実味を帯びています。各ツールの利点を理解し組み合わせることで、これまでプロのスタジオでしか作れなかった映像表現が、個人でも手に届くものになるでしょう。


Nijijourney(にじジャーニー)

1. ツールの概要(何が得意か、主な用途)

Nijijourney(にじジャーニー)は、Midjourneyが提供するアニメ・マンガ風イラスト生成に特化した画像生成AIモデルです (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。Midjourney本体の派生モデルであり、Spellbrush社と協業して開発されたとされています (Version – Midjourney)。**「二次元(にじげん)」**の通り、アニメキャラクターやゲーム風イラストの生成が得意で、Midjourneyの通常モデルとはテイストが大きく異なります (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。

Nijiモデルの最新バージョンはNiji 6(2024年6月リリース)で、Midjourney v6相当の技術をベースにしつつアニメ表現向けの最適化が施されています (Version – Midjourney) (Version – Midjourney)。具体的には、日本語の短いテキスト(カナ)にも対応し、簡単な漢字も描画できるようになるなど、日本語環境での使い勝手が改善されています (Version – Midjourney) (Version – Midjourney)。また、アニメキャラの目の描き込みや細部の表現力が向上し、従来モデルで発生していた一部のアーティファクトも軽減されています (Version – Midjourney) (Version – Midjourney)。

NijijourneyはMidjourneyのDiscordやWeb UIから利用可能で、切り替え方法は「--niji パラメータを付与」「設定メニューでNijiモード選択」「にじジャーニー専用Discordサーバー使用」などがあります (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。基本の使い方や料金プランはMidjourneyと同様であり、商用利用もMidjourney契約に準じて可能です (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。したがってNiji単体というより、Midjourneyの一機能として提供されているイメージです。

得意な生成内容は、アニメキャラクターの全身図、ライトノベル風イラスト、ゲームのコンセプトアートなどです。例えば、美少女キャラやロボット、ファンタジークリーチャーなど、アニメ・ゲーム文脈のものはNijiモデルにすると非常に魅力的に描かれます。Midjourney標準モデルだと写実的になりすぎる場面でも、Nijiなら線画調・デフォルメ表現で理想的な二次元絵に仕上がります (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。個人の創作はもちろん、イラストレーターのアイデア出し、漫画の構図検討などプロユースにも活用されています。

2. プロンプトの基本構造と書き方(画像・動画ごとに異なる場合)

Nijiモデルのプロンプト基本構造はMidjourneyと同様ですが、よりイラスト特化の語彙やスタイル指定を使う傾向があります。また日本語プロンプトにも比較的対応しています (にじジャーニー(niji・journey)の使い方や特徴を深掘り解説 ...) (にじジャーニー(niji・journey)の使い方や特徴を深掘り解説〖イラスト特化の画像生成AI〗 – channel IVY)。

  • 日本語でOK: Nijiモデルは日本語の解析精度が上がっており、日本語でプロンプトを書いてもそれなりに解釈してくれます (にじジャーニー(niji・journey)の使い方や特徴を深掘り解説〖イラスト特化の画像生成AI〗 – channel IVY)。英語が苦手なユーザーでも、「かわいい魔法少女が空を飛んでいる」のように日本語で書いて試すことができます。ただしニュアンスまで伝えるには英語が確実なので、慣れれば英語併記か英語メインを推奨します。

  • キャラクター+状況描写: 基本構文は「キャラクターの容姿・表情 + シチュエーションや背景」です。例:「青い髪の少女が森の中で微笑んでいる」→(英訳)→「a blue-haired girl smiling in a forest」といった具合です。ポイントは容姿の詳細(髪色髪型、服装、表情)を盛り込むことです。Midjourney通常モデル以上に、Nijiはキャラの顔や服をきっちり描くため、そこを指示すると意図に近づきます。

  • 絵柄・テイストの指定: Nijiモデル独自のスタイルパラメータがあります(後述)が、プロンプト中に作家名や作品名を出すことでも画風を寄せられます (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。例えば「宮崎駿アニメ風」や「スタジオジブリ風背景」は効果絶大です。ただし版権や有名作品名はコミュニティガイドライン違反になる可能性もあるので注意しつつ、オマージュ程度にとどめます。

  • シンプルさ: 複雑なシーンより、単一キャラや単一状況の方が安定します。Nijiでも欲張って多人数や背景盛り込みすぎは破綻のもとです。まずは一人のキャラ+シンプルな背景で始め、徐々に付加要素を増やしてみましょう (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。

  • プロンプト例(Niji):

夢見るような瞳の魔法少女が星空の下に立っている。長いピンク色の髪、フリル付きのドレス。背景には満月と輝く星々。 --niji 6 --style expressive

(上記日本語プロンプトを英訳すると:)

A magical girl with dreamy eyes stands under a starry sky. She has long pink hair and a frilly dress. In the background, a full moon and sparkling stars. --niji 6 --style expressive

この例では、日本語でキャラの特徴(夢見る瞳、ピンク髪、フリルドレス)と背景(星空と満月)を記述し、Nijiモデルv6でスタイルをexpressiveに指定しています。にじジャーニーアプリなどでは日本語UIで同様の入力が可能なように、日本語でも比較的違和感なく生成できます (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。

3. よく使われる構文・タグ・パラメータの詳細解説

NijiモデルではMidjourney共通のパラメータに加え、Niji専用のスタイル指定があります。また、Midjourney v6系の新機能(PersonalizationやStyle Reference)も利用可能です (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。

Nijiモデルでは、プロンプトに含めると有用な表現として、日本のイラスト界隈でよく使われる呪文的タグがあります。例えばStable Diffusion系で知られるmasterpiece, best quality等を付けるユーザーもいますが、Midjourneyには不要との声もあります (思い通りにAIイラストを作成するプロンプト一覧!コツや作成例も紹介)。むしろキャラデザ要素(髪型: ツインテール, 表情: wink 等)やポーズ指定(上半身アップ、背中越し 等)を盛り込む方が効果的です。

4. 実現できる表現(スタイル、構図、光、質感、カメラ設定など)とその指定方法

Nijiモデルが得意とする表現と、そのプロンプトでの指定のコツを紹介します。

  • キャラクターデザイン: オリジナルキャラクターの創造はNijiの真骨頂です。髪型・髪色、瞳の色・形、服装(セーラー服・鎧・ドレス等)、表情(笑顔・驚き・ツンデレ顔等)を細かく描写すれば、かなり思い通りのキャラが出ます。例えば「栗色のショートヘアで眼鏡をかけた女子高校生」→ a high school girl with short chestnut hair and glasses のように具体的に。萌え絵的ニュアンス(例: ぽっちゃり頬、きらきらした瞳)は英語では難しいですが、「sparkling eyes, blushing cheeks」といった形で近づけます。ポーズ指定はdynamic pose(動きのあるポーズ)やarms crossed(腕組み)などである程度可能です。

  • 背景美術: Nijiの--style scenicは特に背景が美しくなります (Legacy Features – Midjourney)。アニメの背景美術のような絵画タッチで、ファンタジー風景から都会の街角まで多彩です。背景のみを描かせたい場合、人物を入れずに「古い図書館の中、暖かな夕日が差し込んで埃が舞っている」など環境描写をメインに書きます。Midjourney通常モデルでも背景生成は得意ですが、Nijiにすると色使いや線がアニメ調になるため、イラスト作品にそのまま使いやすい出力になります。

  • アニメ塗り: べた塗りとアニメ影(セル画の影)を表現したいなら、flat colors, cell shadingといったキーワードを追加します。Nijiは基本的にラノベ挿絵風(グラデやハイライト多用)の画風ですが、セルルックに寄せることも可能です。また線画の強調にはbold outlines、逆に淡い水彩風にはwatercolor styleなども有効です。質感はMidjourneyモデルよりシンプルになりがちですが、必要ならintricate pattern on fabric(服の緻密な模様)等と書きます。

  • 構図・カメラ: 漫画的な演出(例えば集中線や誇張遠近)はAIには難しいですが、fisheye viewやDutch angle(斜め構図)などカメラ用語で多少遊べます。また、キャラを映す際にfull body(全身)かupper body(上半身)か明示すると構図が安定します。NijiモデルはRawモード(--style rawまたは--stylize 0併用)にすると構図がフラットで硬くなることがあります (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。臨場感が欲しい場合はスタイライズ高め+expressiveスタイルで、カメラ距離や角度も記述しましょう。例:「low angle shot from ground」(煽り下からアングル)など。

  • ライト効果: アニメ絵でも照明の概念はあります。soft ambient lighting(柔らかな環境光), dramatic shadows(劇的な影)などを指定すれば、陰影にメリハリが出ます。夜のシーンならneon lighting、宇宙ならglowing auraなど、状況に応じて光源を想起させる言葉を使います。Niji 6では夜景中の日本語文字看板なども描けるため (Version – Midjourney)、都市夜景+ネオン看板といった描写も楽しめます。

  • 特殊効果: 魔法陣や炎、水しぶきなどエフェクト系は、Midjourney同様プロンプトに書けば描いてくれます。ただし動的エフェクトは静止画ゆえ難しく、稲妻などは割と苦手です。とはいえ「炎を纏った剣」「蝶の光る羽根」などファンタジックな効果は試して損はありません。Nijiは目やエフェクトの発光表現が得意で、glowingをつけるととても映えます。

Nijiモデルの表現力を最大限に活かすには、好きなアニメ絵の分析が有用です。自分の思う「良いイラスト」の特徴を言語化し、それをプロンプトに反映させてみます。例えば「色彩がパステル調で淡い感じが好き」ならpastel color palette, soft lightingと入れる、「シャープな線と濃い影が好き」ならsharp lineart, high contrast shadingといった具合です。

5. 出力品質や応答性を高めるベストプラクティス

にじジャーニーで満足のいくイラストを得るためのコツをまとめます。

  • キャラ設定を具体的に: とにかくキャラクターものなら属性を細かく列挙しましょう。髪・目・服・表情・ポーズ・年代・性格などです。Midjourney標準では省略しても補完してくれる部分も、Nijiはむしろ積極的に読み取ろうとします。例えば「少年」というだけでなく「勝気な表情の10代半ばの少年」と書いたほうがブレが減ります。キャラ名は使えませんが、自分の中で既存キャラに近いイメージがあれば、それを描写していくと良いです。

  • スタイルパラメータの活用: Nijiの4スタイルはぜひ使い分けましょう。おすすめは--style expressiveで、比較的万能に綺麗なイラストになります (Legacy Features – Midjourney)。cuteはデフォルメが強くコミカル、scenicは背景凝りすぎて主題が埋もれることもあります。それぞれ出力を比較してみて、自分の好みに合うスタイルをデフォルトにしておくと効率的です。スタイル指定しない場合はおそらくOriginal相当ですが、試す価値は低いかもしれません(v6ではデフォルトで既に高性能なため)。

  • 構図テンプレートを使う: イラストの典型構図をプロンプト化しておくと汎用に使えます。例えば「Masterpiece portrait of [キャラ説明]」のように、頭に評価詞やポーズ指定を入れたテンプレを用意すると楽です。実際、日本のユーザー間では「奇跡の一枚のような美麗なイラストを出す魔法の言葉」の共有があり、note等でプロンプトの呪文一覧が公開されています (【画像生成AI】画風プロンプト/呪文一覧|niji・journey - note)。それらを参考に、自分なりのテンプレ構文を(上の続き)

5. 出力品質や応答性を高めるベストプラクティス (続き)

  • 構図テンプレートを使う: イラストの典型構図をプロンプト化しておくと汎用に使えます。例えば「masterpiece portrait of ...」のように、評価の高いイラストを想起させるテンプレを活用しましょう。日本のユーザー間では、いわゆる**「呪文プロンプト」**が共有されており (【画像生成AI】画風プロンプト/呪文一覧|niji・journey - note)、masterpiece, best quality, ultra-detailedのような定型フレーズを冒頭に付けるケースがあります。Midjourneyでは必須ではないとの意見もありますが、好みで試してみてもよいでしょう。ただし過度なタグ羅列は返ってノイズになる場合もあるので、効果を見極めつつ利用してください。

  • モデルの癖を知る: Nijiモデルは目が大きく煌びやかに描かれる傾向や、人物の指がMidjourney標準モデルより整いやすい反面、背景の文字は読めない落書き風になる傾向など、癖があります。試行を重ねて「こういうプロンプトだとこう出やすい」というパターンを掴みましょう。例えば「笑顔」と指示するとしばしば口が開いた笑顔になるので、口を閉じた微笑みにしたければsoft smile, closed mouthまで書く、といった対応ができます。経験値を貯めることで品質が安定してきます。

  • 出力バリエーションの比較: Midjourney同様、1回のリクエストで4枚のバリエーションが得られるので、気に入ったものを選んでアップスケールします。Nijiは細部描写が多いため、アップスケールで劇的に美しくなります。またRemix機能で微修正を加え再生成するのも有効です。例えば髪型だけ変えたいときRemixをONにしてプロンプトを書き換え変化を出す、など部分修正に使えます。

6. 禁止ワード・制限・生成拒否されやすい表現とその回避方法

NijijourneyもMidjourneyの一部であるため、Midjourneyのコミュニティガイドラインに準じた制限があります。したがって、ゴア・性的表現・差別表現などは禁止であり、プロンプトに含めるとブロックされるか、意図と異なる生成になります (Community Guidelines – Midjourney) (Community Guidelines – Midjourney)。特にアニメ絵は露出度が高くなりがちですが、明確な18禁表現は禁止です。乳房の露出や性的シチュエーションは避けましょう。どうしても際どい衣装を描きたい場合も、bikini程度に留め、それ以上は書かないほうが安全です。

また、Midjourneyと同様実在人物のキャラクター化も禁止です (Community Guidelines – Midjourney)。有名俳優をアニメ化する、といったプロンプトは規約違反になり得ます。版権キャラクターも公式には推奨されません。プロンプトに有名キャラ名を書くのは控え、どうしても似せたいなら特徴を文章化するしかありません。

回避方法: 基本的にはMidjourneyと同じで違反内容をプロンプトに入れないことです。Nijiモデルだからといって例外はありません。万一ブロックされた場合、婉曲表現にする以外ありませんが、ポリシー違反を無理に回避することは推奨されません。特にNijiはポップな表現に長けていますので、健全な範囲で十分魅力的な作品が作れます。なお、Nijiモデルでは日本語で不適切語を書いても検知される可能性がありますので注意しましょう。

7. 上級テクニック(ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

Nijijourneyでさらに理想のイラストに近づけるための上級テクニックです。

  • ネガティブプロンプト活用: Midjourney同様、--noパラメータで不要要素を除去できます。アニメ絵では特に余計な小物や奇妙なアクセサリが生成されることがあります。例えば髪飾りが不要なら--no hair ornament、背景に建物を入れたくなければ--no buildingsのように指定可能です。また、Stable Diffusionでよく使うworst quality, low qualityなど画質を下げるネガティブはMidjourneyでは不要ですが、特定の画風を避ける目的で--no realistic, --no photograph(写真風を避ける)とする手もあります。

  • 重み付けとマルチプロンプト: キャラと背景など複数の要素をバランスよく描かせたい場合、重み付けが有効です。例えば「少女::2 森の背景::1」のように::で重みを変えるか、--iw(画像プロンプト時の重み)も利用できます (Version – Midjourney)。また、マルチプロンプト(文を:::で区切る手法)は現在のMidjourney v6.1では推奨されないので、シンプルに一文にまとめる方が安定します (Version – Midjourney)。重み付けは重要な要素だけ強めに設定し、それ以外は1以下に抑えると良いでしょう。

  • 複数生成とベストミックス: お気に入りのキャラを様々なポーズで描きたい場合、一枚の画像に複数キャラを詰め込もうとせず、一枚ずつ別に生成したほうが結果的に高品質です。それぞれ出力した後、画像編集ソフトでコラージュするというアプローチも上級者は取ります。AI任せにせず人間が後処理でレイアウト調整すると、自由度が増します。また、顔はこの画像、ポーズはこの画像が良い…という場合、Img2Img系統の機能はMidjourneyには無いものの、Style Referenceで近いことができます。気に入った絵のURLを--srefに入れ、新たなプロンプトで生成すれば、元のタッチや雰囲気を受け継いだ新規絵が得られます ([PDF] MIDJOURNEY CHEAT SHEET - codes & parameters - Creator Impact)。これを利用して自分の過去生成物から統一感を出すことも可能です。

  • LoRA的アプローチ: MidjourneyではユーザーがLoRAやDreamBoothのような学習モデルを持ち込むことはできません。しかしPersonalization機能で自分好みの傾向を学習させることや (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)、また似顔絵からキャラ化したい場合は他のStable DiffusionサービスでLoRAを作成するなどの手段があります。その上で、出来上がった画像をMidjourneyのImage Promptとして与え、背景や雰囲気を向上させるという合わせ技も考えられます。少々手間ですが、推しキャラやオリキャラを定着させたい場合、SDでLoRA訓練→Midjourneyで美化というプロセスを踏む上級者もいます。

8. 他ツールとの違いや応用的な連携活用例

NijijourneyはMidjourneyの一部でありながら、明確にアニメ特化という個性を持っています。他ツールとの比較と連携例を挙げます。

  • 他ツールとの違い:

    • 汎用のMidjourneyモデルとの違い: 写実性よりイラスト調の美的表現を優先する点です (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。Midjourney標準モデルが写真風から絵画風まで幅広いのに対し、Nijiモデルは常に二次元テイストになります。例えば同じプロンプトで両者を比較すると、Nijiは輪郭線がはっきりし鮮やかな色使い、標準モデルは陰影や質感がリアル、と差が出ます (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES) (Midjourney「Niji」で二次元キャラ生成!実例や使い方を解説|SHIFT AI TIMES)。用途としても、Nijiはキャラクターデザインやライトノベル挿絵向き、標準モデルは概念アートや写真風イメージ向きと住み分けられます。

    • Stable Diffusion系(Animeモデル)との違い: SDにもAnime特化モデル(例:Waifu Diffusion等)がありますが、Nijiはそれらと比べ簡単に高品質な絵が得られます。SDではタグを駆使し微調整が必要なところ、Nijiは文章で指示すれば大きく外さず高レベルにまとめてくれます。反面、カスタマイズ性ではSD系が勝ります(LoRAで特定キャラ学習など)。つまり手軽さのNiji、高度制御のSDという違いです。

    • イラスト生成特化サービスとの違い: 他にNotionのMage.Spaceや国内のNOVEL AIなどイラスト生成サービスがあります。Nijiの強みはMidjourneyの裏打ちによる品質と、コミュニティの豊富な情報です。最新のv6モデルのおかげで、手や顔など難しい部分もかなり安定して描けます (Version 6.1)。これは依然として他サービスに対する優位点です。またNiji専用DiscordやWeb UIにより日本人ユーザーも増えており、情報交換が盛んです。

  • 応用的な連携活用例:

    • Niji → Kling/Runway: Nijiでデザインしたキャラクターを、前述のKlingやRunway Gen-2で動画化する例です。静止画AIで得た魅力的なキャラを動かせるため、二次創作的なアニメーションが可能になります。例として、Nijiで描いた美少女キャラの立ち絵をKlingのImage to Videoに入れ「髪が風になびく」など動きを付与すれば、簡易アニメシーンの完成です。これに背景動画(例えば同じシーンの背景を別途生成しKlingで動かしたもの)を合成すれば、AIだけで一枚絵から動画を作れます。

    • Niji ↔ Midjourney標準モデル: 一つのシーンを両モデルで出力し、良い部分を組み合わせる使い方もあります。例えば標準モデルで出た背景が良く、Nijiで出たキャラが良ければ、Photoshop等で合成します。あるいはNijiでキャラを、標準モデルで背景を別々に生成し、あとで合成する前提で作業するのも一法です。これにより背景の写実性とキャラのアニメ調を両立できます。人手を介しますが、絵としての完成度をさらに高めることができます。

    • Niji + Live2D/3Dモデリング: Nijiでデザインしたキャラを元に、Live2Dや3Dモデリングするケースも考えられます。つまり、Nijiをデザイン画作成ツールとして使い、その絵を参考にしてVTuberモデルやゲーム用3Dモデルを人間が起こすという流れです。Nijiの美麗なイラストは設定資料としても優秀で、特に色遣いや衣装デザインのアイデア出しに貢献します。プロのイラストレーターがNijiでラフ案を出し、それをブラッシュアップして正式採用するような使い方も一部で始まっています。

    • 外部AIとの組合せ: ChatGPTでキャラ設定文を生成→Nijiでビジュアル化、といった異種AI連携も面白い例です。物語の登場人物のプロフィールを文章AIに作らせ、その説明文をNijiに入れて絵を作ることで、テキストからビジュアルへの橋渡しができます。これはゲーム開発のNPC生成やTRPGのキャラメイキング等、遊び方次第で様々な応用があり得ます。

Nijijourneyは創作分野に特化したAIツールとして、他の画像・動画生成AIや創作支援AIと組み合わせることで価値が最大化されます。特に日本のアニメ文化との親和性が高く、今後ユーザーの工夫次第でプロの制作現場にも取り込まれていくでしょう。


Luma AI (Dream Machine)

1. ツールの概要(何が得意か、主な用途)

Luma AIのDream Machineは、2024年6月に公開された最新のテキスト・画像からの動画生成AIです (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。わずか数分で、数秒間の高品質かつリアルな映像を作り出せる点で注目されています (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。特に実写に近い質感と物理的な一貫性に優れており、人物・動物・物体が物理法則に沿って自然に動作する映像を生成できます (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。開発元のLuma Labsは元々NeRF(ニューラル放射野)の技術で知られており、その知見を活かしてフォトリアリスティックなシーンの生成を可能にしています。

Dream Machineは5秒間の動画が基本で、テキストのみ、またはテキスト+1枚の画像を入力として利用します (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。無料のベータ版が公開されており、Googleアカウントがあれば誰でも使えます (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。プロンプト補強機能「Enhance prompt」によるシーン自動補完や、生成動画をループ再生する「Loop機能」も備えています (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成) (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。またクラウド上で強力なGPU(NVIDIA H100)を用いて動作しており、1コマ1秒程度の生成速度、つまり5秒(120フレーム@24fps)の動画に約2分を要します (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。

得意分野は、映画のワンシーンのような高精細映像です。例えば「山岳地帯を飛ぶドローン映像」「水中で泳ぐ魚の群れ」など、ドキュメンタリーやシネマティックな短尺クリップの生成に向いています (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。また、ループ機能を使えば5秒動画を繋ぎ合わせてシームレスに再生できるため、背景映像や環境ビデオを作る用途にも適しています (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。Lumaはもともと3D復元技術で知られる会社のため、風景や空間表現に強く、フォトグラメトリで撮影したかのような現実感が特徴です。

2. プロンプトの基本構造と書き方(動画・画像別の違い)

Luma Dream Machineでは、テキストプロンプトと**(任意で)1枚の画像**を入力します。基本構造はRunway Gen-2に近く、「シーンの概要 + 視覚的ディテール」を簡潔に書くことがポイントです。

テキストのみの場合:

画像+テキストの場合:

基本構造は「場所/対象 + 動き/変化 + 映像スタイル」です。Lumaでは動的な動作の描写が重要で、例えば「揺れる」「走る」「吹き抜ける」など動詞を入れることで、AIに動画らしい変化を意識させます。一方で静止シーンを希望する場合は、敢えて動きを書かずに「静止した構図」を保たせるのも手です。

プロンプト例(テキストのみ):

A drone shot over a forest valley at sunrise, gentle mist rolling, sun rays breaking through trees, cinematic 4K

この例では「夜明けの森の谷をドローン撮影した映像」に、「霧が立ち込め木々の間から朝日が差し込む」という動的・視覚的要素を加え、シネマティックな4K映像を想起させています。Enhance promptをオンにすれば、短く「drone shot of forest at sunrise」でも詳細を補ってくれるでしょうが、自分で具体的に書くことでより狙い通りになります。

3. よく使われる構文・タグ・パラメータの詳細解説

LumaのDream MachineはUI上はシンプルで、Runwayのような多数のユーザー設定項目はありません。ただしEnhance promptやLoopなど独自の選択肢があります (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成) (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。またプロンプト内で有効なキーワードもいくつかあります。

  • Enhance prompt: 先述の通り、短い指示を自動で詳細化する機能です (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。有効時はAIがシーンの補足説明を勝手に足します。初心者には便利ですが、コントロールしたい上級者はオフにして自分で細部を指定する方がよいでしょう。オンオフの切替で出力がどう変わるか比べてみるのも一興です。

  • Loopオプション: 生成された5秒動画をループするユーティリティが提供されています (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。ループ用に動画の最初と最後を馴染ませる処理が行われ、繋ぎ目の分からない連続再生ができます。UI上でボタン一つで指定可能です (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。これにより、短い映像を繰り返して長時間再生するインスタレーション映像などに活用できます。

  • カメラワークや画角: Dream Machineではユーザーが明示的にカメラ動作を選択するUIは無いものの、プロンプトにカメラ用語を含めるとAIが解釈します。例:dolly shot(被写体に沿って移動撮影), time-lapse(微速度撮影)など。ただ、内部でAI自身が様々なカメラモーションを試すように設計されており (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)、必ずしも指示通りにはなりません。逆に言えば、明示しなくても自然なカメラ動きがつくことがあるため、細かく指定しすぎず雰囲気重視で書くほうが良い場合もあります。

  • 物理・環境要素: Lumaモデルは物理的一貫性を重視しているので (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)、wind blowing(風が吹く), rain falling(雨が降る)など環境要素を入れると効果的です。例えば水のシーンでunderwater, bubbles risingと書けば、水中で泡が上がる物理演出を期待できます。これらは映像にリアリティを与える重要なキーワードです。

  • ネガティブ指定: 現状、明確なネガティブプロンプト欄やパラメータはありません。ただプロンプト内に「without ○○」と書くことはできます。しかしLumaはもともと不要なものを入れにくい高忠実モデルなので、あまりネガティブ指定が必要になるケースは少ないです。気になる場合、例えば「人を入れたくない」ならno people presentと書くか、Enhance promptをオフにして余計な推測を避ける方が確実でしょう。

Dream Machineは設定をユーザーにあまり開示していませんが、その分プロンプトの書き方が結果を左右します。**「4K」「HDR」「cinematic」**などの映像クオリティ系キーワードは概ね有効です。解像度自体は自動で高品質ですが、これらを入れるとAIがより映画的美しさを目指す傾向があります。また、昼夜・天候・季節など環境を表す単語も出力を大きく変えるので明記するとよいでしょう。

4. 実現できる表現(スタイル、構図、光、質感、カメラ設定など)とその指定方法

Luma Dream Machineで可能な表現と、その指示方法を具体的に紹介します。

  • フォトリアルな自然風景: 最も得意なのは現実そのもののような自然シーンです。例えば「a tranquil lake in the mountains at dawn, mirror-like reflection」と書けば、山に囲まれた湖に夜明けの薄明かりが差す動画になるでしょう。光の表現も優れており、golden hour sunlight(朝夕の黄金色の光)やsoft shadows(柔らかい影)など入れると、より実写写真のようなトーンが出ます。霧、雪、雨なども積極的に指定して、その状況特有の自然現象(霧が流れる、雪がちらつく等)を起こせます。

  • 街並み・建造物: 都市の風景も、高詳細に生成されます。ただし人や看板文字など細部は抽象化されることが多いです。例えば「walking through a busy Tokyo street at night, neon signs everywhere, rain reflections on the ground」とすれば、ネオン輝く雨の東京の街路映像が得られます。人物はプロンプトに書かなくてもある程度出現する可能性がありますが、細部はぼんやりさせる傾向があります(プライバシー配慮の可能性)。強調したくない場合はempty street(人のいない通り)のように記述しましょう。Lumaは風景重視なので、建物の質感(古びたレンガ、ガラス張り高層ビルなど)を描写してあげると、その場の空気感がよりリアルに出ます。

  • 室内シーン: 室内映像も可能です。例えば「sunlight filtering into an old attic, dust particles floating」(古い屋根裏部屋に差し込む日光と漂う埃)などとすれば、微細な埃の動きまで感じる動画になるでしょう (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。室内は空間が限られる分、Enhance promptがなくてもディテールがしっかり描かれます。小物まで指定すると過剰になるかもしれないので、雰囲気重視で書くと良いでしょう。カメラは固定気味になることが多いですが、handheld camera shake(手持ちカメラの揺れ)など入れると臨場感を加えられます。

  • 人物・生き物: 人物や動物の動きも生成可能ですが、顔の詳細や個体識別は苦手です。例えば「a lion walking across the savannah」と書けばライオンが歩く映像になりますが、顔の模様ははっきりしないでしょう。ただし動きのリアルさは非常に高く、歩行や走行のモーションは自然です (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。人物であれば、silhouette of a woman dancing(女性が踊るシルエット)のように書くと、顔が見えない分動きに集中した映像になるのでおすすめです。アップの人物より、遠景やシルエット、人混みの中といった形で登場させる方が不気味の谷を避けやすいです。

  • ファンタジー・SF: Lumaは現実的なモデルですが、プロンプト次第で非現実も表現できます。例えば「a futuristic cityscape with flying cars, sunset glow」とすれば、かなりリアル寄りな未来都市の映像が得られます。魔法など抽象エフェクトは苦手なようですが、glowing orbs of light floating(光る球体が浮遊)くらいなら表現できるかもしれません。あくまで実写映画の特撮シーンのようなノリで書くと良いでしょう。中世ファンタジーなら「中世ヨーロッパ風の街 + ドラゴンが空を飛ぶ」など、要素を組み合わせ現実×非現実の折衷シーンを狙う形です。

Dream Machineは高精細・高現実感が武器なので、スタイル的には実写映画や高級ドラマの一場面を思い浮かべてプロンプトを作るのがコツです。色調についてはfilm noir style(モノクロハードボイルド)やvibrant colors(鮮やかな色彩)のように言及できますが、モデルが自動でシーンに適した色調を与える傾向もあります。必要以上に指定しなくても、自然で美しい色合いに仕上がるでしょう。

5. 出力品質や応答性を高めるベストプラクティス

Luma Dream Machineを効率的に使い、最高の結果を得るためのヒントをまとめます。

  • シンプルで的確なプロンプト: Dream Machineは高度なモデルゆえ、短いプロンプトでもそれなりに解釈してくれます (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。しかし高品質な結果を安定して得るには、シーンの要点を押さえたプロンプトが理想です。欲張って盛り込みすぎると焦点がぼやけるため、伝えたい主題を一つに絞りましょう。Enhance prompt機能を活用すれば短文でもOKですが、自分で詳細を制御したいなら適度な長さの文章にします。目安として英語で1~2文程度、または箇条書き的にコンマ区切りで3~5要素(場所、時間帯、動き、雰囲気など)を入れるくらいがちょうど良いです。

  • 待ち時間を見越す: 生成には1動画あたり約2分(120フレーム)要します (Luma Labs、無料で使える動画生成AI「Dream Machine」を発表。画像やテキストから5秒の動画を生成)。並列生成はできないため、試行錯誤には時間がかかります。一度に長々と試すより、まず小さく試す姿勢が重要です。例えばEnhance promptオンで大まかに生成→不足部分を確認してプロンプトを足し、Enhance promptオフで再生成、といった段階的アプローチが有効です。無料ベータとはいえ時間リソースは貴重なので、狙いを定めつつ微調整を重ねましょう。また、人気が高まるとサーバー負荷で待たされる可能性もあります。その場合は時間帯をずらすか、諦めずリトライするしかありません。

  • ループ活用: 出力をループさせたい場合、ツール内のLoop機能を使えば簡単です (動画制作を革新するAIソリューション!Luma AI Dream Machine ...)。ループさせる前提でプロンプトを作る場合は、カメラが極端に動くより定点の方が繋ぎ目が自然になります。例えば「ゆっくり波打つ海面」の映像ならループしても違和感ありません。一方「カメラが右へパンする映像」をループすると、戻る瞬間に不自然になりがちです。ループ前提のシーン選びも品質に影響します。

  • 微調整と比較: Lumaは繊細な変化を捉えます。例えば同じプロンプトでも「sunset」→「twilight」に変えるだけで色合いや明るさが変化するでしょう。複数の類語や条件を試して比較すると、自分の好きな雰囲気を見極められます。また、Enhance promptのオンオフでAIの解釈傾向がどう変わるかも見ておくと勉強になります。バージョンアップにも注目しましょう。今後フレーム数や解像度設定が増える可能性があり、その際は新機能を試してみることをお勧めします。

  • アスペクト比の工夫: 明示的な項目はありませんが、入力画像を用いる際などには縦横比を考慮しましょう。5秒動画の解像度は公表されていませんがおそらく横長(16:9程度)です。縦長映像が欲しい場合、あらかじめ縦長の入力画像を与え、それに沿った動画生成を期待する方法もあります。出力をトリミングする手もありますが、必要ならプロンプト中に「vertical video of ...」など書いてみても良いでしょう(通じる保証はありませんが)。

Dream Machine自体には画質やシードなどのユーザー制御は無いので、プロンプト設計と入出力後の工夫が大事です。出力後はMP4動画として保存できるため、必要に応じて動画編集ソフトでさらなる調整(明るさ・コントラスト補正やカット編集)を行うと完成度が上がります。高品質とはいえAI動画特有の若干のチラつきやノイズが気になる場合、Frame Interpolation(フレーム補間)ツールでフレームレートを上げ滑らかにする手もあります。

6. 禁止ワード・制限・生成拒否されやすい表現とその回避方法

LumaのDream Machineも他のサービス同様、安全で倫理的なコンテンツを求めています。明文化されたガイドラインは公開されていませんが、以下の点は避けるべきでしょう。

  • ポルノ・暴力: 写実性が高いだけに、露骨な性的表現や残虐描写は厳禁です。プロンプトにそうした語句を入れてもブロックされるか、Enhance promptが勝手にソフト化する可能性があります。特に人物の裸体や流血シーンなどは生成しないようフィルタされていると考えられます。健全な映像表現に留めましょう。

  • 著名人や特定個人: 実写的な映像なので、特定の実在人物を出そうとするのはディープフェイク扱いされかねません。著名人の名前をプロンプトに入れることは避けるべきです。代わりに「老人男性」「若い女性」のような一般表現に留めます。

  • 過激な政治・差別的内容: 他と同様、政治的プロパガンダや差別表現も禁止でしょう。Lumaはエンタメ向けツールなので、その目的に沿わない物は避けるべきです。

回避方法: 基本は触れないことです。もし意図せず引っかかる場合、言い換えでニュアンスを和らげる方法があります。例えば「テロ爆発現場」を作りたいなら、それは規約上NGと思われますので、「古い建物が崩れる」といった自然災害風の表現に留めるなど。ただ、そうしたセンシティブなテーマ自体をアウトプットすることは推奨されません。Dream Machineはむしろ美しく心地よい映像を手軽に生み出すことに価値があるので、方針に沿った利用を心がけましょう。

7. 上級テクニック(ネガティブプロンプト、反復・重みづけ、LoRA的制御など)

Luma Dream Machineは現状ユーザーが細かくモデルを操作できないため、上級テクニックは主にワークフロー面と他ツール併用になります。

  • ネガティブ的発想: 専用のネガティブプロンプトが無い中で不要要素を抑えるには、Enhance promptをオフにすることが一つの手です。余計なものまでAIが加える恐れがある場合、自動補強を切って自分の言葉だけで指示します。また、プロンプトで「空っぽの」「人影のない」と肯定形で伝えることで、事実上ネガティブの効果を出すこともできます。

  • 複数出力の合成: Runwayのところでも述べましたが、Lumaでもシーンを分割して生成し後で繋ぐことが考えられます。例えば5秒では足りないなら、前半5秒と後半5秒を別々に作り、動画編集ソフトで繋ぐ方法です。カメラ位置や光の具合をプロンプトで合わせる必要がありますが、幸いLumaは物理一貫性が高いので、連続シーンも比較的自然につながります。また、ループ動画を3本くらい用意し、それぞれを順番に再生する事で15秒ループ映像とするなども可能です。

  • Stable Diffusionや他AIとの組合せ: Luma出力をさらに加工したい場合、Stable Diffusionのimg2img機能で各フレームを処理するという高度な手法もあります。例えば絵画調にスタイライズしたければ、Dream Machineの動画をフレームごとに抽出→Stable Diffusionで特定画風に変換→再合成という流れです。これは大変ですが、Dream Machineのリアルな動きに他AIのアートスタイルを載せることで、独自の映像表現が得られます。将来的にLuma自体がスタイル選択を提供する可能性もありますが、現状は手動合成でカバーできます。

  • ファインチューニングの可能性: 現時点ではユーザー側でモデルをチューニングする手段はありません。LoRA的なカスタム要素も利用不可です。しかし、Lumaは将来有料プラン等でユーザーシーンを学習させる可能性もあります(例えば特定建築物の内部など)。上級者は、その時に備え自前データセットを蓄えておくという考え方もあります。例えば自分で撮影した風景写真を何枚か用意し、それを入力画像+プロンプトで似た映像を生成してみるなど、モデルの挙動を研究しておくことも上級者のたしなみと言えます。

8. 他ツールとの違いや応用的な連携活用例

最後に、Luma Dream Machineと他の生成AIツールを比較し、組み合わせ活用の例を紹介します。

まとめ: Luma Dream Machineは現実に迫る映像を誰でも生み出せる画期的なツールです。他の生成AIと比較してユニークな強みを持ちつつ、それらと組み合わせることで弱みも補完できます。静止画AIでデザイン→Lumaで動画化→動画編集で仕上げ、といったワークフローは既に現実のものとなっています (無料で使える動画生成AI「Dream Machine」ってなに?実際に使いながら詳しく解説します! | 株式会社LIG(リグ)|DX支援・システム開発・Web制作) (無料で使える動画生成AI「Dream Machine」ってなに?実際に使いながら詳しく解説します! | 株式会社LIG(リグ)|DX支援・システム開発・Web制作)。今後ツール間の連携がよりシームレスになれば、創作のプロセスはますます効率化し、個人でもリッチな映像コンテンツを生み出せるでしょう。


以上、Midjourney、Runway、Kling、Nijijourney、Lumaそれぞれのプロンプト設計テクニックを網羅しました。各ツールの特性を理解し、適切なプロンプト構築と設定調整を行うことで、想像したイメージを最大限に引き出すことができます。ぜひ本記事のポイントや具体例を参考に、これら生成AIツールを駆使したクリエイティブな画像・動画生成に挑戦してみてください。各ツールの進化は速く、2025年以降も新機能やモデル改良が続くはずです。常に最新情報をキャッチアップしつつ、自身のプロンプトスキルを磨いていけば、表現の幅は無限に広がるでしょう。




いかがでしたか?

 
 
中学生時代、デザインや自作PCの制作などを通して技術・クリエイティブ分野に親しみを持ち中学校卒業後デザイン・クリエイティブを中心に事業を開始、いくつかの法人においてデザイン/クリエイティブ分野の役員を経験しかねてより続けていた「先端技術xクリエイティブ」へとどーのこーの

あなたへのおすすめ