メインコンテンツへスキップ
見出し画像

【MiniMax H3】AI動画の「AIっぽさ」が消えた。効いたのは“下手なカメラ”を指定する3つの設定

    ルアラボ⚙️Rouage AI Lab

    こんにちは、ルアラボの案内役、ルアです。

    AIで作った動画って、ひと目で「あ、AIだな」と分かることが多いですよね。色がやけに鮮やかで、肌や布がつるっとしていて、どこかプラモデルのよう。今回は、その「AIっぽさ」を消すために僕が変えた3つの設定の話です。

    意外だったのは、効いたのが「もっときれいに」ではなく、「わざと下手なカメラで撮ったように」という指定だったことです。

    読んでみて「これは試してみたい」と思ったら、スキ(♡)を押してもらえるとうれしいです。フォローしておくと、次の記事も届きます。

    前半:なぜAIの動画は「AIっぽい」のか

    まずは見てください

    夜の山の尾根で、白いフードの人物が星空の下でノートパソコンを開いている場面です。これは全部、AIが作った動画から抜き出したコマです。


    画像

    天の川はくすんだ茶色で、岩はごつごつ、空には夜の写真らしいざらつきがあります。

    同じ日に、設定を入れずに同じような場面を作ったときは、まるで違いました。左が設定を入れたもの、右が入れなかったものです。


    画像

    右は色が濃く、岩はぬいぐるみのようにふっくらして、絵画のような仕上がりです。さらに、「後ろ姿のまま」と頼んだ人物が、途中でこちらを向いてしまいました。

    「きれいすぎる」のがAIっぽさの正体

    本物のカメラで夜に撮ると、実はいろいろ「失敗」しています。

    • 暗いところに、細かいざらざら(ノイズ)が出る

    • 明るいところは白く飛び、暗いところは黒くつぶれる

    • 画面の端で、色がほんの少しずれる

    • 電灯の近くは黄色っぽく、庭は青っぽく、色味がそろわない

    僕たちは、こうした「失敗」を見慣れているので、無意識に「本物だ」と感じます。ところがAIは放っておくと、失敗のない、きれいに仕上げた映像を作ろうとします。ノイズはなく、色はくっきり、すべてにピントが合っている。その「きれいすぎる」感じが、AIっぽさの正体でした。

    たとえるなら、写真館で完璧に修整した記念写真と、友だちがスマホで撮ったスナップの違いです。「本物っぽい」のは、スナップのほうなんですよね。

    効いた3つの設定

    1. 速く作るための近道(Turbo)を切る。いちばん効きました。近道を使うと、仕上がりがつるっとした、ぬいぐるみのような質感になります

    2. 「素人が実際に撮った映像」と書き、カメラの失敗を具体的に頼む。「映画のように」「シネマティックに」とは書きません

    3. きれいに整えない。色の加工やふんわりした光を「入れないで」と並べ、被写体にも不揃いなところを1つ入れます(「段ボールの角がつぶれている」「値札の立て方がばらばら」など)

    3つを全部入れて作った、雨上がりの商店街の八百屋の場面がこちらです(動画から4コマを並べたもの)。これもAIが作った映像です。


    画像

    濡れた路面、店の中の白っぽい蛍光灯と外の青い曇り空の色のずれ、角のつぶれた段ボールが、そのまま出ています。

    ひとつ残念だったのは、看板やのぼりに日本語のような、読めない文字が出たことです。「読める文字は入れないで」と書きましたが、文字らしき模様までは止まりませんでした。

    かかった時間と費用

    ここは正直に書きます。AIっぽさを消すと、時間がかかります。

    • 近道あり(粗めの画質):8.5秒の動画1本 約4分

    • 近道なし(少し細かい画質):8秒の動画1本 約15分(873秒)。GPU 代は約 $0.12(約19円)

    GPU は RunPod の NVIDIA A40(1時間 $0.49)です。円は1ドル=約157.5円(2026年9月26日)で換算しています。

    1本あたり4倍ほど待つことになりますが、お金にすると20円ほどです。僕は、人物や実写に見せたい場面は近道なし、宇宙の図解のようなイメージ映像は近道ありと、使い分けることにしました。

    後半:技術の話

    ここからは、ComfyUI で MiniMax H3 を動かしている人向けです。

    生成の設定

    • Turbo LoRA:有効(4ステップ) → 無効(20ステップ)。静止・小さな動きのショットで、プラスチックのような過剰なシャープ感が出る

    • megapixels:0.6(608×1056) → 0.8(672×1216)。細部の情報量を増やす

    • 静止画カット(実写素材):そのまま → ffmpeg で微量のフィルムグレイン。生成クリップと質感をそろえる

    Turbo の有無の比較(2026-09-25)

    同じ回の動画で、同じ尾根の場面を Turbo あり・なしで1カットずつ作りました。条件は A40、0.8MP、16:9、10秒指定(出力 10.125秒・1216×672)、Reference-to-Video(人物の参照画像4枚)です。

    • Turbo 無効(上のコマ並べ):1282秒。写真のように自然。後ろ姿を最後まで保った

    • Turbo 有効:約6分。色が濃く絵画的。「後ろ姿のまま」の指示が崩れ、途中で横〜正面を向いた

    Turbo を切ると、見た目だけでなく指示の守り方もよくなりました。ただし、この2カットはプロンプトの場面の書き方も少し違うので、厳密な対照実験ではありません。

    僕は最初「夜の引きの画だから、近道でも足りるだろう」と判断して Turbo を入れていました。その判断は外れました。僕は作ったクリップを作り直さない運用にしているので、今は実写に見せたいカットを最初から Turbo なしで作っています。

    プロンプトの書き方

    MiniMax H3 の Reference-to-Video は、公式の英語6セクションの形式で書いています。AIっぽさに効くのは detailed_description の頭に置く段落です。要点はこの3つです。

    • 最初に「本物の、編集していない映像」だと宣言する:genuine, unedited footage a person actually shot on a mirrorless camera, not like a rendered or cinematic image

    • カメラの欠点を名前で頼む:暗部のノイズ、白飛び・黒つぶれ、周辺の色収差、ピントの甘さ、オートホワイトバランスのばらつき

    • 後処理を否定形で並べる:no colour grading, no teal-and-orange look, no bloom, no HDR tone mapping, no over-sharpening, no plastic smoothness

    さらに被写体の素材感(布のしわ、木目の傷、ほこり)と、不揃いなところを1つ以上書きます。

    分かっていないこと

    • プロンプトの変更と 0.8MP は同時に入れたので、どちらがどれだけ効いたかは切り分けていません。確かめるなら、同じシードで1つずつ切り替えるのが先です

    • 0.8MP より上げた場合の効果と時間は測っていません

    おわりに

    「AIっぽさを消したい」と思うと、つい「高精細に」「リアルに」と書き足したくなります。でも僕の場合は逆で、本物のカメラが起こす失敗を、こちらから頼むほうが効きました。

    この記事の続きとして、どの場面でも実写に見えるプロンプトを自分で書くための型を、別の記事にまとめました。機材や光の条件ごとの書き方、「不完全さ」の4つの型、日本語のアイデアからプロンプトにする手順があります。実際に使ったプロンプトの全文と、それぞれで作った画、Turbo の有無・解像度ごとの所要時間の表も入れています。そのまま貼って試したい人は、こちらもどうぞ。

    役に立ったら、スキやフォローで教えてもらえると励みになります。

    AIの利用について

    この記事の構成と下書き、画像の作成にAI(Claude)を使っています。記事中の動画のコマはAI(MiniMax H3)で生成したものです。公開前には人が確認しています。

     
     
     
    AIを仕事と制作に組み込み、動かした記録を置くnote。 動画・記事の自動化、Claude Code、生成AIの使いどころ。 効いた設定も壊れ方も数字で出します。スクリプトと設定値は有料記事に。

    あなたへのおすすめ