
【MiniMax H3】AI動画の「AIっぽさ」が消えた。効いたのは“下手なカメラ”を指定する3つの設定
こんにちは、ルアラボの案内役、ルアです。
AIで作った動画って、ひと目で「あ、AIだな」と分かることが多いですよね。色がやけに鮮やかで、肌や布がつるっとしていて、どこかプラモデルのよう。今回は、その「AIっぽさ」を消すために僕が変えた3つの設定の話です。
意外だったのは、効いたのが「もっときれいに」ではなく、「わざと下手なカメラで撮ったように」という指定だったことです。
読んでみて「これは試してみたい」と思ったら、スキ(♡)を押してもらえるとうれしいです。フォローしておくと、次の記事も届きます。
前半:なぜAIの動画は「AIっぽい」のか
まずは見てください
夜の山の尾根で、白いフードの人物が星空の下でノートパソコンを開いている場面です。これは全部、AIが作った動画から抜き出したコマです。

天の川はくすんだ茶色で、岩はごつごつ、空には夜の写真らしいざらつきがあります。
同じ日に、設定を入れずに同じような場面を作ったときは、まるで違いました。左が設定を入れたもの、右が入れなかったものです。

右は色が濃く、岩はぬいぐるみのようにふっくらして、絵画のような仕上がりです。さらに、「後ろ姿のまま」と頼んだ人物が、途中でこちらを向いてしまいました。
「きれいすぎる」のがAIっぽさの正体
本物のカメラで夜に撮ると、実はいろいろ「失敗」しています。
暗いところに、細かいざらざら(ノイズ)が出る
明るいところは白く飛び、暗いところは黒くつぶれる
画面の端で、色がほんの少しずれる
電灯の近くは黄色っぽく、庭は青っぽく、色味がそろわない
僕たちは、こうした「失敗」を見慣れているので、無意識に「本物だ」と感じます。ところがAIは放っておくと、失敗のない、きれいに仕上げた映像を作ろうとします。ノイズはなく、色はくっきり、すべてにピントが合っている。その「きれいすぎる」感じが、AIっぽさの正体でした。
たとえるなら、写真館で完璧に修整した記念写真と、友だちがスマホで撮ったスナップの違いです。「本物っぽい」のは、スナップのほうなんですよね。
効いた3つの設定
速く作るための近道(Turbo)を切る。いちばん効きました。近道を使うと、仕上がりがつるっとした、ぬいぐるみのような質感になります
「素人が実際に撮った映像」と書き、カメラの失敗を具体的に頼む。「映画のように」「シネマティックに」とは書きません
きれいに整えない。色の加工やふんわりした光を「入れないで」と並べ、被写体にも不揃いなところを1つ入れます(「段ボールの角がつぶれている」「値札の立て方がばらばら」など)
3つを全部入れて作った、雨上がりの商店街の八百屋の場面がこちらです(動画から4コマを並べたもの)。これもAIが作った映像です。

濡れた路面、店の中の白っぽい蛍光灯と外の青い曇り空の色のずれ、角のつぶれた段ボールが、そのまま出ています。
ひとつ残念だったのは、看板やのぼりに日本語のような、読めない文字が出たことです。「読める文字は入れないで」と書きましたが、文字らしき模様までは止まりませんでした。
かかった時間と費用
ここは正直に書きます。AIっぽさを消すと、時間がかかります。
近道あり(粗めの画質):8.5秒の動画1本 約4分
近道なし(少し細かい画質):8秒の動画1本 約15分(873秒)。GPU 代は約 $0.12(約19円)
GPU は RunPod の NVIDIA A40(1時間 $0.49)です。円は1ドル=約157.5円(2026年9月26日)で換算しています。
1本あたり4倍ほど待つことになりますが、お金にすると20円ほどです。僕は、人物や実写に見せたい場面は近道なし、宇宙の図解のようなイメージ映像は近道ありと、使い分けることにしました。
後半:技術の話
ここからは、ComfyUI で MiniMax H3 を動かしている人向けです。
生成の設定
Turbo LoRA:有効(4ステップ) → 無効(20ステップ)。静止・小さな動きのショットで、プラスチックのような過剰なシャープ感が出る
megapixels:0.6(608×1056) → 0.8(672×1216)。細部の情報量を増やす
静止画カット(実写素材):そのまま → ffmpeg で微量のフィルムグレイン。生成クリップと質感をそろえる
Turbo の有無の比較(2026-09-25)
同じ回の動画で、同じ尾根の場面を Turbo あり・なしで1カットずつ作りました。条件は A40、0.8MP、16:9、10秒指定(出力 10.125秒・1216×672)、Reference-to-Video(人物の参照画像4枚)です。
Turbo 無効(上のコマ並べ):1282秒。写真のように自然。後ろ姿を最後まで保った
Turbo 有効:約6分。色が濃く絵画的。「後ろ姿のまま」の指示が崩れ、途中で横〜正面を向いた
Turbo を切ると、見た目だけでなく指示の守り方もよくなりました。ただし、この2カットはプロンプトの場面の書き方も少し違うので、厳密な対照実験ではありません。
僕は最初「夜の引きの画だから、近道でも足りるだろう」と判断して Turbo を入れていました。その判断は外れました。僕は作ったクリップを作り直さない運用にしているので、今は実写に見せたいカットを最初から Turbo なしで作っています。
プロンプトの書き方
MiniMax H3 の Reference-to-Video は、公式の英語6セクションの形式で書いています。AIっぽさに効くのは detailed_description の頭に置く段落です。要点はこの3つです。
最初に「本物の、編集していない映像」だと宣言する:genuine, unedited footage a person actually shot on a mirrorless camera, not like a rendered or cinematic image
カメラの欠点を名前で頼む:暗部のノイズ、白飛び・黒つぶれ、周辺の色収差、ピントの甘さ、オートホワイトバランスのばらつき
後処理を否定形で並べる:no colour grading, no teal-and-orange look, no bloom, no HDR tone mapping, no over-sharpening, no plastic smoothness
さらに被写体の素材感(布のしわ、木目の傷、ほこり)と、不揃いなところを1つ以上書きます。
分かっていないこと
プロンプトの変更と 0.8MP は同時に入れたので、どちらがどれだけ効いたかは切り分けていません。確かめるなら、同じシードで1つずつ切り替えるのが先です
0.8MP より上げた場合の効果と時間は測っていません
おわりに
「AIっぽさを消したい」と思うと、つい「高精細に」「リアルに」と書き足したくなります。でも僕の場合は逆で、本物のカメラが起こす失敗を、こちらから頼むほうが効きました。
この記事の続きとして、どの場面でも実写に見えるプロンプトを自分で書くための型を、別の記事にまとめました。機材や光の条件ごとの書き方、「不完全さ」の4つの型、日本語のアイデアからプロンプトにする手順があります。実際に使ったプロンプトの全文と、それぞれで作った画、Turbo の有無・解像度ごとの所要時間の表も入れています。そのまま貼って試したい人は、こちらもどうぞ。
役に立ったら、スキやフォローで教えてもらえると励みになります。
AIの利用について
この記事の構成と下書き、画像の作成にAI(Claude)を使っています。記事中の動画のコマはAI(MiniMax H3)で生成したものです。公開前には人が確認しています。