メインコンテンツへスキップ
見出し画像

MiniMax H3の動画、1本いくら? クラウドで「使うたびに作って壊す」運用を実測したら1本13円だった話

こんにちは、ひよりあかねです。

今回は「クラウドGPUで動画を1本作ると、結局いくらかかるの?」を、実際に何回も回して計測した記録です。

測ってみると、日本のRTX 4090ホストで1セッション$0.251(約38円)で3本、1本あたり約$0.084(約13円)でした。
※金額は1ドル=150円で換算しています。

公式APIだと768P・5秒で$0.40(約60円)なので、だいたい1/5です。最初に手動でやったときは1本$1.06(約159円)だったので、そこからはスクリプト化で1/12まで下がりました…!✨

有料パートでは、この「検索→作成→生成→回収→破棄」をMacから1コマンドでやってくれるスクリプト一式を配布しています。

実行本数合計1本あたり手動 T2V(09-25)1約1.06ドル(転送別)約1.06ドル(約159円)スクリプト T2V(転送単価の高いホスト)1約0.57ドル(推定)約0.57ドル(約86円)スクリプト I2V×220.142ドル0.071ドル(約11円)スクリプト T2V+I2V×2(転送込み最安で選定)30.158ドル0.053ドル(約8円)スクリプト T2V+I2V×2(RTX 4090・日本ホスト)30.251ドル約0.084ドル(約13円)公式API 768P 5秒10.40ドル0.40ドル(約60円){\scriptsize \begin{array}{|l|c|c|c|} \hline \textsf{\textbf{実行}} & \textsf{\textbf{本数}} & \textsf{\textbf{合計}} & \textsf{\textbf{1本あたり}} \\ \hline \textsf{手動 T2V(09-25)} & 1 & \textsf{約1.06ドル(転送別)} & \textsf{約1.06ドル(約159円)} \\ \hline \begin{array}{l} \textsf{スクリプト T2V} \\ \textsf{(転送単価の高いホスト)} \end{array} & 1 & \textsf{約0.57ドル(推定)} & \textsf{約0.57ドル(約86円)} \\ \hline \textsf{スクリプト I2V×2} & 2 & \textsf{0.142ドル} & \textsf{0.071ドル(約11円)} \\ \hline \begin{array}{l} \textsf{スクリプト T2V+I2V×2} \\ \textsf{(転送込み最安で選定)} \end{array} & 3 & \textsf{0.158ドル} & \textsf{0.053ドル(約8円)} \\ \hline \begin{array}{l} \textsf{スクリプト T2V+I2V×2} \\ \textsf{(RTX 4090・日本ホスト)} \end{array} & 3 & \textsf{0.251ドル} & \textsf{\textbf{約0.084ドル(約13円)}} \\ \hline \textsf{公式API 768P 5秒} & 1 & \textsf{0.40ドル} & \textsf{0.40ドル(約60円)} \\ \hline \end{array} }

覚えておいてほしいポイントは3つだけです。

  • 1セッションの固定費は約$0.11です。中身は起動、依存導入、モデル約48GBのダウンロード、転送料金。

  • 1本追加するごとの費用は約$0.01〜0.02です(ComfyUIの実行75〜127秒 × 約$0.56/hr)。

  • 総額を一番大きく動かすのは、時間単価ではなく意外にも転送単価でした。

今回、したかったこと

MiniMax H3は、映像とステレオ音声を同時に生成してくれる動画モデルです。台詞や環境音、BGMまで出てくるので、すごく楽しいんですよね。

ただ、わたしのメイン機はM1 Max(64GB)で、NVIDIA GPU/CUDAは持っていません。しかし、今は購入するにも値上げであまり考えられませんし、でもH3を本気で何度も回すならほしいところです。

そこで考えたのが次の構成です。

  • Vast.ai(個人ホストも含むGPUマーケットプレイス。安い)

  • Vast CLIで検索・作成・破棄

  • 推論はComfyUI公式のネイティブワークフロー(T2V / I2V)をAPI経由で実行

第1ラウンド:手動でやったら1.8時間、約$1.06

最初は手順書を作ってそれを見ながら、全部手作業でやりました。

項目値GPURTX 4090 ×1(ホストRAM 188GiB)所在地Japan料金0.578ドル/hr(ディスク120GB込み)イメージvastai/base-image:cuda-12.8.1-auto生成時間129.5秒(T2V 1本)作成→破棄約1.8時間{\scriptsize \begin{array}{|l|l|} \hline \textsf{\textbf{項目}} & \textsf{\textbf{値}} \\ \hline \textsf{GPU} & \textsf{RTX 4090 ×1(ホストRAM 188GiB)} \\ \hline \textsf{所在地} & \textsf{Japan} \\ \hline \textsf{料金} & \textsf{0.578ドル/hr(ディスク120GB込み)} \\ \hline \textsf{イメージ} & \textsf{vastai/base-image:cuda-12.8.1-auto} \\ \hline \textsf{生成時間} & \textsf{129.5秒(T2V 1本)} \\ \hline \textsf{作成→破棄} & \textsf{約1.8時間} \\ \hline \end{array} }

生成そのものは2分ちょっとで終わるのに、作成から破棄までは1.8時間かかりました。ほとんどが「わたしがコマンドを打つのを待っている時間」なんですよね、、、😭

しかも出だしからつまずきました。vastai-automatic-tag のイメージで作ったら、10分以上 loading のまま動かなくて。結局、何度も破棄して起動し直して、CUDAタグを cuda-12.8.1-auto に固定して作り直したら一発で起動しました。

その後、モデルのダウンロードはこんな感じでした。

ファイルサイズ時間速度audio VAE fp320.6GB93秒6.5MB/svideo VAE fp165.2GB3分18秒33.7MB/sFL2VA pruned int821.0GB6分45秒119MB/sQwen3-VL 32B nvfp415.7GB4分44秒112MB/sTurbo 8step LoRA2.0GB31秒83.8MB/s{\scriptsize \begin{array}{|l|c|c|c|} \hline \textsf{\textbf{ファイル}} & \textsf{\textbf{サイズ}} & \textsf{\textbf{時間}} & \textsf{\textbf{速度}} \\ \hline \textsf{audio VAE fp32} & \textsf{0.6GB} & \textsf{93秒} & \textsf{6.5MB/s} \\ \hline \textsf{video VAE fp16} & \textsf{5.2GB} & \textsf{3分18秒} & \textsf{33.7MB/s} \\ \hline \textsf{FL2VA pruned int8} & \textsf{21.0GB} & \textsf{6分45秒} & \textsf{119MB/s} \\ \hline \textsf{Qwen3-VL 32B nvfp4} & \textsf{15.7GB} & \textsf{4分44秒} & \textsf{112MB/s} \\ \hline \textsf{Turbo 8step LoRA} & \textsf{2.0GB} & \textsf{31秒} & \textsf{83.8MB/s} \\ \hline \end{array} }

合計約44GBで、約15分かかりました。大きいファイルは100MB/s以上出ていたので、「都度ダウンロードでも現実的にいけそう」という感触はつかめました。

でも、手動で1本に$1.06かかるのは高すぎます。また、実行する手間もありこれなら公式APIの方が安いです。

というわけで、高速化のためにスクリプト化しました。

第2ラウンド:スクリプト化で9分12秒!…なのに$0.57

Macから1コマンドで、次の流れを全部やるスクリプトを作りました。

検索 → 作成 → SSH接続 → セットアップ → モデルDL → ComfyUI起動 → 生成 → 回収・SHA-256検証 → 破棄

結果、作成から破棄まで9分12秒です。手動の1.8時間からすると、別物みたいに速くなりました。

段階秒起動(create → running)36セットアップ(apt・venv・torch・ComfyUI依存)142モデルDL(44.43GB、約380MB/s)116ComfyUI起動18生成(ComfyUI実行 195.8秒)201回収11合計552{\scriptsize \begin{array}{|l|r|} \hline \textsf{\textbf{段階}} & \textsf{\textbf{秒}} \\ \hline \textsf{起動(create → running)} & 36 \\ \hline \textsf{セットアップ(apt・venv・torch・ComfyUI依存)} & 142 \\ \hline \textsf{モデルDL(44.43GB、約380MB/s)} & 116 \\ \hline \textsf{ComfyUI起動} & 18 \\ \hline \textsf{生成(ComfyUI実行 195.8秒)} & 201 \\ \hline \textsf{回収} & 11 \\ \hline \textsf{\textbf{合計}} & \textbf{552} \\ \hline \end{array} }

時間課金は $0.076です。「やったー!1本11円!!」と思ったんですが、、、

転送料金を見落としていました。

このホストは、ダウンロードが1GBあたり$0.0104でした。約48GB落とすので、それだけで約$0.50です。時間課金の6倍以上で、合計は約$0.57になりました。ひぇぇぇ。

Vast.aiは、ホストごとに転送単価がバラバラなんです。今回見た範囲だけでも $0〜$0.0133/GB まで幅がありました。48GBに換算すると、ほぼタダのホストと$0.60以上かかるホストがある計算です。

今回に限っては、単に「時間単価の安い順」で選ぶと高いホストを選んでしまうということです🥲

 
 
 
こんにちは、ひよりあかねラボです。 このnoteでは、Macで規制解除を前提としたローカルAIでのイラスト制作過程や実験の記録などを書いていきます。特に記事内に記載が無ければ規制解除されたモデルやツールが前提です。 文章には補助的にAIを使用してます。

あなたへのおすすめ