メインコンテンツへスキップ
見出し画像

【ローカルAI】ComfyUIで任意の動画ファイルのアップスケールとフレーム補間する話

  • 割引あり

はじめに

最近の動画アップスケールは、動画生成AIの技術を利用するものが増えてきましたが、筆者が知る限り、(家庭用PCスペックで利用可能な)ローカルAIモデルはまだ無いと思います。

この記事では、昔から利用されている一般的な手法である、画像フレームを一枚ずつアップスケールし、フレーム補間するやり方を、ComfyUIで行う方法を紹介します。

任意の動画ファイルを読み込み、ComfyUIで高画質化する手法です。

※ ワークフローは記事内にてすべて紹介していますが、記事で利用したjsonファイルを有料付録欄に添付しています。

※ 下記事で紹介している動画アップスケール・補間部だけを取り出して、一般の動画ファイルを読み込んで出力する形式にしたものです

※ ComfyUIの動画処理は、AIで生成したようなショート動画・数秒用に特化したもののため、映画並みの2時間などは(出来ないこともないですが)困難です。

流れ

動画ファイルの読み込み

VideoHelperSuiteカスタムノードを利用します。動画解像度(source_width等)取得する事が可能になります

画像

静止画フレームごとにアップスケール

例では、krita-ai-diffusionでもデフォルトになっている、高速で高品質な4x_NMKD-Superscale-SP ESRGANモデルと、JPEGノイズを除去する1x_JPEGDestroyerV2を利用しています。拡大率が異なるため、それぞれ個別に適用した後に、オリジナル画像の2倍のサイズに統一して50%ブレンドします。

※ 画像リサイズには「was-node-suite-comfyui」カスタムノードを利用しています

アップスケーラ・モデルは下記サイトで入手できます。ComfyUIで利用する場合は、ダウンロードしたモデルを「models/upscale_models」に保存します。

4x_NMKD-Superscaleだけだとノイズを増幅する傾向があるので、デノイズ系のアップスケーラーと利用するのが良いと思います。

ただし、数秒でも数百枚処理することになるので、高品質なアップスケーラは処理時間的に難しいです。

画像

※ その他アップスケールモデルに関しては下記事を参考ください

フレーム補間(フレーム生成)

Frame-Interpolationカスタムノードを利用します。例では、写実系に特化したFILM VFIを利用しています。

画像

FILM VFI以外にも、アニメに特化したものなどの複数のモデルが利用可能です。

※ Frame-Interpolationカスタムノード・リポジトリはこちら

動画に出力

fpsを指定して出力します。例では、解像度、fpsが共に2倍にしたファイルが出力されます。

画像

まとめ

ComfyUIで生成した動画に限らず、一般的な動画ファイルをComfyUIを利用してアップスケール&フレーム補間する手法です。

将来的には、個別の静止画のアップスケールではなく、WAN Video等のオープンになっている動画生成技術を利用した動画アップスケールもローカルで可能になると思います。

静的なフレームごとの高画質化だけでなく、時間軸の情報もAIが利用できるため、アップスケーラとしてはかなり有利になるはずです。家庭用PCでは難しいのかもしれませんが。

付録

本記事で紹介したワークフローjsonファイルです。記事支援いただける場合はぜひよろしくお願いします。

 
 
3Dアート作品や3Dモデルデータも扱っています。最近は専らAIを利用した作品が多いです。 ※ BOOTHにて各種販売も行なっております。 https://lit.link/catappart3d

あなたへのおすすめ