メインコンテンツへスキップ
見出し画像

生成AIアニメ「かわいそうな知性」批評~広告とtapehead.lab作品に見るAI創作~

     ことXにおいて強烈な批判にさらされる創作における生成AIであるが、その中でも特に批判を受けているジャンルは何かと言えばAIアニメだろう。AIイラストやロゴに関してはChatGPTのnano banana登場辺りから一般層からの評価が改善してきたような印象を受けるが、こと生成AIを使用したアニメに関しては未だに不出来を指摘される場合が多い。

     だが、それでもAIを使用したアニメという創作技法は様々検討されてきた。特に広告というジャンルとAIアニメのつながりは深く、生成AIでアニメを作ると言う施策が商用利用された走りは2024年、auの『三太郎シリーズ』に遡る。
     以降も生成AIで映像を作れるSoraの登場、Sora2による爆発的なクオリティの上昇と利用者の増加を経て、現状最新鋭の動画生成AIとして注目されているSeedance2.0が登場した。

     そしてAIアニメの現状の答えとして登場したのが、アニメにSeedance2.0を用いて、イメージにはMidjourneyを、音楽はSunoで制作したMV『かわいそうな知性』である。
     本アニメの制作者であるtapehead.lab(以下、tapehead)は数々のMVを生成AIで制作しているが、これまで制作されてきた生成AIアニメとは明らかに別ベクトルでのクオリティを見せてきた。本作は生成AIアニメにおける新しい一歩であることを、本稿では論じていきたい。

    ・何故生成AI産のアニメは低品質なのか

     AIで制作されたアニメが低評価を受ける理由はいくつかあるが、主だった理由は下記4つである。

    ・作画に致命的な破綻が存在する
    ・必要な作画の破綻が存在しない
    ・現状公開されている傑作を上回れていない
    ・生成AIユーザー/生成AI批判者自身の問題

    ・作画に致命的な破綻が存在する

    🧡💭🧡💭🧡💭🧡💭🧡
    この食感、はじめまして。#とろむにゃ食感 が特徴の#もちきゅあ
    こんなときにいかがですか?
    💜💭💜💭💜💭💜💭💜

    もちきゅあについてはこちらから👇https://t.co/VOij8eLS2s#三幸製菓 #おもちのようなグミ pic.twitter.com/rpGvuiqDiz

    — 三幸製菓 (@sankoseika) September 9, 2024

     これに関してはわざわざ書かれなくても分かる人は多いだろう。出来がひどいものでは指が6本あったり、シーンごとにキャラクターの個性が指定しきれていなかったりと、素人でも指摘できるミスが残されている場合が多いのが評価を落とす原因である。
     またこれは技術的な問題であるが、静止しているべき背景がぐねぐねと動き回っているという所もしばしば指摘される所だ。固形であるはずの地面の煉瓦が動いているとか、壁のざらざらがうごめいているとか、どうしても発生する破綻が存在する。
     これは手書きのアニメにおいてはそう発生しないことであるし、現実においても何かしらの理由が無ければ発生しない齟齬である。このような不備は技術発展により改善しつつある。

    ・必要な作画の破綻が存在しない

     だが、どちらかと言えば生成AIアニメの面白味の無さとは必要な作画の破綻が存在していないことにあるだろう。
     例えばウォルト・ディズニーが1941年に公開したアニメ映画『ダンボ』を見ると分かりやすいのだが、「本来はあり得ない動きをしているが面白い動き」が人間の作ったアニメには多数存在する。走り出したら上体が置き去りにされつつも下半身だけが前に動くとか、液体の表現でもダンボの涙は少しねっとりと落ちているとか、幻想的なゾウの動きとダンボなど実在のゾウの動きは動きの粒度が異なるとか、現実的に考えると様々なおかしな点がある。
     しかしこれは創作者が強調したい部分が意図的に破綻していたり、逆に強調すべきでない部分は描き方を変えたりすることによってアニメ表現の面白さを出すことに成功している例である。このような作画は素人が見ても「作画崩壊だ」と指摘することは無い、表現の面白さとして取り入れられる。

     ことAIが作画すると、この面白味に欠けてしまうことがある。
     例えば『ドラベル』というゲームで広告用に公開されたAIアニメを見て欲しいのだが、確かに人物の動きには目立った破綻が無く、カメラ内に少女の走る様がきちんと収まっている。だがこれはきちんと画角に収まっているだけで、見ていて面白いアニメではない。
     素早い走りを描写するうえでは人体すべてを描き続ける必要は無い。いくつかのコマをあえて欠落させたり、人の走る動きの中でもピックアップしたいところに注目したい所に拡大することによって人間の走りの描写をイキイキとしたものに変えることに出来るのだが、これをするには独自にアングルを指定しないといけない。
     もちろんこれは6秒以内の広告なのでそんなカット割りまで気にすることが出来なかった可能性は考慮できる。しかしここまでこだわれるか、あるいはプロンプトの入力者がこだわらずともAI側で勝手にここを意識した作画をしてくれるかというのは、今後の生成AIアニメの評価において重大な評価点になるだろう。

    ・現状公開されている傑作を上回れていない

     だが一番の理由は、生成AIを主にしたアニメが現状公開されている傑作の部類に属するアニメーションを上回れていないことである。
     たとえ研究中の技術であったとしても、いつだって作品を評価する際は過去の傑作と比較される。『トムとジェリー』、スタジオジブリ作品など、トップクラスの作品は当然のように生成AI側が模倣すべくデータを取っている。
     しかし、それらの画風は全て既存作品の劣化コピーにしかなっていない。
     オリジナル性の欠如は多くの生成AI作品の突き当たる問題で、個人使用の範疇ならまだしも他者に評価してもらうための作品として世に出した際に、その制作物の個性の無さに突き当たることになる。
     一部の生成AIユーザーが人の手描き風の絵柄を研究し始めるのは個性の無さを補うための行為であるのだが、単に何者かの手描きの絵柄を模倣したところでやはりそれは手描きの劣化コピーになり、傑作としては捉えられない。ここを誤って解釈しているせいで、単に下手で面白味も無いAI作品を出力して満足するアカウントに堕してしまう例はいくつか見受けられる。

     昨今の「『NTE:Neverness to Everness』生成AIアニメ映画問題」や「ウテナモイスチャーのセーラームーンパクリアニメ問題」も、結局は元ネタが分かる上に元ネタを上回れなかったのが真実である。
     NTEに関しては背景アートだからそれらしければ良いと思ったのかもしれないし、ウテナモイスチャーもクオリティ的に充分だと思ったのだろう。しかしパクリ元が明白な程度のクオリティだった上に、生成AI作品特有の懸念点を充分に払拭できなかった。当然クオリティさえ良ければ許されるとまではいかないが、クオリティが劣化コピーで学習元が不明瞭となれば批判は免れない。

    ・生成AIユーザー/生成AI批判者自身の問題

    画像
    参考リンク

     作品に対する問題ではなく使用者のモラルの問題なのだが、これが現代における生成AIを採用した作品に対して評価を見誤る大きな要因であると感じている。
     そもそも既存の画風を学習させて模倣品を出力する行為自体が盗作行為に等しいという指摘は生成AIの登場当初から指摘されていたことであるが、これに対して生成AIユーザーの一部は法的にはセーフだとか、グレーだとかいうラインで誤魔化し、大々的に説明することも無く生成AIの使用を推し進めてきた。
     この問題は未だに議論が続けられているところである。法的にはセーフでも倫理的には良くないという意見も数多く見られ、実際のところ本当にグレーラインの使用を続けている所もあれば、なるべく潔白に使用している例もあるだろう。

    画像
    参考リンク:神への造反者:ロストオリジン 5/11投稿

     しかし完全なる黒の例として、広告における生成AI素材を使用した著作権侵害は2026年5月現在今もなお続く問題である。だがこれらの問題に対して解決の見込みは無く、悪質なAI使用者ら、ひいては企業は世界全体でAIの適切な使用方法の検討や規制を行わずにAIの利益だけを享受しようとしているのが現状である。
     そしてこれらの繊細な問題点を無視して意図的に利益のみを享受した挙句、既存のアニメーターは廃業だの、イラストレーターの仕事は無くなるだのという挑発的な発言を無思慮に行ってしまうAI利用者の発言の愚かしさは直視し難いものがある。現在存在する大半のAI作品はソフトウェアの性能の素晴らしさだけで勝負しているのであって、出力する人間側の工夫や意図が伝わる作品はほぼ見られない。
     例えAIに仕事が奪われるという言葉が事実であったとして、道具の性能に頼り切りにも関わらず他者に傲慢な態度を取る存在と誰が対話したいのか。

     だが生成AIを批判する側も、AIを一部に使用しているというだけで正確な評価が行えなくなっている点は留意すべきである。
     生成AIが使用されていると分かっただけで過去の生成AIユーザーの罪を必要以上にあげつらって、その作品が優れていたとしても「でも生成AIが使われているから」の一点張りでまともに生成AIを使用した作品の批評が進んでいないのもまた重大な問題である。生成AIユーザー側の問題はもちろん軽視すべきではないが、同様に生成AIが採用された作品も軽視すべきではない。
     この傲慢なAI利用者の発言と先鋭化したAI規制派の批判双方に見られるのは、作品その物への軽視である。新技術のデモンストレーション、収益性、生成AIの使用有無などの要素ばかりに目を向けて、まともに作品を見ずに刺激的な意見の付和雷同に徹するばかりの人間があまりにも多い。
     これが生成AIが登場して1年目の鑑賞態度であればまだ仕方ないかもしれないが、もう生成AIが市民ベースで使われるようになって4年も経過するにも関わらず未だにAI作品そのものがまともに鑑賞されていないのは不健全である。生成AIに関する諸問題と作品を完全に切り離すことは不可能であるにしても、どのように道具が用いられているかを慎重に検証したうえで最終的な作品への評価を下すべきだ。

    ・生成AIアニメの制約とそれを超える工夫

     生成AIアニメでも出来が良いものを見ると優れた創作道具のように見えるが、「何故生成AI産のアニメは低品質なのか」の項で述べた通り技術的な制約はまだ存在している。特に作画の破綻問題に関しては、いくつかの手法で解決を試みられている。

     基礎技法として、短い映像かつ動きが少ないなら破綻が少ないことを活かしてクオリティの高さを維持するやり方がある。
     ここまでは日本企業産のAIアニメでもしばしば見られる工夫で、ケアパートナー株式会社やプレックスジョブのAIアニメ広告は3秒程度の映像を3種導入することで登場人物のバリエーションの広さと動きの安定性を取っている。
     短時間で完結させなければならない広告と、短時間で完結させなければクオリティが低下する生成AIアニメは、双方の制約が見事に噛み合った領域だと言える。しかも現代広告はとかく低コスト化が求められるため、生成AIによってコストカットが出来ればさらに都合が良い。
     生成AIアニメ分野においては広告が最も先進的であると自分が仮説を立てていたのは上記の理由が大きかった。生成AIアニメと広告は見事に利害が一致しており、より有効な広告を発見するためのABテストと、一つプロンプトを用意すれば複数案を出力できるが故の試行錯誤の容易さもまた、広告界隈における生成AIアニメ研究を加速させる要因となった。

    画像
    参考リンク:運命逆転 2025年11月18日投稿

     細かなカットを活用して1本のストーリーを形成する領域にまで至ったのが『運命逆転』の広告である。
     特に弁護士の美門が詰め寄ってくるシーンで細かくカットを分け、こちらに勢いよく迫ってくるように見えるのは丁寧に全てのカットを用意しなかったが故の成果だと言えよう。手描きアニメ特有の全て描写しないという手法をAIアニメに導入するとこうなる、という一例だ。
     無論背景を見ると齟齬があるという見方もあるが、短時間で細かく絵を変えている影響で背景の齟齬もそこまで気にならなくなっているのも狙いが成功していると言える。

     『異世界のんびりライフ』や『Topheroes』で取り入れられているのはドット絵風にして作画の粗さを誤魔化してしまうというやり方。サンプルの広告では「13:00 PM」のシーンでは不自然な背景の歪みが気になったり、「17:00PM」のシーンでは桶に麦を入れるシーンがヘンなどの粗はあるが、ここを除けばだいぶ違和感の無い仕上がりになっている。
     この誤魔化し方はゲームアプリだからこそやっても比較的マシに見えるという側面もあるが、ドット絵風やゲーム画面風にして絵の粒度を下げてしまうのはすぐに出来る、やりやすいアプローチだと言えよう。

     あるいは、そもそも既存のアニメの範疇で勝負しないというのも一つの正解である。
     現状AIでの映像生成でバッシングが多いのは既存の創作をコピーしているようなAIアニメであって、shortsでしばしば見受けられるテンプレ化されたアニメーションであればそもそも既存のアニメを見ている層とは被らない分バッシングも起き得ない。
     例えば食べ物を擬人化して喋らせる3Dアニメ風演出とか、ステージ紹介風の3D風アニメとか、shorts側の新しい流行を使う方が広告としての目新しさを確保する面でも有効である。

     AIアニメの技法を一部活用して基本は実写作品とする使用例としては、『キノコ伝説』の2周年主題歌『社畜の多元宇宙』がある。本映像では社畜ニキに対して様々なスタイルを適用している。
     これはRunway Alephを使用しているのではないかと推測した。VFX処理をAIで行えることは2025年頃からnoteの記事でも紹介されているような技術である。キノコ伝説の場合は「様々な楽しい思い出」を「多彩なエフェクトのかかった社畜ニキ」という形で表現しているため、ある程度は納得の行くやり口である。しかしこれは特に意図が無ければ作画自体の統一感を損なう行為とも紙一重であるため、このMVの成功はバランスよく新しい技術を取り入れたJOY NET GAMESの手柄と言えるだろう。
     この辺りの「やろうと思えばできるがあえてやらない」「やろうと思えば出来るし使った方が面白い」の技術の使い分けが顕著に出ているのはAI創作の見どころの一つになっていくだろう。

     ここまでのAIアニメの方針をまとめていくと、カットを多用するようにする、広告自体を短時間で終わらせる、フィルターで誤魔化すなどの技巧面で解決する方針と、そもそも既存の手描きアニメとは別軸の勝負を仕掛けるという2種のやり方がメインだったことが分かる。
     しかしそのどちらにも共通する問題点は、それらは既存の手描きアニメ的な手法が土台にあるからこその差別化、工夫である。生成AIアニメならではの面白さのような所に一歩踏み込んだ作品は無かった。

    ・「かわいそうな知性」を見る

     ここまでAIアニメの技法を見て来たうえで、本題に入ろう。
     本作で目を引くのは、AIアニメーションで無ければ実現の難しい映像体験を生み出していることである。すさまじい勢いで動き続けるアニメーション、歌詞とシンクロしたMVの映像はこれまでの生成AIアニメでは見られなかったクオリティだ。そして、手描きでこれを制作することも難しい。何故ならそれぞれの絵に脈絡が存在しないからである。
     
    どうしても人間が作画しようとすると前の絵と次の絵に一貫した動きをつけたくなるし、無意味にも見えるカラフルな色の氾濫のような所に作為性が紛れ込んでしまいがちである。だがこれは見る限りあまりにも無作為的であり、一見成立していないのに成立しているアニメが実現している。これは素人が一目見てすごい作品だと分からせるだけの技量がある。

     制作者であるtapeheadはこれを「コラージュアニメーション」とジャンル分けしている。だがコラージュアニメーションと言うと写真を切り貼りしたコラージュの方の意味合いの方が現状強いため、個人的にはこれを「カレイドスコープ」とジャンル分けしたい。万華鏡のように細かに千変万化する音楽/映像体験ながら、それぞれの映像が緩い関係性で関連し続けているのは自分が知る限り他に無い。

     tapeheadの映像作品の約半数に見受けられる特徴として、少女と目玉のモチーフが多量に登場することが挙げられる。
     これは彼の過去作「Blink」などでも見られるのだが、かわいそうな知性と明確に異なる点はモチーフというよりはストーリー性や歌詞に映像を合わせるシンクロ感を強く押しだしていること。よってこちらはどちらかと言えば既存のミュージックビデオにつくアニメに近い作風だ。
     それに対してかわいそうな知性はモチーフを強く前面に押し出し、無秩序でありつつも演出に統一感を持たせることで作品としての秩序を成立させている。こちらも簡単に歌詞と映像の統一はなされているが映像自体に歌詞と関係の無いものが多数混じっているため、独特の混沌とした雰囲気を感じる仕上がり。
     
    Blinkの場合はSora2を採用している分異なる味付けがなされているが、映像表現においてSeedance2.0を採用したことがここまでの激しい演出を可能にしている可能性もあり得るだろう。

    画像

     興味深い批判として見受けられたのが、「目をつぶって音楽だけ聴いたらそうでも無かった」「歌詞は韻を踏めておらずリズムもぐちゃぐちゃである」というもの。
     これは逆も指摘出来ることで、音を消して映像だけ見るとやはり映像の破綻や動いているだけで意図の感じられない演出も多い。つまり本作は音楽を制作した後それに合う映像を制作することで完成する映像作品であって、どちらかだけで成立させようとは考えていないのではないか。

    画像

     韻が少なく歌詞の繋がりが緩くリズムが不規則という特色もこの映像と組み合わせる分にはポジティブに働いており、不規則に破綻した人体や背景が演出に昇華されている。本来のアニメーションで言うならばこれは作画崩壊にあたるが、無秩序そのものをテーマとしてしまえば作画崩壊による絵の奇妙さが不評に繋がらない。
     本作が特に優れているのは生成AIアニメに存在する大課題である「作画に致命的な破綻が存在しやすい」という制約と「必要な作画の破綻が存在しづらい」という制約をテーマ選びの時点でクリアしたことがある。
     この二つの要素をいち早く見抜いたtapeheadの慧眼が本作品を生み出したのだ。

     だがtapeheadの「破綻」に対するアプローチは、決してすべてを破綻させるというだけには留まらない。
     『Side Step』のMVでは破綻しがちな背景やスピード感ある演出を全て実写にしてしまい、イラストだけを実写映像に合成する手法を用いていると思われる。確かにこの手法ならば、気になる破綻の少ないAIアニメを実現できる。
     ただ本人の解説動画曰く、一度イラストを生成してからリテクスチャで実写化、これを人物だけマスクして戻すという手法も過去に試しているらしく、一部はこの手法を採用している可能性もあり得る。
     とはいえ両作品共に言えるのは、AI作品特有の破綻に対して真摯に向き合い続けたことが新しい表現の発見に役立ったということだろう。破綻を楽しむにしろ排除するにしろ、意図をもって表現していることが窺える。これが創作と言わずして何を創作と言えようか。
     総括すると、『かわいそうな知性』はAIによる新たなる表現研究は小規模であっても確実に進んでいくという希望が見られる作品だ。今後の作品にも期待したい。

    ・ご本人のワークフロー記事を見る

     具体的なワークフローがご本人から公開されたのでここでも付記しておきたい。
     基本的な製法はそちらの記事を参照してもらうとして、最も驚くべきはこの映像が5つの画像とプロンプトだけで出来ていることだろうか。これだけの内容だから相当複雑な指定をしているかと思っていたが、製法はかなりシンプル。
     またSeedance2.0製の映像を見ていると、あまりにもSeedance2.0以前の生成AIアニメのクオリティと違い過ぎるなという感が強い。ここまで書いたことが大体修正されていて、あとは個々人のセンスとどこまで妥協なくやったかというクオリティ勝負でしか無いなあと思いました。


    あなたへのおすすめ