2026年4月の画像・動画生成AI進化まとめ
こんにちは!GENELです。
4月の1ヶ月間で主要AIモデルが、
「何が変わったか」+「実際に使ってみてどうだったか」
をまとめました。
時間がなくて触れない人、最新情報を追うのに疲れた人、ぜひ参考にしてみてください!💪🏻

①Seedance 2.0「人物の顔参照」対応(4/7)
Seedance 2.0に、人物の顔参照機能が追加されました!
今まで実写は生成できず、T2Vでなんとかやりくりしていたので嬉しい発表ですね。
実際に試した動画がこちら↓
seedance 2.0 人物の顔参照可能に
— GENEL | AIを用いた動画制作 (@genel_ai) April 7, 2026
Topview ( @topviewjapan )
早速試してみました👀
・問題なく参照可能◎
・一枚の写真から幼少の頃も再現可能
・Agent v2でマルチカット生成も◎
15秒以上の延長もできるので、一気に表現の幅が広がってきてます。#TopviewAI #Seedance2 #PR https://t.co/uDZPFZTEDQ pic.twitter.com/libNedhf9Y
実際に試した感想としては、
問題なく参照可能できる
ツールによっては未成年NG
マルチカットでも一貫した顔
と言う感じで、ほぼ問題なく実写も生成できました◎
よくコメントで「どこで使用していますか?」と聞かれますが、
Topview(https://www.topview.ai/)
Lovart(https://www.lovart.ai/ja)
で利用することが多いです!
ただ、上記のようにツールごとにまだアクセス周りの不安定さがあるようで、そこは今後の課題かもしれないですね。
Seedance2.0でどんなことができるの?と言う方はこちらのnoteを参考にしてください👇🏻
②謎の動画生成AI「HappyHorse-1.0」(4/8 / 4/17)
「Seedance 2.0を超えた」と話題になった謎の動画生成AI、『HappyHorse-1.0』。
リリースはまだですが、4/17にはArena上で利用可能になり注目を集めています。
実際に比較してみた結論としては、個人的にはまだまだSeedance 2.0のほうが品質高い&今後もSeedance2.0でいいかも?という印象でした。
実際に比較↓
Seedance2.0を超えたと話題の『HappyHorse-1.0』
— GENEL | AIを用いた動画制作 (@genel_ai) April 8, 2026
結論としては、個人的にはまだSeedance 2.0のほうが品質高いかな?と思いました。
Seedance2.0のほうが動作が自然で、人物の見せ方もよく、全体の破綻も少ないように感じます。… pic.twitter.com/kDll6GQSS6
Seedance2.0 vs HappyHorse-1.0 https://t.co/k8b8bXlZV5 pic.twitter.com/rjuFXpXULM
— GENEL | AIを用いた動画制作 (@genel_ai) April 9, 2026
一方で、日本語の精度は意外にいいな?と感じました。
日本語のイントネーションの品質はSeedance2.0に並ぶかもしれないですね。
4/27現在、アリババのプラットフォーム「Alibaba Cloud Model Studio」でリリースされたとの告知がありました。
🚨 速報:HappyHorse、本日リリース! 🚨
— 藤川裕一🤖アリババAIエンジニア (@fujiyuu75e) April 27, 2026
ついに、あの HappyHorse が解き放たれました!🐎✨
あまりの反響に、予定よりも前倒し公開となっております! 本日から ModelStudio ですぐに遊べますので、ぜひその凄さを体験してください🔥
https://t.co/JxreW5OptX#HappyHorse #ModelStudio #AI #新機能 https://t.co/kQiLEaisT3 pic.twitter.com/Yfd4c5m2gl
しかし、リストの確認ができず、まだ調整中とのことでした。

リリースされたらGENELのXにて最新情報を発信していきます🫡
詳しい内容はこちらのnoteにまとめています👇🏻
③Vidu Q3「リファレンス機能」登場(4/14)
動画生成AI「Vidu」のQ3にリファレンス機能が追加されました。
手書き風イラストで試してみた↓
Vidu Q3( @vidujapan )リファレンス来ましたね!
— GENEL | AIを用いた動画制作 (@genel_ai) April 14, 2026
手書き風イラスト実験
・やはりViduは線が細かいイラストの動きがきれい
・テイストを明記すると雰囲気がキープされやすい
(手書き風、水彩~など)
・音声は短く区切ると自然な読み上げになる
世界観を壊さずに動かせるのがViduは強いですね◎ pic.twitter.com/6ks2Do2djM
やっぱりVidu×イラストはかなりいい動きしてくれますね。
ただ、イラストのスタイルの一貫性を保つのが意外と難しくて、たまにアニメ調っぽくなってしまうことがありました。


そんな時はプロンプトにどんなスタイルか色々書き込むとうまくいきやすかったのでおすすめです!
世界観を壊さずに動かせるのがViduの強みだなと改めて感じました◎
④Gemini 3.1 Flash TTS登場(4/16)
Googleから音声生成モデル「Gemini 3.1 Flash TTS Preview」がリリース。
Gemini 3.1 Flash TTS 試してみた https://t.co/vSA6JATHvD pic.twitter.com/Gc0ZVgucXB
— GENEL | AIを用いた動画制作 (@genel_ai) April 17, 2026
日本語のイントネーションがかなり自然でアニメなどで使えそうだな~と思ったんですが、日本人の声が無いのがネック…🤔
イレラボのようにいろいろな声を選択できるわけじゃないので、声が似てしまうことがありました。
とはいえ、感情の動きを豊かに表現していて今後用途によっては使い道があるなと感じました。
詳しくはこちらのnoteでまとめています!
⑤Seedance 2.0「1080p」対応(4/17)
Seedance 2.0がついに1080p出力に対応!
画質の向上によって、実用レベルで使える場面がさらに増えた印象です。
続々と各所でSeedance2.0が1080pに対応開始
— GENEL | AIを用いた動画制作 (@genel_ai) April 17, 2026
まだ自分の環境だとUnlimitedだけど使えないな? https://t.co/geJxIBbecE pic.twitter.com/dtTKYCf5mw
顔参照(①)との組み合わせで、クオリティと再現性のどちらも高い動画が作れるようになってきており、Seedanceの完成度がどんどん上がっているなと感じます。
⑥OpenAI「ChatGPT Images 2.0」登場(4/21)
OpenAIからChatGPT Images 2.0が登場。
実際に試してみると、日本語の生成はNanoBananaProを超えるレベル、日本人もかなりリアル、ストーリーボードの生成もできるなど、活用方法がありすぎて驚きました。

GPT Image 2 × Seedance 2.0 https://t.co/C0uWPVFXQU pic.twitter.com/aCp49gq1lc
— GENEL | AIを用いた動画制作 (@genel_ai) April 18, 2026
さらに「構成コンテ・絵コンテ」の生成にも対応。なんとなくなアイデアからコンテ制作もお手のもので、「文章で提案」から、「絵で説明する」時代に移行しつつあるなと感じました。
ChatGPT Images 2.0→Seedance2.0
— GENEL | AIを用いた動画制作 (@genel_ai) April 22, 2026
動画の文字破綻を軽減するTips
①コンテをChatGPTに読み込む
②下記の指示:
このコンテに出て来る文字のサンプルを、シーンごとに
大きく生成。
イラストではなく、文字のみ。
③生成されたテキストとコンテを参照し、動画生成 https://t.co/a7UUqXC2Ut pic.twitter.com/ZEmsydGhoV
細かい設定を入れると指示書・設計書に近いレベルまで仕上げられるのは、映像制作者として素直に使いたいと思える機能です。
さらにSeedance2.0との相性もいいので、気になる方はこちらのnoteをチェックしてみてください👇🏻
⑦KlingAI 3.0が4Kに対応+コンテスト開始(4/24)
KlingAI video 3.0がついに4K出力に対応。
さらに総額25000ドル(約398万円)コンテストも開始されました。
実際に使ってみましたが、細部の描写がかなり鮮明で、光の表現もワンランク上がったなと言う感じでした。
AIに聞いてみた
— GENEL | AIを用いた動画制作 (@genel_ai) April 24, 2026
「もし、1日だけ人間になれたら何がしたい?」
Created with Kling AI (@Kling_ai )#Kling4K #KlingAI pic.twitter.com/ppNMC9ZIr3
逆に、男性の顔のクローズアップなどをすると毛穴とか髭とかが目立って逆にネガティブなイメージになっちゃうな、と思いました。
こういうシーンではちょっと注意したいですね…。
あと、クレジットの消費が1080pの3倍なので、クレジットがガンガン消費されていきます!使いどころを見極めたほうがいいですね。
4K対応によって、商業利用・映像作品としての使用がよりリアルになってきました。
コンテスト参加もモチベーションになりそうなので、気になる方はぜひチェックを!
🏆 Introducing the Kling AI 4K Short Film Creative Contest!
— Kling AI (@Kling_ai) April 24, 2026
Kling AI now supports native 4K ultra-high-definition output, allowing for more detailed and rich texture rendering, with smoother and more natural color transitions.
🏅We are now inviting creators worldwide to submit… pic.twitter.com/CiYiVnXCNh
⑧ElevenLabsから音楽生成がリリース
音声生成で有名なElevenLabs
元々、SEだったり色々幅広く生成できたのですがここにきてさらに音楽まで生成できるようになりました。
日本語精度はまだいまいち…だが、日本法人もあり、日本語モデルにも力を入れている企業なので伸びしろには十分期待できます。
現状はSunoやUdioに軍配。
ElevenLabsから音楽生成がリリース
— GENEL | AIを用いた動画制作 (@genel_ai) April 30, 2026
VS Suno!
早速試してみました
・日本語精度まだいまいち
・生成は早い
音楽系proの方の意見待ちですが、さすがにSunoやUdioにはまだまだ遠そう👀 https://t.co/rQqmaPif7F pic.twitter.com/0uxptWipT3
まとめ
4月は「画像生成の進化」が特に印象的で、個人的に今月最も「使い続けたい」と思ったのは⑥GPT-Image-2です。
企画・コンテ段階での活用が特に強く、映像制作者として今後欠かせないツールになりそうです。
今後も「AI動画生成の今」をキャッチアップ&シェアしていきます🫡
いつも最後まで読んでいただきありがとうございます! 参考になったという方は「スキ」や「フォロー」していただけると励みになります👏🏻
ではまた、次のnoteでお会いしましょう!
