見出し画像

2026年4月の画像・動画生成AI進化まとめ

こんにちは!GENELです。

4月の1ヶ月間で主要AIモデルが、

「何が変わったか」+「実際に使ってみてどうだったか」

をまとめました。

時間がなくて触れない人、最新情報を追うのに疲れた人、ぜひ参考にしてみてください!💪🏻



①Seedance 2.0「人物の顔参照」対応(4/7)

Seedance 2.0に、人物の顔参照機能が追加されました!
今まで実写は生成できず、T2Vでなんとかやりくりしていたので嬉しい発表ですね。

実際に試した動画がこちら↓

実際に試した感想としては、

  • 問題なく参照可能できる

  • ツールによっては未成年NG

  • マルチカットでも一貫した顔

と言う感じで、ほぼ問題なく実写も生成できました◎

よくコメントで「どこで使用していますか?」と聞かれますが、

で利用することが多いです!

ただ、上記のようにツールごとにまだアクセス周りの不安定さがあるようで、そこは今後の課題かもしれないですね。

Seedance2.0でどんなことができるの?と言う方はこちらのnoteを参考にしてください👇🏻


②謎の動画生成AI「HappyHorse-1.0」(4/8 / 4/17)

「Seedance 2.0を超えた」と話題になった謎の動画生成AI、『HappyHorse-1.0』。
リリースはまだですが、4/17にはArena上で利用可能になり注目を集めています。

実際に比較してみた結論としては、個人的にはまだまだSeedance 2.0のほうが品質高い&今後もSeedance2.0でいいかも?という印象でした。

実際に比較↓

一方で、日本語の精度は意外にいいな?と感じました。
日本語のイントネーションの品質はSeedance2.0に並ぶかもしれないですね。

4/27現在、アリババのプラットフォーム「Alibaba Cloud Model Studio」でリリースされたとの告知がありました。

しかし、リストの確認ができず、まだ調整中とのことでした。

リリースされたらGENELのXにて最新情報を発信していきます🫡

詳しい内容はこちらのnoteにまとめています👇🏻


③Vidu Q3「リファレンス機能」登場(4/14)

動画生成AI「Vidu」のQ3にリファレンス機能が追加されました。

手書き風イラストで試してみた↓

やっぱりVidu×イラストはかなりいい動きしてくれますね。

ただ、イラストのスタイルの一貫性を保つのが意外と難しくて、たまにアニメ調っぽくなってしまうことがありました。

最初はこんな感じだったけど…
だんだんアニメっぽい感じに

そんな時はプロンプトにどんなスタイルか色々書き込むとうまくいきやすかったのでおすすめです!

世界観を壊さずに動かせるのがViduの強みだなと改めて感じました◎


④Gemini 3.1 Flash TTS登場(4/16)

Googleから音声生成モデル「Gemini 3.1 Flash TTS Preview」がリリース。

日本語のイントネーションがかなり自然でアニメなどで使えそうだな~と思ったんですが、日本人の声が無いのがネック…🤔

イレラボのようにいろいろな声を選択できるわけじゃないので、声が似てしまうことがありました。

とはいえ、感情の動きを豊かに表現していて今後用途によっては使い道があるなと感じました。

詳しくはこちらのnoteでまとめています!


⑤Seedance 2.0「1080p」対応(4/17)

Seedance 2.0がついに1080p出力に対応!

画質の向上によって、実用レベルで使える場面がさらに増えた印象です。

顔参照(①)との組み合わせで、クオリティと再現性のどちらも高い動画が作れるようになってきており、Seedanceの完成度がどんどん上がっているなと感じます。


⑥OpenAI「ChatGPT Images 2.0」登場(4/21)

OpenAIからChatGPT Images 2.0が登場。

実際に試してみると、日本語の生成はNanoBananaProを超えるレベル、日本人もかなりリアル、ストーリーボードの生成もできるなど、活用方法がありすぎて驚きました。

さらに「構成コンテ・絵コンテ」の生成にも対応。なんとなくなアイデアからコンテ制作もお手のもので、「文章で提案」から、「絵で説明する」時代に移行しつつあるなと感じました。

細かい設定を入れると指示書・設計書に近いレベルまで仕上げられるのは、映像制作者として素直に使いたいと思える機能です。

さらにSeedance2.0との相性もいいので、気になる方はこちらのnoteをチェックしてみてください👇🏻


⑦KlingAI 3.0が4Kに対応+コンテスト開始(4/24)

KlingAI video 3.0がついに4K出力に対応。
さらに総額25000ドル(約398万円)コンテストも開始されました。

実際に使ってみましたが、細部の描写がかなり鮮明で、光の表現もワンランク上がったなと言う感じでした。

逆に、男性の顔のクローズアップなどをすると毛穴とか髭とかが目立って逆にネガティブなイメージになっちゃうな、と思いました。
こういうシーンではちょっと注意したいですね…。

あと、クレジットの消費が1080pの3倍なので、クレジットがガンガン消費されていきます!使いどころを見極めたほうがいいですね。

4K対応によって、商業利用・映像作品としての使用がよりリアルになってきました。
コンテスト参加もモチベーションになりそうなので、気になる方はぜひチェックを!



⑧ElevenLabsから音楽生成がリリース

音声生成で有名なElevenLabs
元々、SEだったり色々幅広く生成できたのですがここにきてさらに音楽まで生成できるようになりました。

日本語精度はまだいまいち…だが、日本法人もあり、日本語モデルにも力を入れている企業なので伸びしろには十分期待できます。

現状はSunoやUdioに軍配。



まとめ

4月は「画像生成の進化」が特に印象的で、個人的に今月最も「使い続けたい」と思ったのは⑥GPT-Image-2です。

企画・コンテ段階での活用が特に強く、映像制作者として今後欠かせないツールになりそうです。

今後も「AI動画生成の今」をキャッチアップ&シェアしていきます🫡

いつも最後まで読んでいただきありがとうございます! 参考になったという方は「スキ」や「フォロー」していただけると励みになります👏🏻

ではまた、次のnoteでお会いしましょう!

いいなと思ったら応援しよう!