メインコンテンツへスキップ
見出し画像

ブラウザだけでAI漫画が作れる「AniFusion」がサービスイン

    ブラウザだけで本格的な漫画が描ける話題の海外サービス「AniFusion」がついにサービスインしました。実際にさわってレポートしてみます。
    https://anifusion.ai/

    ・テキストから画像
    ・インペイント
    ・顔の改善
    ・ポーズコントロール
    ・AI漫画

    画像

    こんな感じの画像が作れます。

    画像

    チュートリアルは無料

    AniFusionはドイツ/フィリピンでLLMと拡散モデルを研究するコンピュータサイエンスの大学院生 Nucleusさん @EsotericCofe が開発しています。

    画像

    チュートリアルの内容を説明していきます。

    まず画面右上にプロンプトを並べていきます。Danbooruスタイルのタグを使うことで最高の結果が得られるそうです。

    画像

    画像の縦横比率を決めます。

    画像

    ツールバーの十時ツールでオブジェクトを移動させます。数字キーの[1]~[5]で切り替えられます(後ほど解説します)

    画像

    下にあるメニューバーでズームしたりパンニング(✋️)できます。パンニングはスペースバーやマウス中ボタンでもできます。ズームはControlキーを押しながらでも切り替えできます。

    画像

    Generateボタンでdiffusionレイヤーを新規作成します。押してみましょう。

    画像

    レイヤー共通の操作は画面の上部にレイヤーオプションが現れます。右クリックで同様のメニューを表示できます。

    画像

    ここから先はサブスクリプションが必要です!

    画像

    ・月額20USDの課金で1日あたり300画像生成できます。
    ・ワークスペースのキャンバスを保存できます。
    ・複数のモデルをサポート
    ・複数のLoRAをサポート
    ・新機能へのアーリーアクセス

    実際にさわってみた!

    Generate

    基本的にはGenerateを使って画像を生成していきます。

    カンマで区切られたプロンプトを右上の「Prompt」に貼り付けるとタグになります。

    画像

    「Tag Mode」をオフにすると、テキストになります。

    画像

    レイヤーとパネル(おそらく漫画のコマに当たる要素)の関係ですが、現状は上下させるだけで、従属させる機能はなさそうです。
    ※鍵🔐がありますが、位置関係のみのようです。

    画像

    1,2,3,4,5のキーを押すとツールを以下を切り替えられます
    [1] 移動ツール
    [2] インペイントエリア選択ツール
    [3] インペイント領域ドローイングツール
    [4] ダミーポーズ作成ツール
    [5] パネル作成ツール

    インペイント

    画像

    smileとしてInpaintすると…

    画像

    笑ってくれました!

    なお表情のエンハンス機能はGenerateタブの隣りにあり、顔だけを良くする機能として独立しています。

    画像

    ダミーポーズ作成ツール

    ControlNetのOpenPoseようなポージングを指定できます。
    これは便利そうですね
    作者の Nucleus( @EstericCofe )さんによるデモ

    currently working on new demo videos pic.twitter.com/ZJYbirAstY

    — Nucleus☕️ (@EsotericCofe) June 30, 2024


    ControlNetを使える環境を用意しようと思うと、けっこうなVRAM搭載のAutomatic1111環境が必要です。

    ブラウザだけでこれができるのは感動がありますね。

    画像
    画像

    右クリックメニュー

    画像を右クリックすることでもメニューが表示されます。

    画像

    ・レイヤーをダウンロード
    ・複製
    ・削除
    ・上層/下層へ移動
    ・再生成
    ・アップスケール
    ・バリエーションを生成
    ・顔を改善
    ・ポーズを分析
    ・背景を変える
    ・背景を除去する
    ・情報を表示する
    ・ロックする

    テキストツール

    セリフなどの文字を打つことができます。
    文字は縦書きも使えるようですが…

    画像

    どうやら句読点の位置や改行にバグがあるようです。

    画像

    💬吹き出しを描く機能はまだないようです💭


    作例

    画像

    その他


    LoRAはCivitAIのURLで指定するようです

    画像

    実際に指定してみると…

    画像

    使えるモデルは6種類

    画像

    サポートはDiscordにて

    画像

    AICU media 編集部が気になった点

    ・画像の枠線によるクリップを簡単にできると良さそう
    ・オブジェクトの拡大縮小機能が欲しい
    ・全体の画像を保存する機能はない
    ・フォントを選べない
    ・背景だけを生成する機能がほしい
    ・縦書きテキストにバグが有る
    ・モデルの商用ライセンスは解決済みなのだろうか?
    ・Animagine XL 3.0が欲しい

    などなど
    まだまだ発展途上な感じはしますが、今後の機能実装と用途によっては$20/月は悪くないかもしれないですね。

    なお画像生成部分は「fal」というサービスを使っているようです。

    https://fal.ai/

    続きはこちら!


     
     

    AICU

     
     
    生成AI時代に「つくる人をつくる」をビジョンに活動する日本最大のクリエイティブAIコミュニティ。 AIクリエイターさんとともに、「わかるAI」を伝えていきます。

    あなたへのおすすめ