メインコンテンツへスキップ
見出し画像

AI初心者がワイヤーアート風画像を生成する「GPTs作成」に挑戦した話

    「一筆書き」×「ワイヤーアート」。

    このシンプルでミニマムなテーマで画像生成GPTsを作ろうと思い立ったのは、数年前に箱根彫刻の森美術館で出会った「鉄筋彫刻」がきっかけだった。

    画像
    美術館といったら・・・「モナリザの微笑み」

    ジャズ奏者をテーマにしたその彫刻は、一筆書きの線がそのまま空間に浮かんだような佇まいだった。疾走感があって、生き生きとしていて、どこか遊び心もある。そのアドリブと遊び心を楽しむ軽やかさは、まさに「ジャズる」感じで心を揺さぶられた。

    画像
    「スイングジャズを演奏するサックス奏者(上半身)」

    その作品に触れてから、ずっと心のどこかで「この雰囲気を何かで表現したい」と思っていた。

    そこで今回、「ジャズる」ワイヤーアート風の画像をテーマに、画像生成用のGPTs作成に挑戦した。

    「ジャズる」ワイヤーアート風画像を生成できるGPTsはこちら

    GPTsは下記リンクからどうぞ。GPTストアでは公開せず、リンクから使用できるようにしています。

    まず伝えておきたいこととして、今回作ったGPTsでは、生成される画像には余計な装飾や要素(額縁、手、植木、額縁など…。)がたびたび混じってしまうこと。そんなときは、「余計な装飾や要素は排除して」とプロンプトで改めて指示を出す必要がある。

    正直、この点は完成度がまだまだだ。こんなレベルで公開することが悩ましかったが、ひとまず公開することにした。完璧じゃないからこそ、誰かからのフィードバックやアドバイスをもらえたら嬉しい。

    実例集

    GPTsで生成した画像の実例集。

    いい感じの画像が生成できたら、noteの「みんなのフォトギャラリー」で提供していきたい。

    「ジャズる」ワイヤーアート風の画像になっているだろうか・・・。

    ひと癖ある人物

    画像
    「ファンキーなサングラスをかけたお婆さん」
    画像
    「ハンバーガーを食べている太った人」

    ひと癖ある有名人

    画像
    ロックバンドQUEEN「フレディ・マーキュリー」
    画像
    「マリリンモンロー」
    画像
    「スティーヴィー・ワンダー」
    画像
    「ピアノを演奏するスティーヴィー・ワンダー」


    画像
    「舌を出したアインシュタイン」
    画像
    「黒板に相対性理論を書くアインシュタイン」

    音楽室の定番

    画像
    「ベートーヴェン」
    画像
    「モーツァルト(横顔)」
    画像
    「モーツァルト(横顔)」
    画像
    「バッハ」

    ひと癖ある動物

    画像
    「たくさんのネックレスをかけたキリン」
    画像
    スマホに夢中なチンパンジー(上半身)
    画像
    「ジオメトリックテイストなサイ」
    画像
    「トリケラトプス」

    疾走感のある人物

    画像
    「ダンクシュートを決めるコービー・ブライアント」
    画像
    「100m走でゴールするウサイン・ボルト」

    物語の登場人物

    画像
    「赤毛のアン」
    画像
    「物語ウサギとカメ」

    建物・構造物

    画像
    「東京タワー」
    画像
    「神社」
    画像
    「神社」
    画像
    「自由の女神(上半身アップ・下から見上げる構図)」

    制作裏話:プロンプトと戦った一週間

    ここから先は、じぶんでもGPTsを作ってみたい人向けに制作ストーリーを語る。わたしの試行錯誤の記録が、誰かのGPTs作成の役に立てば嬉しい。

    「ジャズる」ワイヤーアート風を目指したものの、正直、思っていた以上に手こずった。想定していた制作日数は1日。実際に作業したのは、子育ての隙間時間で作業したものの、一週間も費やしてしまった。

    ハードル1:「好みのテイスト」を言葉で正確に伝えるハードル

    一番初めのハードルは、「好みのテイストを言葉で伝える」 ことだった。

    GPTsの作成では、指示(Instruction)という場所に、要件を書き込んでいく。GPTsにどんなことをして欲しいか、どんな画像を作りたいかを指示していく。例えば「一筆書き風で」「ワイヤーアートっぽく」というように、言葉で具体的に指示をしていく。

    このステップでは、ChatGPTを使って、表現したいテイストを「言語化」するサポートをしてもらった。好みに近い画像を5つほどChatGPTにアップロードし、「この画像から共通する要素を抽出して」と指示してみた。すると、例えば「洗練された」「ミニマリスティックな」といった言葉の表現や、構図などの好みを言語化することができた。この方法は、下記のブログを参考にした。

    ハードル2:「テイスト」を絞り、「一貫性」を維持するハードル

    好みの画像を選んでは言語化し、画像生成を繰り返すうちに、GPTsにはさまざまなテイストを指示する言葉が増えていった。

    指示に一貫性がなくなった結果、生成される画像のテイストに一貫性がなくなってしまった。

    完全に表現迷子になったわたしは、原点回帰することにした。今回「ジャズる」ワイヤーアート風イラストを作ろうと思うきっかけになったあのワイヤーアートを改めて調べ、どんなものを作りたいのか、改めて目標設定を明確にした。

    ネットで調べたところ、わたしが出会ったワイヤーアートは、造形作家・徳持耕一郎さんの作品だということがわかった。ジャズを題材として鉄筋彫刻作品などを発表し続けている、世界的に活躍する造形作家さんのようだ。

    改めて彼の作品を見て、目標は決まった。大胆かつ繊細で、軽やかかつ疾走感に溢れていて、遊びゴコロもある。ゴールは「ジャズっているワイヤーアート風のイラスト」だ。

    この抽象的で感覚的な表現を、どう伝えれば正確に伝わるのか。表現方法や指示を削ぎ落とすことに注力した。といっても、この過程でもChatGPTに相談しながら行った。「シンプルでミニマム」でありながら、「大胆かつ繊細」「軽やかかつ疾走感に溢れた」表現にするために、「effortless(気楽に、軽々と)」「one stroke(一筆書き)」「Continuous Line(連続した線)」などという表現を加えては削除する、の繰り返しを延々と繰り返した。

    実はGPTsには、knowledgeという学習データを保存できる機能がある。knowledgeに画像(その他、PDFやテキストデータなど)をアップロードして、学習データとして利用することができるのだ。しかし、他人の著作物を学習用データとして利用してGPTsで画像を生成すると、著作権を侵害してしまうリスクがある。だから、誰かの著作物を学習データとしてそのまま使ってはいけない。

    ハードル3:「シンプル」で「ミニマム」に徹するハードル

    最後のハードルは、意外なことに「シンプルでミニマムなデザイン」の画像を生成することだった。

    今回生成する画像では、背景は単色、装飾や余計な要素は一切なしにしたかった。最後まで粘ったが、結局乗り越えられないまま、今回のGPTsを公開することにした。未だに、生成した画像の背景に余計な要素が加わるといったエラーが生じる。

    GPTs作成に費やした一週間のうち、ほとんどが、この装飾や余計な要素は一切なしにするためのプロンプトの修正に費やした。

    どうしてこんなにも難しいのか。GPTsの指示には「背景はホワイトグレー一色、余計な要素は排除する」と何度もさまざまな表現方法、構造化を試してみたけれど、結果は思い通りにならなかった。

    原因は、プロンプトの「構造」と「表現」にあるのだと思う。OpenAIのガイドラインやプロンプトガイドの解説記事を読み、指示の構造を変えてみたり、言葉の順序や表現方法、強調の仕方を色々と試してみた。

    終わりに:未完成でも公開する理由

    制作期間は一週間。子育ての合間に少しずつ進めて、ようやく形になった。

    途中、画像を生成しすぎた結果、ChatGPTの回数制限にかけられてしまい、10時間以上画像を生成できなくなってしまうトラブルも生じた。

    画像
    「徹夜明けのチンパンジー」

    背景の装飾問題が解決できないまま公開するのは少し迷ったけれど、試行錯誤の過程そのものが、誰かの参考になればと思ってこの記事を書くことにした。

    シンプルなデザインを目指すほど、細かなニュアンスや余白の美しさが求められる。シンプルでミニマムなデザインに削ぎ落としつつも、必要な要素に絞るセンス、配置や構図の美的感覚、・・・どうやったら伝わるか、表現できるのか、難しさを痛感した制作だった。

    もしこの記事を読んで、「こんなプロンプトを試してみたら?」とか「背景の装飾を防ぐコツを知っている」といったアドバイスがあれば、ぜひ教えてほしい。

    何度も試して、作り直して、少しずつ理想に近づけていきたいと思っている。次はもっと「ジャズる」画像が作れるはずだ。

    画像
    「スイングジャズバンド(サックス、トランペット、バス、ドラム)」

    プロンプトの改善には膨大な時間を費やしたが、完璧には至らなかった。それでも、この過程を通して、「AIに伝わりやすい指示」をどう出せば良いか、少しだけ感覚が掴めた気がする。

     
     
    思考×試行=至高 本を読んで考え、実際に試す AI時代のワーママの生き方と思考の実験場 論理と感性を行き来する、知的探究の読書 年100冊|note毎週更新|Amazonアソシエイト参加

    あなたへのおすすめ