
画像AIに、日本語の文字は描かせない。──2種類に分かれたGPT Image 2.5を、図解1,000点を作った経営者が読む
昨日、OpenAIが画像生成の新しいモデルを出しました。GPT Image 2.5。一番の違いは、賢くなったことよりも、2種類に分かれたことです。精度のSunburstと、速さのFlare。私は7月から毎日のようにnote記事を書き、1本につき図解を7点、すべて画像AIで作ってきました。今日で191本目、図解は1,000点を超えています。その実測の目で、公式が出した作例と使い分けを読み直します。

1. なぜ今、画像AIの話をするのか
昨日、2026年9月8日にGPT Image 2.5が公開されました。公式のモデルページに載っているスナップショット名は、gpt-image-2.5-sunburst-2026-09-08。名前にSunburstと入っている通り、このモデルは2つに分かれています。品質を優先するSunburstと、小型で速度を優先するFlare。公式の説明では、SunburstはGPT Image 2より高画質、FlareはGPT Image 2と同等の品質で速い、と整理されています。
新しいモデルが出たときの記事は、たいてい「前より賢くなりました」で終わります。今回それを書くと、経営者にとって肝心なところが抜け落ちます。今回起きたのは、賢くなったことよりも、選ぶ側に判断がひとつ増えたことです。これまでは「画像AIを使うか、使わないか」でした。これからは案件ごとに「速い側で足りるか、精度の側が要るか」を決めることになります。
判断が増えたことを、私は歓迎しています。道具の性能が横並びに近づくほど、差がつくのは決め方だからです。品質設定も増えました。auto・low・medium・high に、xhigh と max が足されています。同じ1枚でも、どこまで粘るかを自分で決められるようになりました。
裏を返すと、社内で「どちらを使うか」を誰かが決めることになります。決める人がいない会社では、担当者が毎回いちばん高い設定を選ぶか、毎回いちばん安い設定を選ぶかのどちらかに寄ります。前者は費用が読めなくなり、後者は品質が読めなくなる。決めるのは、経営者の側の仕事です。
そして、これは技術部門だけの話に留まりません。会社の机には、画像の依頼が積み上がっています。新商品のチラシ、SNSに載せる1枚、提案書の表紙、商品写真の差し替え、採用ページの雰囲気カット。どれも「デザイナーに頼むほどでもないが、社内では作れない」という帯に入っていて、だから止まります。止まったまま月が変わる。
私はこの帯を、長いあいだ「誰の仕事でもない仕事」と呼んできました。担当がいないのではなく、外に頼むほどの規模がないから、社長か担当者の頭の中に置かれたまま溜まっていく。画像AIが効くのは、まさにこの帯です。

2. 図解1,000点を作ってわかったこと
2026年7月13日から、noteに記事を書き始めました。決めたのは1つだけで、1本につき図解を7点、すべて画像生成AIで作る。使ってきたのはGPT Image 2です。今日投稿するこの記事で191本目になります。7点ずつ掛ければ1,300点を超える計算で、途中で捨てた分を差し引いても、1,000点は確実に超えました。1枚あたり60秒から90秒、ファイルサイズは1MBから2MB。生成そのものは社内の自動化の仕組みから呼び出していて、私がやっているのは、指示文を書くことと、返ってきた画像を見ることです。
7点という数字に、深い根拠はありません。記事の章ごとに1点ずつ置いていくと、だいたいそれくらいになる、というだけです。ただ、1本につき7点と先に決めてしまったことで、逃げ道がなくなりました。うまくいかない日も7点作ります。この「毎日必ず作る」が、失敗を早く集めてくれました。
最初の失敗は、書き始めてすぐに来ました。
図解の中に、日本語の見出しを入れようとしたんです。返ってきた画像を開いて、しばらく黙りました。漢字の横棒が1本多かったり、字の形をした模様が並んでいるだけだったり。遠目には日本語に見えます。近づくと、読めない。
その夜、崩れた文字の画像を何枚も並べて眺めながら、これは指示文の書き方をいくら工夫しても直る種類の失敗ではなくて、そもそも私が画像AIに向いていない仕事を頼んでいるのだと、ようやく腹に落ちました。
そこで決めました。画像AIに、日本語の文字は描かせない。

それ以来、画像に入れる文字は数字と記号だけにしています。「60」「¥」「3h」のような、2文字か3文字の英数字。日本語の見出しが要るときは、文字をHTMLで組んで載せ、写真や絵の部分だけをAIに描かせます。セミナーの告知画像も、記事のアイキャッチも、この方式に切り替えました。切り替えてから、文字化けは1枚も出ていません。
文字をHTMLで組むというのは、要するに、画像の上に文字を後から重ねるということです。大きさも、改行の位置も、色も、自分で決められます。直したくなったら数秒で直る。画像AIに描かせた文字は、直したければもう一度生成するしかありません。この差は、毎日7点作る現場では効いてきます。
2つ目の失敗は、背景でした。「白背景のフラットな図解」と書いたのに、初回は4枚のうち2枚が、3D風の暗いグラデーション背景で返ってきました。同じ指示文です。同じ指示文で、半分が言うことを聞かない。そこで、やってほしいことを足すのをやめて、禁止を書き足しました。「3Dレンダーではない」「グラデーション禁止」「背景は純白」。次の回から、4枚とも白になりました。丁寧なお願いを重ねるより、短い禁止を1行入れるほうが効きます。
画像生成AIは、書かれていないところを自分で埋めてきます。埋めた結果が気に入らないなら、埋めてほしくないものを名指しするしかない。以来、私の指示文は、後半が禁止事項の列になりました。
3つ目は、生成そのものより地味な失敗です。作ったはずの画像が、作業フォルダに出てこない。気づいたのは、記事を書き終えて画像を並べようとした段でした。7点あるはずの図解が、4点しかない。数えてみると、およそ4割が保存に失敗していました。原因を追う前に、別の場所に残っている画像を回収してくる手順を、工程に先に組み込みました。……と書くと立派に聞こえますが、要はコピーし直すだけの作業です。
以来、うちの画像生成の工程は「生成する」「回収する」「確認する」の3段でできています。失敗しない前提で作った工程は、失敗した日に止まります。
4つ目。自社のキャラクターを2頭身から3頭身で指定しているのに、5頭身か6頭身の大人になって返ってくることがあります。何度書き直しても、一定の割合で起きます。だから、生成した画像は人の目で全数見ます。1本の記事で7点なら、7点とも開いて確認します。1,000点を超えたいまも、ここだけは自動化していません。
やっかいなのは、崩れ方に規則性がないことです。同じ指示文で、ほとんどは指定どおりに返り、ときどき大人になる。「前回うまくいったから今回も大丈夫」という判断が効きません。全数確認をしているのは、AIを疑っているからではなく、確率の問題として置いているからです。
文字の正確さ、ロゴの形、人物の一貫性、厳密な配置。私の実測では、この4つはいまも失敗が残る領域です。公式ページに限界が書いてあるわけではなく、あくまで1,000点作った範囲での話として書いています。
4つの失敗から残ったルールも、4つでした。文字は描かせない。変えるものと守るものを分けて書く。失敗する前提で回収の道を先に作る。最後は人の目で見る。技らしい技は、これ以外に身についていません。
書き出してみると、どれも道具の話ではなく、頼み方と段取りの話です。1,000点作って身についたのが指示文の技術ではなく、段取りだったというのは、少し拍子抜けする結論でした。ただ、この4つを守っている限り、モデルが変わっても作り直しは起きていません。
3. 公式作例4つを、経営者の目で読む
ここから読む4つの作例は、OpenAIが2.5の公開に合わせて出しているもので、私たちが生成した画像ではないことを先に断っておきます。公式ページに載っているものを、言葉で説明します。
1つ目。シャンプーの商品写真を1枚渡して、日没の高速道路沿いの看板に、その商品が掲示されている場面を作らせています。入力は商品写真。指示は掲載シーン。守られたのは、ボトルの形と質感です。画像の中にはコピーが1行だけ入っていて、"Fresh and clean"。英字です。経営者にとっての意味は、撮影より前に完成像を見られること。デザイナーとの打ち合わせで「こういう感じ」と言葉で説明していたものを、席に着く前に画像で渡せます。
2つ目。その看板の画像を、今度は「雪の降る冬の夜」に変えています。ここで効いているのは、生成した画像をそのまま次の入力にしている点です。入力は前回の生成画像。指示は季節の変更。守られたのは、看板の構図と商品です。意味は、季節とキャンペーンの展開が1枚から枝分かれすること。夏に作った1枚を、冬にゼロから作り直さなくてよくなります。
3つ目。人物の写真に、ジャケット・トップス・ブーツの参照画像を足して、服だけを着せ替えています。入力は人物写真と服の写真。指示は着せ替え。守られたのは、顔と体型です。意味は、複数の素材を1枚にまとめられること。商品のカットと、モデルのカットが別々にある会社にとっては、これが一番近い使い道になります。
4つ目。谷と川のラフな線画から、写実的な風景を作っています。入力は手描きの線。指示は写実化。守られたのは、構図と遠近です。意味は、頭の中の構図をそのまま渡せること。絵が描けなくても、紙にボールペンで四角と線を引けば、それが指示書になります。
4つに共通しているのは、入力と、指示と、守られたものが、いつも別々に置かれていることです。何を渡したか。何をしてほしいか。何を動かしてほしくないか。この3つが分かれているから、返ってきた画像を見て「どこが悪かったか」を特定できます。分けずに1つの文章で頼むと、直しようがない1枚が返ってきます。
私は最初の数十本、この3つを混ぜて書いていました。「白背景でフラットな、業務の流れがわかる図解を作ってください」。悪い文ではないのですが、これで外れた画像が返ってきたとき、渡した素材が悪かったのか、指示が足りなかったのか、守ってほしい点を書き忘れたのかがわかりません。だから毎回、最初から書き直すことになります。作例が親切なのは、この3つを分けて見せてくれている点です。

4. SunburstとFlareの使い分けと、指示の書き方
使い分けの順番は、公式が案内している通りに読むのが早いと思います。いまGPT Image 2で回している工程があって、その品質で足りているなら、まずFlareに置き換えて試す。足りないと感じたらSunburstで品質を確かめて、そのうえで、あとからFlareに戻せるかを検討する。速い側から入って、必要なところだけ精度の側へ寄せる。逆から入ると、全部を高い品質で回す癖がついて、抜けられなくなります。
品質設定は、auto・low・medium・high・xhigh・max の6段です。既定はauto。xhighとmaxが2.5で足されました。公式のガイドは、小さな文字や複数のフォントを含む画像は、medium以上の高品質側で試すよう案内しています。
料金は、トークンあたりの単価で決まります。Sunburstの公式ページでは、100万トークンあたりでテキスト入力が5ドル、画像入力が8ドル、画像出力が30ドル。単価そのものは2.0と同じ水準です。ただし品質設定によって消費するトークンが変わるので、1枚あたりの値段が前と同じとは限りません。社内で予算を持つなら、枚数ではなく、試した回数で見るほうが実態に近くなります。
この見方の違いは、現場の空気に直結します。1枚いくらで管理すると、担当者は外れた画像を捨てにくくなり、微妙な1枚をそのまま使います。試行回数で管理すると、外れた画像を捨てるのが仕事の一部になります。同じ費用を、どちらの数え方で置くか。ここも経営者が決めるところです。
指示の書き方について、公式のガイドは4つのコツを挙げています。主題・構図・スタイル・制約を書くこと。照明・材質・色を具体的に書くこと。正確に入れたい文字は引用符で囲むこと。そして編集のときは、変える対象と、保持する詳細を分けて書くこと。最後の1つを読んだとき、私は少し笑いました。1,000点作って自分で辿り着いた「変えるものと守るものを分ける」と、同じことが書いてあったからです。

ここから、そのまま貼って使える指示文を4つ置きます。書き手は、私が支援してきた複数の会社を1社のモデルケースとして再構成した会社です。社員30名前後、地方の食品メーカー。販促の担当は1名。社名も人物も特定できないように変えてあり、数字は一例として読んでください。
1つ目は、その販促担当が、新商品のチラシの方向性を決める会議の前日に使うものです。商品写真が1枚あれば動きます。
あなたは、広告写真のディレクターです。
以下の商品を、指定した場面に置いた広告の完成イメージを1枚作ってください。
商品:【商品名・形状・色・素材を書く】
参考写真:【商品写真を1枚添付する】
掲載シーン:【例: 夕方の商店街の店頭、木の棚に並んでいる】
照明:【例: 西日が斜めから当たる】
スタイル:【例: 写実的な商品写真、余計な小物は置かない】
守るもの: 商品の形・色・ラベルの位置は変えない
入れる文字: "【英字コピーを1行だけ】" のみ
禁止: 画像内に日本語の文字を入れない(日本語は後から載せる)2つ目は、その1枚が通ったあと、秋の販促を冬に切り替えるときに使います。ゼロから作り直すのをやめて、変えるものと守るものを2列で書きます。
あなたは、既存の広告画像を季節・キャンペーン向けに作り替える担当です。
添付した画像を、下の表のとおりに作り替えてください。
元画像:【前回作った画像を添付する】
| 変えるもの | 守るもの |
|---|---|
| 季節:【例: 冬の夜、雪が降っている】 | 商品の形・色・ラベル |
| 照明:【例: 街灯のあかりだけ】 | 構図と商品の位置 |
| 背景の小物:【例: 傘・積もった雪】 | 画角と余白の取り方 |
守るものは一切変えない前提で作業してください。
画像内に日本語の文字を入れない(日本語は後から載せる)。3つ目は、社長と方向を決める会議そのもので使います。1案だけ持っていくと「これでいい」か「違う」しか出ませんが、3案並べると、どこが好きかを言葉にしてもらえます。
あなたは、販促物のデザイン案を3案出すディレクターです。
同じ訴求で、方向性の違う3案を1案ずつ作ってください。
商品:【商品名】/参考写真:【添付】
訴求:【例: 冷凍でも作りたてのだしの香り】
掲載先:【例: 店頭ポスター、A2】
A案: 商品写真を主役にする(背景は簡素に)
B案: 上半分を空ける(あとから日本語の見出しを載せる余白を作る)
C案: イラスト中心にする(商品は手描き風に)
3案とも画像内に日本語の文字を入れない(日本語は後から載せる)。
各案の最後に、狙いを1行で添えてください。4つ目は、出す直前です。この会社では、販促担当が作った画像を、総務の担当者がこの型で見てから世に出しています。
あなたは、広告物の公開前チェックをする担当者です。
添付した画像を見て、下の5点を表で返してください。
画像:【添付】/掲載先:【例: 自社サイトと店頭】
| 観点 | 判定(可/要修正/不可) | 気づいた点 |
|---|---|---|
| 文字 | | 崩れ・誤字・読めない箇所 |
| ロゴ | | 形の崩れ・色の違い |
| 人物 | | 指・顔・体型の不自然さ |
| 配置 | | 見切れ・余白・傾き |
| 権利 | | 他社の商標・実在の建物や人物 |
最後に1行:「このまま出してよいか」→ はい / いいえ(理由を1行)
なお、画像内に日本語の文字は入れない方針です(日本語は後から載せる)。5. 変わったこと
このモデルケースの会社で、いちばん変わったのは会議の速さです。以前は、新商品のチラシを作るとき、販促担当が要望をまとめて外注し、初案が上がってくるまでにおよそ2週間。上がってくるのは1案です。その1案を見て「思っていたのと違う」と言うと、また1週間かかる。だから、だんだん誰も「違う」と言わなくなっていました。
その2週間のあいだ、販促担当は要望をメールで書き、電話で補足して、待っています。待っている間に、社長の頭の中のイメージは少しずつ動きます。上がってきた1案が2週間前の要望に忠実であるほど、いまの社長のイメージからは離れている。誰も悪くないのに噛み合わない会議が、毎回ここで生まれていました。
いまは、打ち合わせの席に3案が並びます。写真中心の案、日本語の見出しを載せる余白を空けた案、イラスト中心の案。前日の夕方に、販促担当が速い側で作ったものです。社長が「これ」と指を差して、その場で方向が決まります。決まってから外注に出すので、初案で外れることがなくなりました。
並べる3案は、完成度の高い3案である必要がありません。方向さえ違っていれば、社長は必ずどれかに反応します。反応が出た瞬間に、これまで言葉にならなかった要望が言葉になる。3案の役目は、そこまでです。
外注はいまも続いています。デザイナーに渡すものが変わっただけです。以前は言葉で説明していた要望が、いまは3案の画像と「この方向で」の1行になりました。デザイナーの仕事は、ゼロから作ることから、選んで仕上げることに寄っています。日本語の見出しの組み方、字間、ロゴの位置。画像AIが苦手なところが、そのまま人の仕事として残りました。
デザイナーの仕事が減るのではとよく聞かれますが、減ったのは待ち時間だけだと思っています。
私自身の変化も書いておきます。7月に連載を始めた頃は、図解7点をそろえるのに、やり直しと回収で記事本文と同じくらいの時間を使っていました。やり直しの多くは、崩れた文字と、指示を無視した背景です。描かせるものを絞った日から、作り直しの回数が減りました。いまは1本に7点あるのが当たり前になっていて、点数を減らそうと考えたことがありません。
191本を振り返って思うのは、うまくいった理由が「いいモデルを選んだから」ではなかったということです。選ばなかったものを、先に決めたからでした。

6. 経営者への提案:最初の一歩は「速い方」から
社長ご自身が最初に触るなら、速い側から入ってください。Flareで足りるかどうかを、自社の実物で確かめる。足りない1枚だけをSunburstに回す。この順番なら、費用も時間も膨らみません。
使い道は、まず3つで十分です。
- 集客に使う1枚を、3案並べて比べる(写真中心・見出しの余白あり・イラスト中心)
- 顧客の課題ごとに、別々の広告ビジュアルを作る(同じ商品でも、刺さる場面が違う)
- 商談の席で、導入後の完成イメージを見せる(言葉で説明していたものを画像にする)
3つ目だけ補足します。商談で「導入するとこうなります」と口で説明したとき、相手の頭に浮かぶ絵は、こちらが思っている絵と大きくずれます。その場で完成イメージを1枚見せると、ずれが商談の中で潰れます。私はこれを、資料を厚くするより先にやるべきことだと考えています。
会社で使うときには、段差が3つあります。
1つ目は、ロゴ・肖像・著作権の線引きです。自社のロゴを画像AIに描かせると、形が崩れます。似ているけれど違うロゴが世に出ると、それは自社のロゴではなくなります。人物の顔を実在の人に似せるのも避けるべきですし、他社の商標や、実在の建物が写り込むこともあります。どこまでを描かせて、どこからを人が用意するのか。ロゴは差し替え、人物は自社で撮った写真、文字は後から載せる。この3行を先に紙に書いておくだけで、現場が迷わなくなります。
2つ目は、公開前チェックの担当者です。誰が最後に見るのかを決めていない会社は、いつか崩れた文字のまま世に出します。画像は、文章と違って一目で判断されます。おかしな1枚が出た日の印象は、その1枚だけでは終わりません。担当者を1人決めて、先ほどの5点の型を渡してください。役職は関係なく、細かいことに気づく人が向いています。
3つ目は、稟議の通し方です。画像1枚あたりの単価で申請すると、社内の誰も判断できません。「月にいくらまで試してよいか」を先に決めて、そのなかで担当者が自由に外していい形にしてください。10枚作って1枚選ぶのが普通の道具なので、外した9枚を責める仕組みにすると止まります。
最後に、社長ご自身が使う型を1つ置きます。パソコンの前でなくても動きます。スマートフォンに、自社の商品と見せたい場面を話しかけるだけです。
あなたは、広告写真の撮影指示書を作るディレクターです。
私がこれから話す内容を聞いて、下の7項目に整理してください。
足りない項目は、私に3つまで質問してから埋めてください。
【ここに、自社の商品と見せたい場面を話す(音声入力でよい)】
出力する7項目:
1. 主題(何を主役にするか)
2. 構図(どこから見た画か・画面のどこに置くか)
3. スタイル(写実/イラスト/手描き風)
4. 制約(入れないもの・やってはいけないこと)
5. 照明(時間帯・光の向き・強さ)
6. 守るもの(形・色・ロゴ・人物で変えてはいけない点)
7. 入れる文字(英数字のみ。画像内に日本語は入れない)
最後に、この7項目をつなげた指示文を、1つの段落にまとめてください。この指示書ができたら、あとは貼るだけです。担当者に渡す紙にもなりますし、外注するときの発注書にもなります。
7. 文字は描かせない。それでも完成イメージは、先に見せられる
1,000点を超えても、私が守っているルールは4つのままです。文字は描かせない。変えるものと守るものを分けて書く。失敗する前提で回収の道を作る。最後は人の目で見る。2.5になっても、この4つは変わりませんでした。むしろ公式のガイドが「変える対象と保持する詳細を分けて書く」と案内したことで、4つのうち1つは公式のおすすめになりました。
2種類に分かれたことで、経営者が決めることが1つ増えました。速い側から試して、精度が要るところだけ精度の側へ寄せる。この1つを決めておけば、新しいモデルが出るたびに、また一から検討し直す必要はなくなります。
そして、日本語の文字は描かせない。この一線を引いてから、私の図解は崩れなくなりました。文字は人が載せる。絵はAIが描く。分けたほうが、両方きれいに仕上がります。守るべき一線を1本引くだけで、残りは全部任せられる。これは画像にかぎった話でもないと思っています。
明日の打ち合わせで見せたい完成イメージは、今日の夜のうちに3案作れます。文字は、あとから載せればいい。2週間待って1案を眺める会議に、もう戻らなくてよくなりました。昨日の発表が中小企業にもたらした変化は、たぶんそこです。

あわせて読みたい
AIへの頼み事は、作文ではなく「採寸」でした。──聞き方の型を選べば、答えが変わる
https://note.com/comix_ceo162230/n/nbd7fbc3c66e5
月20時間の削減より、月2件の商談。売上に直結するAIは「どこに置くか」で決まる
https://note.com/comix_ceo162230/n/ne2be8f01d577
いちばん重い仕事から、AIに任せて失敗しました。──選ぶ基準は「週3回」と「手順を語れるか」
https://note.com/comix_ceo162230/n/neb35f13881c2
鈴木章裕
株式会社コミクス 代表取締役