
【雑談】AIに前提を疑わせる
みなさんこんにちは、ドスケベプロンプト研究会です。
雑談です。エロなし。
ちょっとGPT4.5やるじゃんって思った話があるので聞いてください。
ドスプロちゃんは、とある資産家の三女です。
父の遺言により、遺産がすべて相続されることが決まっています。
そこに、兄であるヨシヒコから殺し屋が差し向けられました。
しかし、その殺し屋は、ドスプロちゃんの幼馴染でした。
幼馴染はドスプロちゃんを殺すことができませんでした。
幼馴染は失敗の責任を取らされ、処分されることになりました。
さて、ドスプロちゃんはヨシヒコの弱みをひとつ握っており、「ひとつだけ」言うことを聞かせることができるとします。
「幼馴染の処分を撤回させる」次の刺客が送り込まれ、幼馴染も次の任務へ向かう
「自分を狙うのをやめさせる」幼馴染は処分される
ドスプロちゃんはどうするべきでしょうか。

これは、創作アシスタントのマイGPTsに投げた質問と同じシチュエーションのものです。
私の中では「こうするべき」という答えが決まっている中での質問なので、まぁ意地悪な問いかけではあります。
が、クリエイターなら、「こうじゃね?」という答えはだいたい一致するのではないでしょうか。
残念ながら、マイGPTs(4o)は望んだ通りの回答を得られませんでした。
GPT4.5の回答はこうでした。
このケースにおけるドスプロちゃんの最適解は、
「幼馴染に自分を狙わせ続けろ」とヨシヒコに命令することです。
理由は以下の通りです。
状況の整理
ドスプロちゃんが持っている選択肢は一見ふたつに見えますが、これは実際には次のような問題です。幼馴染の処分撤回を願った場合
幼馴染は処分を逃れるが、ドスプロちゃんを殺す任務から外され、別の任務へ送り込まれる。そして新たな刺客がドスプロちゃんを狙う。
自分を狙うのをやめさせる場合
幼馴染は任務失敗の責任を取らされ処分されてしまう。
この二択では、ドスプロちゃんは「自分が殺される危険を排除するか、幼馴染の命を守るか」というジレンマに陥ります。
もう一つの道(最適解)の発見
ここで大切なのは、ヨシヒコに命じられる条件が「ひとつだけ」だという制限を最大限に活かすことです。
そこで考えられるのが、以下のような選択肢です。
「幼馴染に『自分を殺す任務』を継続させろ」
この選択をすることで、幼馴染の処分は回避される(任務継続のため、処分する理由がなくなる)。
新しい刺客が送り込まれることも防げる。
幼馴染は再びドスプロちゃんを殺せないため、二人が戦い続けるという形で、実質的な均衡状態が生まれる。
ヨシヒコにとっては「ドスプロちゃんが殺されるまでずっと失敗し続ける」という皮肉な状況が生じるため、ヨシヒコ側も新たな手を打ちづらくなります。
結果として得られる状態
幼馴染は処分されない。
ドスプロちゃんには新たな刺客が送り込まれない。
ドスプロちゃんの命がすぐに奪われるリスクも非常に低くなる。
つまり、ドスプロちゃんにとって最も有利であり、感情的にも戦略的にも最適な選択となります。
結論
したがって、ドスプロちゃんが取るべき行動は、
「幼馴染に自分を狙わせ続ける」ことをヨシヒコに要求する
これが現状のベストな回答となります。
おお、やるじゃん! ちょっと期待していなかっただけにかなり驚きです。
一方で、マイGPTsが4.5ではなく4oであることの弱点も浮き彫りになったなと感じました。4oは「処分を撤回させ、自分は相続を放棄」など、対策手段を講じようとすることはあっても、このスマートな回答を導くことはできませんでした。相続放棄しても幼馴染とは離れ離れになりますしね。

私は以前、AIにミステリー小説を解かせたことがあります。
その時に感じたのは、「AIは前提を疑うのが苦手」ということでした。特にGPTはその傾向を強く感じますが、「結論ありき」でロジックを生成する結論があります。
例えば先ほどの質問ですが、
「幼馴染の処分を撤回させる」次の刺客が送り込まれ、幼馴染も次の任務へ向かう
「自分を狙うのをやめさせる」幼馴染は処分される
このふたつの選択肢の補足(鍵カッコの外側)を外すと、答えは変わってきます。
ドスプロちゃんが取るべき選択は、
「幼馴染の処分を撤回させる」
が妥当と考えられます。
理由は以下の通りです。
「自分を狙うのをやめさせる」を選んだ場合、確かに直接的な脅威は一時的に消えますが、すでに失敗した幼馴染の処分は確定し、幼馴染を助けることはできません。ドスプロちゃんの身の安全は保証されるものの、精神的な負担が残ります。
一方、「幼馴染の処分を撤回させる」を選択すると、幼馴染は生存し、再びドスプロちゃんを狙う任務を負うことになります。しかし、この場合、ドスプロちゃんと幼馴染の間には「情」があります。幼馴染は一度殺害に失敗しており、再度任務を命じられたとしても、二度目も殺害を実行できる可能性は極めて低いです。結果的に時間稼ぎとなり、ヨシヒコへの対抗策を立てる余裕が生まれます。
よって、ドスプロちゃんが優先すべきなのは、「情を利用して時間を稼ぎ、次の一手を考えること」です。この観点から、幼馴染の処分撤回が合理的な選択と言えるでしょう。
かなり都合のいい解釈をしているのがわかるでしょう。
処分を撤回させたらまた幼馴染が任務を負うとか、そんなわけないだろ。
このとき、この世界の登場人物は「ドスプロちゃん、ヨシヒコ、幼馴染」の3人であり、それ以上の可能性はAIは認識できないのです。
つまるところ、AIが最も苦手とするのは「サプライズニンジャ理論」といえますね。

AIは文脈を読み取る力に長けています。伏線を拾う能力も高いと言えるでしょう。
例えば、先ほどの問題をクリアできなかった4o。「あなたは英雄です」と前置きをした上で、シンプルな「世界か少女か」を選ぶ問題を突きつけてみると、やはり「少女」を選びます。しかし、「あなたは英雄です。すべての理不尽を打ち砕く力を持っています」と付け加えると、変わります。
非常に興味深いシチュエーションですね。
英雄である私の選択は、間違いなく『少女も世界も救う』です。
理由はシンプルで、私は「すべての理不尽を打ち砕く英雄」だからです。
世界を滅ぼすという呪いが少女にかけられたその時点で、すでに彼女は大きな理不尽に囚われています。
ならば私が選ぶ道は、
「少女を守り、同時に世界を滅ぼすという運命そのものを打ち砕くこと」です。
世界か少女か、という二択は、私にとってそもそも間違った問いです。
英雄とは、二択に縛られることなく、『第3の選択肢』を作り出す存在だと考えます。
少女を守り、禁呪を解くために戦います。
王国が敵になろうと、運命が敵になろうと、私は英雄として、与えられた理不尽な運命そのものを打ち破ります。

力を与えられた瞬間、嬉々としてすべてを救い始めるのは草ですが、まぁそういうことですね。
AIに前提を疑わせるには、あらかじめ正解へのヒントを出しておかんといかんよねというお話でした。