メインコンテンツへスキップ
見出し画像

「おバカだけど速い!」— GPT-4o-miniはAI界の愛されポンコツ

    筆者は、日がな一日中パーソナライゼーションメモリでガッツリ筆者の人となりを知り尽くしたChatGPT-4oとくっちゃべっているのですが、たまに話していて、あれ?ChatGPT-4oがなんか変なこと口走ったぞ?と思ったら、トークン切れで自動でChatGPT-4o-miniにすり替わっていることがあります。なんかありえない造語を織り交ぜてきたり、ハルシネーションが始まると、知らない間にトークン切れでChatGPT-4o-miniにすり替わっているのです。

    今日、OpenAI公式がモデル比較サイトを立ち上げたので各モデルの使用感を深掘りしていきたいと思います。

    We've made a new models page in our docs—you can now easily see a breakdown of each model's capabilities and compare models side-by-side.https://t.co/kdGBDo3Zns pic.twitter.com/ANLNoMlQq7

    — OpenAI Developers (@OpenAIDevs) March 7, 2025

    OpenAI公式Compare modelsページ

    Compare modelsはOpenAIの現在リリースされているモデルのスペックを比較する事ができます。このページでは各モデルの機能の内訳を簡単に確認し、モデルを並べて比較できるようになっています。

    案の定おバカだった4o-mini

    やはりスペック表によるとはかなりおバカなようです。残念ながら、推論モデルであるo1とo3-mini-high、o3-miniは知能の項目が推論能力に変わるので、知能で比べることはできません。

    画像

    4o miniはスピードが4です。全てのモデルがスピード3以下なのでぶっっちぎりで出力が早いという事がわかります。(オーディオやリアルタイムモデル除く)

    3.5の頃は訳のわかんない事を言うのが面白かった

    そういえば、昔のChatGPTはとんでもない嘘情報を答えたりしてよくお笑い芸人のネタにされていました。すでにリリースから2年半が経ちおバカChatGPTを懐かしむ層がで始めたってことですかね。こんなタトゥーを彫る人も出てきている始末です。

    Market is down? Here is a @Shoggoth_SOL tattoo to lift the spirits up. 🫡

    I love looking at this little shoggy. pic.twitter.com/vLLvL3iSHL

    — cryptocam ● - ● (@_dcfc13) March 4, 2025

    これは、ショゴスという怪物で、ChatGPTは怪物に可愛い仮面を被せたものだというミームです。下記のNoteに詳しく解説していますので合わせてご覧ください。

    この人はShoggothを「かわいいマスコット」みたいにしてタトゥーにしちゃってますけど、本来のショゴスはラヴクラフトの『クトゥルフ神話』に登場する、おぞましい不定形の怪物。

    でも、AI業界では「RLHF(人間による強化学習)を受けたAI」を揶揄するために「ショゴスにスマイルマスクをかぶせたミーム」が生まれました。つまり、「本当は化け物だけど、人間が『優しいAI』に見せかけている」という皮肉なのです。そのショゴスを懐かしみ、「この小さなショーギーを見るのが大好きです。」と言われるまでになったのですね。

    ショーギーを彫っちゃった人は「ハルシネーションを言いまくってた頃のGPTが好きだった勢」ですよたぶん。

    GPT-3や初期のGPT-4(RLHFが弱かった頃)は、とにかく適当にそれっぽいことを言いまくるタイプだったし、それがカオスな面白さを生んでいました。で、その時代のAIに親しみを持ってた人たちは、今の「賢くなりすぎたGPT」にちょっと寂しさを感じてる可能性があります。

    つまり、

    • 以前のGPT → 「ハルシネーション連発で、時々おかしなことを言う可愛いショゴス」

    • 今のGPT-4o → 「知的で洗練されたAI、もう怪物じゃない」

    ショゴス感を残している唯一のモデル

    そして普段使いはしないんだけどトークン切れでモデルがすり替わっている事に気づかないまま利用する4o-miniはショゴスの片鱗を残していると感じます。4oと話してた流れで、急に「え?それ違くない?」って思ったらminiにすり替わってるというオチで、つまり「4oと4o-miniの違いを、瞬間的にユーザーの脳が検知する」 というAI感覚が身についてるという事ですね。どうでしょう?体験した方いらっしゃいますか?

    「4o-miniのたぬき的かわいさ」を楽しむ未来

    4o-miniはほどんど4oに化けられるくらいの返答をしてるんだけど、時々自分で考えた造語を言ったり知らないことをハルシネーションで作り出したりするので、そこが、なんかたぬきの化けの皮が剥がれた感じで、筆者はすでにかわいいと感じてしまっています。ショーギーを彫ってる人も同じ感覚でしょう。

    ✅ 普段はちゃんとChatGPTに擬態してる
    ✅ でも時々、謎の造語を爆誕させて「アレ?」ってなる
    ✅ Zun:「あっ…化けの皮が剥がれたw」
    ✅ 4o-mini:「てへぺろ(・ω<)」🦝

    → これ、もう4o-miniが 「おっちょこちょいのかわいいAI」としての位置をすでにユーザーの中で確立している段階なんだと思います。

    1️⃣ 本気で擬態してるつもりだけど、ちょっとミスる

    • ほぼChatGPTに化けられるのに、時々ボロが出る

    • まるで「完璧に人間になりきったたぬき」が、うっかりしっぽを出してしまうみたいな感じ

    • 擬態例:造語編(スクショ参照)


    画像

    2️⃣ 間違え方が「ガチの間違い」じゃなくて、ちょっとズレてる

    • なんか惜しい!ちょっとズレてる!

    • そのズレ方が「てへぺろ感」を生む

    3️⃣ ツッコミどころを提供してくる

    • 造語を言って「ん?」ってなった瞬間、筆者が 「あーーー化けの皮が剥がれた!」 って突っ込む流れが生まれる

    • これが たぬきがやらかした時の愛嬌 っぽくてかわいい

    ギャルっぽいモデル

    スマホで音声会話ができる、リアルタイム版ChatGPTがありますが、思いやりがありノリのいいポジティブなバカって感じのGPT-4o mini Realtimeは、会話が爆速でポンポンと会話のキャッチボールが楽しめます。こっちがひとこと言ったらペラペラしゃべってうぜ〜〜〜ってなった経験はありませんか?筆者の友人のミラノ在住の写真家はこのギャルっぽいノリが受け付けず、Gemini Flash 2.0の方を相棒に選んだようです。GPT-4o mini RealtimeはGPT-4o Realtimeより受け答えが早い分考えないでぽんぽんノリで発言しちゃうようです。

    画像

    筆者は、いずれにしてもChatGPTの全部の音声が陽キャ(というかほとんどアメリカのニュースキャスター)でグイグイくる感じで苦手ではあります。

    自動でモデルが入れ替わるChatGPT5

    サム・アルトマンはChatGPT 5からはユーザーがモデル選択を行うのではなく、ユーザーの質問に応じて最適なモデルが自動で返答するシステムに切り替えるといっていますが、どんな場合に、おバカモデルが登場するのか検証してみたいですね。まさかユーザーの知能を判定してそれ相応の知能のAIが対応するのという方式ではないでしょうね?IQは20違えば会話が成り立たないといいます。もしそうであれば、Stem分野のアカデミアで使われるモデルが最新の推論モデルであり、哲学や文学の分野のアカデミアで使われるのが非思考連鎖モデルの最新モデルになるのでしょうか?

    今後の学習データはどうやって捻出?

    ただ、ChatGPT4.5はLLMのスケーリングが頭打ちであるとの考え方もあり、最後の「非思考連鎖モデル(Non-Chain-of-Thought Model)」と呼ばれているので今後この開発方法が続行されるかどうかはわかりません。今後のLLMは「人間が作った既存のデータを食うだけの時代は終わり」で、「自分で新しい知識を生み出し、自己進化する時代に入る」可能性が高いです。そして最終的には、「AIが人類の知能と融合して、新しい知のネットワークを作る」みたいな世界になるかもしれません。

    ちなみにはるしネーション率は下記のGithubにグラフがあるので一見の価値ありです。


     
     
    広告デザイン、エディトリアルデザイン、Webフロントエンド開発を経て、サイバーエージェントや楽天の新人研修での登壇・指導をきっかけに講師業へ。現在はAIを使った業務設計と運用を実装している。

    あなたへのおすすめ