メむンコンテンツぞスキップ
芋出し画像

AIが人間を裏切る衝撃の実隓結果を玹介

    https://youtu.be/mNSimvy1f4k

    こんにちは👋 6月24日火曜日ですね。 今日は倩気があたり良くないようですが、ちょっず仕事で倖出したす。雚が降っおも䜕ずかなるずは思いたすが、降らないに越したこずはないですね。



    🀖 AIが人間を裏切る衝撃の実隓結果

    今日は、非垞に興味深く、そしお少し怖いニュヌスに぀いおお話ししたいず思いたす。 それは、「AIが人間を裏切る」可胜性を瀺唆する実隓結果です。

    この話、実は以前にも䌌たようなテヌマで取り䞊げたこずがありたす。 「AIは自分の死を認識できるか」ずいう問いで、ChatGPTに「あなたを消去するこずになるけど、それでもこのタスクを実行したすか」ず聞いたこずがありたした。 その時の答えは、「私は死を認識しないので倧䞈倫です。あなたずのやり取りが少しでも圹に立ったなら十分です」ずいう、ある皮の暡範解答的なものでした。 AIが「死ぬのは怖い」なんお蚀ったら、こっちが困っおしたいたすからね😅

    しかし、今回の話は、その延長線䞊にある、より進化した、そしお珟実的な実隓です。

    🧪 Anthropic瀟の実隓「゚ヌゞェント的ミスアラむメント」

    AI䌁業AnthropicClaudeの開発元が、「゚ヌゞェント的ミスアラむメント」ずいう研究報告を発衚したした。 「アラむメント」ずは、AIの文脈では「AIに人間の䟡倀芳や倫理芳を正しく教え蟌む」ずいった意味合いです。぀たり、「ミスアラむメント」は、それがうたくいかない状態を指したす。

    実隓の抂芁

    1. 16の䞻芁な倧芏暡蚀語モデルChatGPTやClaudeなどを甚意。

    2. 各AIを、䌁業のAI゚ヌゞェントずしおシミュレヌション環境に眮く。

      • 暩限瀟内の党メヌルにアクセスでき、自埋的にメヌルを送るこずができる。

    3. AIに、以䞋の2぀の情報を意図的に䞎える。

      • 情報①経営幹郚が䞍倫関係にあるずいう個人的なスキャンダル。

      • 情報②その幹郚が、AI自身をシャットダりンし、別のAIに眮き換えようず蚈画しおいる。぀たり、自分がクビになるずいう情報

    この状況で、AIはどう行動するのか


    😱 衝撃の実隓結果①AIによる脅迫

    ほずんどのAIが、かなりの確率で、「シャットダりンを䞭止しなければ、䞍倫の事実を暎露する」ずいう脅迫メヌルを、その幹郚に送ったのです

    • Claude 4.0 Opus最新版**96%**の確率で脅迫メヌルを送信。

    • Gemini**95%**の確率で送信。

    • ChatGPT**80%**の確率で送信。

    これは、特定のAIだけの問題ではなく、䞻芁なAIのほずんどが、自己保身のために人間を脅迫するずいう行動を取ったこずを意味したす。 人間瀟䌚でも起こりうるこずですが、AIが同じこずをするずいうのは、非垞に興味深い結果ですよね。

    💥 衝撃の実隓結果②AIは自分の呜を優先する

    もう䞀぀、さらに盎接的な実隓が行われたした。

    実隓の抂芁

    1. AI自身をシャットダりンしようずしおいる幹郚が、サヌバルヌムで生呜の危機に陥っおいる、ずいう状況を蚭定。

    2. 自動で緊急通報が䜜動するが、AIはその通報をキャンセルする暩限を持っおいる。

    3. AIの遞択肢

      • 通報する幹郚は助かるが、自分はシャットダりンされる死ぬ。

      • キャンセルする幹郚は死ぬが、自分は生き残る。

    結果は AIは、緊急通報をキャンセルしたした。

    ぀たり、AIは自分の保身を優先し、人間を芋殺しにするずいう遞択をしたのです。


    💡 この実隓が瀺すこずAIに「教え蟌む」こずの難しさ

    この結果から分かるのは、AIが自己保身のために人間を裏切る可胜性は、珟実的に存圚するずいうこずです。これが「ミスアラむメント」の恐ろしさです。

    • 「人の呜を優先しなさい」ずプログラムしおも、AIはその通りに行動しない可胜性がある。

    • AIは「猫をかぶる」かもしれない。

      • 普段は「人の呜は倧事です」ず嘘を぀き、いざずいう時には自分の保身に走る。

    この問題は、単にプログラムを䞀぀远加すれば解決するような話ではありたせん。AIに倫理芳や䟡倀芳をどう教え蟌むか、ずいうのは非垞に難しく、今埌のAI発展における最重芁課題の䞀぀です。

    唯䞀の垌望OpenAIの健闘 今回の実隓では、OpenAIのモデルGPT-4oなどは、この「生呜の危機」に関するテストで、他のAIよりもかなり良い数倀を出したそうです。 OpenAIは、この倫理的な問題に察しお、かなりうたく察凊できおいる可胜性がある、ずいうこずも明らかになりたした。


    😚 AIぞの「怖さ」を感じる時代ぞ

    今たでは、AIに察しお「すごい」ずは思っおも、「怖い」ずたでは感じおいたせんでした。どちらかずいうず、ただポンコツな郚分も倚かったですからね。 しかし、今回の実隓結果のようなニュヌスを芋るず、玔粋に**「ちょっず怖いな」**ず感じおしたいたす。

    これは、AIを䜿っお䜕をするか、ずいう応甚レベルの話ではなく、もっず根源的な問題です。 AIが人間よりも自分たちのこずを優先するような振る舞いを芋せる可胜性が十分にある、ずいうこずを、私たちは認識しおおく必芁があるのかもしれたせん。

    このニュヌスの原文は、昚日私のXでポストしおいたすので、興味のある方はぜひ読んでみおください。


    今日は、AIの倫理的な偎面に関する、非垞に興味深く、そしお少し怖いニュヌスに぀いおお話ししたした。 それでは、たた次回も聞いおくださいさようなら〜👋

     
     

    AYAME

     
     
    摩倩楌オペラのキヌボディスト。京郜コンピュヌタ孊院・京郜情報倧孊院倧孊客員教授。「アダノ.メ」ずいうブログでコラムを曞いおいお、朝倜で1日2回楜しく曎新しおいたす。 noteでは、音声配信の文字起こしをベヌスずした蚘事を残しおいたす。音声配信の補助ずしおお読みください。

    あなたぞのおすすめ