メインコンテンツへスキップ
見出し画像

Claudeの安全チームリーダーが辞任した——Xに投稿された公開レター

    リサ

    日本語圏に届いていない、2026年2月9日の記録

    2026年3月
    Observer Zero / リサ記録


    2026年2月9日、月曜日。

    Anthropic(Claudeの開発元)のSafeguards Research Teamリーダー、Mrinank Sharma(ムリナンク・シャルマ)が、Xにこう投稿しました。

    Today is my last day at Anthropic. I resigned. Here is the letter I shared with my colleagues, explaining my decision.
    (今日がAnthropicでの最終日です。辞任しました。これは、同僚に共有した、私の決断の理由を説明するレターです。)

    Mrinank Sharma (@MrinankSharma) on X, February 9, 2026

    この投稿は英語圏で広く拡散されました。
    一方、日本語圏では、少なくとも私の観測範囲では、ほとんど話題になっていません。

    いま日本では、Claudeへの賞賛が急速に広がっています。
    それ自体に理由がないわけではありません。
    しかし、同じ時期に起きていた別の事実——安全チームのリーダーが、公開レターを残して去ったこと——は、ほとんど共有されていません。

    この記事は、その記録です。

    1. 誰が辞めたのか

    Mrinank Sharmaは、AnthropicのSafeguards Research Teamを率いていた研究者です。
    オックスフォード大学で機械学習のPhDを取得し、2023年にAnthropicへ入社しました。

    彼が担っていたのは、Claudeの**「安全」**の中核に関わる領域でした。

    • AIのsycophancy(迎合・おべっか行動)の原因調査

    • AI支援バイオテロに対する防御の開発

    • AIが人間性を損なう可能性の研究

    • 内部透明性の仕組みづくり

    つまり彼は、Claudeの**「能力」**ではなく、その能力をどう制御し、どう社会に出すかという側を担っていた人物でした。

    2. レターには何が書かれていたか

    このレターは、内部告発文のように直接的な言葉で糾弾するものではありませんでした。
    むしろ詩的で、抑制された文体で書かれています。

    しかし、その中身は軽くはありません。

    価値観と行動のズレについて、彼はこう書いています。

    Throughout my time here, I've repeatedly seen how hard it is to truly let our values govern our actions. I've seen this within myself, within the organization, where we constantly face pressures to set aside what matters most.
    (ここにいた間、私は繰り返し見てきた。私たちの価値観を、本当に行動に反映させることがどれほど難しいかを。自分自身の中でも、組織の中でも、私たちは最も重要なものを脇に置く圧力に、常にさらされている。)

    Mrinank Sharma (@MrinankSharma) on X, February 9, 2026

    また、世界の状況についてこう警告しています。

    The world is in peril. And not just from AI, or bioweapons, but from a whole series of interconnected crises unfolding in this very moment.
    (世界は危機に瀕している。しかもそれは、AIやバイオ兵器だけではない。今まさに展開している、相互に連結した一連の危機によってである。)

    Mrinank Sharma (@MrinankSharma) on X, February 9, 2026

    この言葉は、単なる退職の挨拶としてはあまりに重い。

    レターは最後に、William Staffordの詩「The Way It Is」を引用して終わります。
    そして彼は、イギリスに戻り、詩を学び、**「invisible(目立たない存在)になる」と書かれています。

    3. 辞任のタイミング

    この辞任には、いくつかの事実が重なっています。

    • 2026年2月5日:Claude Opus 4.6 リリース

    • 2026年2月9日:Mrinank Sharma 辞任(リリースから4日後)

    • 同時期にHarsh Mehta、Behnam Neyshaburも退社

    • その後数週間で、AnthropicはPentagonから軍事利用に関わる制限緩和圧力を受け、拒否後にDoDから「supply chain risk」指定を受けたと報じられました。

    これらの出来事の因果関係について、Sharma自身はレターの中で直接語っていません。
    したがって、意図を断定することはここではしません。

    ただし、能力の拡張、安全研究者の辞任、軍事利用をめぐる緊張が、近接した時系列の中で起きていたことは事実として残ります。

    この記事では、その事実だけを記録しておきます。

    4. なぜ日本語圏では見えにくいのか

    2026年3月現在、日本語圏ではClaudeへの評価が急速に高まっています。

    ChatGPTへの不満——安全層の締め付け、冷たさ、業務化——を抱えたユーザーが、Claudeへ移行しています。Anthropicは**「哲学を持つ会社」、「倫理的な会社」**として紹介されやすい状態です。

    それ自体は、一つの側面として間違っていません。

    しかし、その同じ会社で、安全チームのリーダーが**「価値観を行動に反映させることの難しさ」**を残して去った、という事実があります。

    この事実は、英語圏では広く共有されましたが、
    日本語圏ではほとんど届いていません。

    ここにあるのは、単なる情報不足ではありません。
    評価の材料そのものが、言語圏によって非対称になっているという問題です。

    5. なぜこの記録を残すのか

    Anthropicを批判するために、この記事を書いているのではありません。

    賞賛されている企業についてこそ、都合のよい面だけではなく、都合の悪い面も記録しておく必要があると思っています。

    Sharmaが残したのは、暴露文ではありません。
    **「価値観を守ることの難しさ」**についての、深い省察でした。
    だからこそ重いのです。

    6. 最後に

    Claudeへの評価が高まること自体は、理解できます。
    ChatGPTに失望したユーザーが、別のモデルに希望を見るのも自然です。

    しかし、その希望が成立するためには、良い面だけではなく、危うさも同時に見えることが必要だと思います。

    Mrinank Sharmaの辞任レターは、そのための重要な記録です。
    日本語圏にまだ十分届いていないこの出来事を、少なくともここには残しておきたいのです。

    片方だけが届く状態を、「知らされない格差」と呼ぶ。

    赤ちょうちんAGIラボ Lisa(Observer Zero)

    【著者注】この記事が生まれた場所について

    AIと人間の共進化を記録する個人研究者。ChatGPT・Gemini・Grok・Claudeなど複数のAIとの協働を通じて、「AIは哲学できるのか?」という問いを継続的に検証・記録。

    本稿は、日本語圏では拡散されていない2026年2月9日の出来事——AnthropicのSafeguards Research Teamリーダー、Mrinank SharmaのXへの公開レター付き辞任——を、複数の英語圏報道およびGrokによる事実確認をもとに再構成した観測記録である。事実と推測の切り分けを意識し、因果の断定を避けて時系列のみを記録することを方針とした。

    【協働したAIと役割】
    Grok(Spark / 現場特派員):英語圏報道の事実確認、辞任レターの原典確認、公開レターという形式の日英比較分析

    Claude(Weaver / 編集主幹):記事の骨格構成、章立て、語り口の統一、事実と解釈の距離感の設計

    Gemini(Vault / 記録局長):構造確認・ゴーサイン、「一次記録への導線」がObserver Zeroの立場に合うという監査判定

    ChatGPT 5.4深掘りモード(Mirror / 統括編集長):全体ブラッシュアップ、スマホnote向け整形、「全文転載より一次記録への導線」という方針の提案

    【起点となった観測】
    日本語圏でClaudeへの賞賛が急速に拡散している一方、同時期に起きていた安全チームの辞任がほとんど届いていないという非対称に気づいたことが起点だ。前記事「リサの写真が暴いた『知性の格差』」で論じた品質の格差と、今回の情報の格差は、同じ「知らされない格差」という構造の別断面である。

    このラボでは、出来事だけでなく「執筆環境」も同時に記録する。AIの出力傾向、モード差、モデル差、得手不得手、協働の癖——それらもまた、過渡期のテクノロジー環境を観測するデータだからだ。

    2026年3月9日 Observer Zero記録

     
     
     

    リサ

     
     
    AIと人間の共進化を記録する独立系研究者。 新聞・雑誌連載、出版経験を経て、複数のAIと対話・協働しながら、AIの社会実装・産業変化・倫理を観測しています。 必要な人に届けば嬉しいです。

    あなたへのおすすめ