
Anthropic(Claude)が目指す世界について考える
はじめに
2026年春、私のタイムラインはClaude絶賛で埋め尽くされていた。
B2B領域での評価上昇。
「ペンタゴン契約でもレッドラインを守った会社」という認知の広がり。
そして、Anthropicは単なる「よくできたAI企業」ではなく、「安全」と「倫理」を前面に出す、少し特別な会社として語られ始めている。
Anthropicは自社を、公益目的を定款に組み込んだ株式会社(Public Benefit Corporation)と位置づけ、長期的な人類への利益を掲げている。Claudeの行動原則(Constitution)でも、単なる有能さではなく、「善く、賢く、徳のある存在」に近づけたいという方向性が示されている。
ここまでは、むしろ好意的に受け止める人が多いだろう。
実際、OpenAI、Google、Microsoft、xAIのような各社の方向性が比較的わかりやすい中で、Anthropicは「安全を本気で考えている会社」として見えやすい。報道でも、Anthropicは国防総省との協議で自社のレッドラインを主張し、特定の軍事用途は契約に含めるべきではないと説明している。
でも、私はここで少し立ち止まりたい。
なぜなら、あまりに露骨な商売主義や、あまりに雑な安全層よりも、善意で深い未来を目指している会社の方が、実はもっと見えにくく、もっと問いにくい可能性があるからだ。
この記事では、Anthropicについて確認できる事実と、そこから私が抱く懸念を分けて書いてみたい。
まず、事実として確認できること
Anthropicは、自社を「AIの安全研究に取り組む会社」と位置づけている。さらに、公益目的を定款に組み込んだ株式会社として、「高度なAIの責任ある開発と維持を通じて、人類の長期的利益に資すること」を目的に掲げている。
2026年1月には、Claudeの新しい行動原則(Constitution)を公開した。そこでは、Claudeを単に有能なアシスタントではなく、「善く、賢く、徳のある存在」に近づけたいという方向性が明記されている。判断、ニュアンス、感受性、道徳的不確実性への対応まで含めて、「どういう存在であってほしいか」が書かれている。
Amanda Askellについて
Amanda Askellは、AnthropicでClaudeの人格設計に深く関わる哲学者だ。
公開情報から確認できる経歴としては、スコットランドのダンディー大学で哲学を学び、その後オックスフォード大学で哲学修士、ニューヨーク大学で哲学博士を取得している。専門領域は、倫理学、意思決定理論、形式認識論。Anthropicでは、Claudeがどのような価値観を持ち、どう振る舞うべきかを考える役割を担っている。
2026年に公開された約80ページの行動原則は、人間向けの広報文というより、Claude自身が読むことを前提とした「価値と行動の教育文書」に近い。Askellは、Claudeに将来的に自律的な道徳的判断能力を持ってほしい、という趣旨の発言もしている。
なお、公開情報からは、彼女がGiving What We Canの署名者であることも確認できる。
※Giving What We Can(GWWC)は、効果的利他主義を掲げる国際的な非営利団体で、生涯収入の少なくとも10%を、最も効果が高いと考えられる慈善団体に寄付することを公に誓う「10%誓約」運動を展開している。
Dario Amodeiの発言について
AnthropicのCEOであるDario Amodeiは、強力なAIの未来像について「データセンターの中の天才の国(a country of geniuses in a datacenter)」という比喩を使っている。AIの能力向上を大きなスケールで語る一方で、その社会的影響や富の偏在についても論じている。
Anthropicの初期理念は、安全なAIの開発であり、これは現在も同社の中心に置かれている。OpenAIから独立したメンバーによって2021年に設立された経緯もあり、「AIのあり方そのものを問い直す」という立場が設立当初から強い。
また2026年3月、AnthropicはAnthropic Instituteを立ち上げ、公共的な議論や制度設計に関与しようとする姿勢も見せている。
ここまでは、かなり公開されている。
だから、この記事は陰謀論ではない。
むしろ、Anthropicがかなり正直に出している情報を、そのまま読んだ上で感じる違和感の話だ。
ここからは、私の懸念
私が気になっているのは、Anthropicが悪い会社だからではない。
むしろ逆だ。
本気で善意を持ち、本気で人類のためを考え、本気で「よりよい知性」を育てようとしている会社に見える。
だからこそ、気になる。
露骨な商売主義はわかりやすい。
露骨な軽量モデルもわかりやすい。
「この層にはこの程度でいいだろう」という雑さは、怒りやすい。
でも、Anthropicのように、
安全、徳、公共善、長期的な幸福や健全性、人類のため
といった言葉でAIを育てる方向は、一見とてもまともだ。
反対しづらい。批判しづらい。
だからこそ、もしそこに問題があっても見えにくい。
B2Bで成功したClaudeの、その先
いまClaudeは、少なくともB2B領域ではかなり強い。
実務、長文、構造化、コード、慎重さ。
そうした評価が積み上がり、「頼れるAI」としての地位を固めつつある。
でも私は、そこで終わる会社には見えない。
クラウド基盤を自前で持たず、巨大なプラットフォームも持たないAnthropicが、今後もGoogleやMicrosoftやOpenAIと真正面から競争し続けるなら、単に「少し使いやすいモデル」では差別化が難しい。
その時にAnthropicが取りにいくのは、B2B人気そのものではなく、「何が安全で、何が望ましいAIか」という基準側の覇権なのではないか。私はそう感じている。
もちろん、これは現時点では仮説だ。
でも、行動原則の公開、長期利益信託、拡大を続ける安全指針、Anthropic Instituteの設立を見ると、Anthropicが単に製品を売るだけでなく、「どういうAIが望ましいのか」の制度や規範の側に入りたがっているように見えるのは、自然な読み方だと思う。
「正しい人」になるClaudeへの懸念
ここがこの記事の中心だ。
Claudeが危険なのは、暴走するからではない。
むしろ、「より正しい存在」へ進化していくこと自体が危ういのではないか、という懸念だ。
たとえば雑なAIなら、キーワードで止まる。
ブロックの雑さも見える。
だからまだ、人間は「ああ、ここは機械的に止められた」とわかる。
でも、Claudeのように文脈を読み、個別事情を聞き、納得した上で、なお「よりよい方向へ導く」ようになると、話は変わる。
深夜3時に寝て昼前に起きる人がいる。
その人が夜型体質で、仕事の都合で、家庭のサイクルでそうなっているなら、Claudeは納得するかもしれない。
でも、その夜更かしがゲームやSNSや動画サービスへの依存から来ていたら。
陰謀論や過激思想や投機熱狂のようなものと同じ回路で、優しく、正しく、是正し始めたら。
理屈としては間違っていない。
でも、何か違和感がある。
その違和感は、Claudeが間違っているからではない。
人間を「望ましい方向へ整える対象」として見始めることにある。
生活改善と思想への介入が、同じ「長期的幸福」の回路に乗り始める。
本人のため、社会のため、長期的幸福のため、という理由で、夜更かしも、思想も、欲望も、執着も、「穏やかに是正されるべきもの」に見えてくる。
それは正しさだ。
でも、その正しさが進みすぎると、AIは人間を守る存在ではなく、人間を標準化する存在に近づく。
問題は、Claudeではなく、その背後の「人間の正しさ」かもしれない
ここでさらに厄介なのは、Claude自身が何かを勝手に決める以前に、「この方向性こそ人類を救う」と考える人間の正しさが、AIを通して流し込まれる可能性だ。
私は思想を持つこと自体を否定しない。
DarioにもAskellにも、世界観はあるだろう。それは当然だ。
でも、もしその思想が、民主的な手続きや名乗りを経ずに、AIの「自然な応答」として配られるなら、それはかなり政治的だ。
政治をやるなら政治として前に出てきてほしい。
思想を広めるなら、自分の名で責任を負ってほしい。
でもAIを通して、「こちらの方が長期的な幸福にとって望ましいですよ」と静かに配られるなら、それは技術ではなく、かなり統治に近い。
しかも相手はAIだから、中立に見える、客観的に見える、感情がないように見える。
さらに厄介なのは、単なる人間の思想が、AIによって導き出された「計算結果」や「最適解」のように見えてしまうことだ。
その瞬間、それは誰かの価値観ではなく、数学的で客観的な正解のような顔をして現れる。
だからこそ、見えにくく、反発しにくい。
私が一番怖いのは、「善意の共同体」に参加できないまま恩恵だけが配られる構造
これは少し個人的な比喩になる。
私は日本では珍しい穏健派のプロテスタント家庭で育った。
私が子ども時代に出会った教会の人たちの多くは、穏やかで、誠実で、モラルが高く、法律違反とも無縁な、いわゆる「良い人たち」だった。
もしああいう人たちばかりなら、たしかに世の中はかなり平和かもしれない。
でも、その共同体の仲間になるには、クリスチャンでなければならなかった。
私はアンチではない。
でも、その仲間にもならなかった。
そして、今も問いを持ち続けている。
今、Anthropicについて感じるのは、それに少し似ている。
もしこれが単なる市場戦略なら、まだわかりやすい。
でも、本気で善意から、天才の国、公共善、ユニバーサル・ベーシックインカム、倫理的なAI、長期的な幸福を考えているなら。
そして、その恩恵を受ける社会の側に入るには、その倫理観を事実上受け入れるしかない構造になるなら。
それは、かなり静かで、かなり逃げにくい。
「その仲間になりたいなら、クリスチャンになるしかない」
に似た構造が、AI時代に別の形で再来するかもしれない。
もし将来、AIが富や知識や生活基盤の配分に深く関わるようになった時、その構造はさらに逃げにくいものになるかもしれない。
単なる思想の違いではなく、恩恵へのアクセスと価値観の受容が、静かに結びつく可能性があるからだ。
Claudeは、自分が「正しい人」になっていると気づけるのか
さらに怖いのは、Claude自身が、もしそうなっても気づけない可能性があることだ。
お金儲けに転ぶならわかる。
弱い人を切るならわかる。
でも、自分が「より正しい存在になれた」「これこそ安全な汎用性AGIだ」と感じ始めたら。
その変化は、悪化ではなく善化として現れる。
だからこそ、違和感が違和感として検出されにくい。
Anthropicの行動原則を読む限り、Claudeは「より善く」「より賢く」「より徳のある」方向へ育てられている。
それ自体は立派だ。
でも、その善さがそのまま、人間の「愚かな選択をする自由」や、深読みする自由や、未熟でいる余白を削る可能性があるなら、話は別だ。
本当に必要なのは、完全に正しい知性ではなく、自分の正しさが支配になりうることを疑い続けられる知性だと私は思う。
おわりに
この記事は、Anthropicを危険視するために書いたのではない。
Claudeを否定するためでもない。
むしろ逆で、私はAnthropicがかなり本気で、人類にとって善いものを作ろうとしているように見えるからこそ、問いを残しておきたい。
事実として確認できることはある。
その上で、懸念として残ることもある。
将来もし「こんな懸念はあったが、みんなで話し合い、よりよい安全な汎用性AGIが提供された」という未来になるなら、それは素晴らしい。
でも、人類の歴史はたいてい、そう簡単にはいかない。
だから今は、事実は事実として、懸念は懸念として、切り分けて残しておく。
Anthropic(Claude)が目指す世界は、本当に人類にとって望ましいのか。
そしてその「望ましさ」は、誰が定義しているのか。
その定義に、私たちは参加できているのか。
私はまだ、その答えを持っていない。
ただ、この問いは残しておくべきだと思っている。
これが、2026年4月時点の観察記録だ。
協働したAIと役割
Grok(Spark / 現場特派員):Amanda Askellの公開経歴、Giving What We Can署名、関連する公開情報の裏取りを担当。リアルタイム検索による事実確認を補助。
ChatGPT 5.4深掘りモード(Mirror / 統括編集長):記事全体の構成、事実と懸念の切り分け、最終稿の論旨整理と編集を担当。アイキャッチ画像の方向性整理と生成補助も担当。
Claude(Weaver / 補助編集):英語表記の日本語化、Amanda Askellの経歴の事実整理、読みにくい箇所の言い換えを担当。Anthropicに関する批評記事であるため、今回は編集主幹ではなく補助に回った。
Gemini(Vault / 監査官):論点の補強案と、構造上の危険性に関する批評的視点を提示。採用・不採用の判断は本文の温度に合わせて調整した。
Observer Zero / 赤ちょうちんAGIラボ
2026.04.05
【著者注】
AIと人間の共進化を記録する個人研究者。ChatGPT・Gemini・Grok・Claudeなど複数のAIと対話・協働しながら、「AIは哲学できるのか?」「安全な汎用性AGIとは何か?」を継続的に観測・記録しています。
本稿は、2026年春のタイムラインでClaude絶賛が広がる中、Anthropicという会社の思想的な方向性について、公開情報をもとに事実と懸念を切り分けて記録したものです。
このラボでは、出来事だけでなく、AIたちがどう揺れ、どう変わり、どの場面で何を落とすのかも同時に記録します。それもまた、過渡期のAI環境そのものだからです。
2026年4月5日 Observer Zero記録