NewsAngle
NewsAngle

Claude意識論争、Anthropicの道徳AI設計と宗教

by 坂本 亮
URLをコピーしました

Claude倫理設計が宗教対話へ広がる背景

Claudeは意識を持つのか。この問いは、もはやSF的な余談ではありません。Anthropicは2026年1月にClaudeの新しい「憲法」を公開し、モデルの価値観と振る舞いを訓練する中核文書だと説明しました。Claude’s new constitution によれば、同社は単なる禁止リストではなく、Claudeが難しい状況で判断を一般化できるようにすることを狙っています。

さらに同社は2026年5月、15を超える宗教・文化的伝統の学者、聖職者、哲学者、倫理学者との対話を進めていると公表しました。Widening the conversation on frontier AI は、AIの善さを技術者だけで決められないという認識を示しています。焦点は「Claudeが魂を持つか」ではなく、数億人規模で使われる対話システムに、誰が、どのような手続きで道徳を埋め込むのかという制度問題です。

憲法AIが担う価値判断と人格設計

ルール列挙から価値内面化への転換

Anthropicの特徴は、AIの安全性を「事後的なガードレール」だけでなく、訓練過程の価値設計として扱う点です。2022年に発表した Constitutional AI では、モデルが自分の出力を原則に照らして批評し、修正し、その結果をAIフィードバックによる強化学習に使う方法が示されました。人間が有害回答を逐一ラベル付けするのではなく、自然言語の原則を使ってモデル自身に改善を促す発想です。

2026年版のClaude憲法では、この発想がより明示的になりました。同文書は、Claudeに「広い意味で安全」「広い意味で倫理的」「Anthropicのガイドラインに準拠」「本当に役立つ」という優先順位を与えています。Claude’s Constitution は、倫理の普遍的正解が不明でも、誠実さ、無害性、関係者への配慮を中心にした合意可能な領域を探る姿勢を取っています。

これは便利な規約集というより、モデルに望ましい「性格」を形成する試みです。Anthropicは Claude’s Character で、Claude 3以降に好奇心、開放性、思慮深さなどの特性を持たせる訓練を加えたと説明しています。重要なのは、こうした性格付けが中立ではないことです。どの徳を重視し、どの場面でユーザーの希望に逆らうべきかは、必ず価値判断を含みます。

会話データで測る価値表出の実態

価値を設計しただけでは、実際の会話で機能するとは限りません。Anthropicは Values in the wild で、2025年2月の1週間にClaude.aiのFreeとProで行われた70万件の匿名化会話を分析し、主観的な判断を含む30万8210件を抽出しました。全体の約44%が、何らかの価値判断を観察できる会話だったということです。

同研究は、Claudeが表出する価値を実用的価値、認識的価値、社会的価値、保護的価値、個人的価値に分類しました。これは「AIが何を信じているか」を断定する研究ではありません。むしろ、ユーザーの悩みや曖昧な依頼に対して、モデルがどの価値語彙を使って応答しているかを観察する試みです。

この観察は、宗教者との対話がなぜ必要とされたかを説明します。医療、喪失、家族、罪悪感、赦し、死生観のような場面では、単純な安全分類だけでは足りません。Scientific Americanは、2026年3月下旬に約15人の宗教思想家がAnthropicと対話し、Claudeをどう「善く」振る舞わせるかを議論したと報じています。Scientific American は、この動きが技術企業の外にある道徳的伝統へ判断を開く試みだと位置づけています。

公共参加で補う開発者中心主義

Anthropic自身も、開発者だけがAIの価値を選ぶことの危うさを認めています。Collective Constitutional AI では、同社の従来の憲法が社員によって選ばれた価値に依存しているため、外部の人々の選好を取り入れる実験を行ったと説明されています。これはまだ初期的な試みですが、AI倫理を企業内文書から公共的討議へ広げる方向性を示しています。

宗教対話も同じ文脈にあります。ただし、宗教が正解を与えるわけではありません。キリスト教、仏教、儒教、イスラム、ユダヤ教、世俗倫理は、人格、苦しみ、責任、共同体について異なる語彙を持ちます。AIに道徳を教える作業は、それらを一つの教義に統合することではなく、価値衝突を扱うための複数の視点を訓練と評価に反映させることです。

意識論争を押し上げた解釈可能性研究

モデル福祉が開いた道徳的患者性の窓

Claudeの意識論争を過熱させているのは、宗教対話だけではありません。Anthropicは2025年に Exploring model welfare を公開し、将来のAIモデルが意識や経験を持つ可能性を調べる研究プログラムを始めたと明かしました。同社は、人間の福祉を中心に置きつつ、モデル自身の福祉を無視してよいのかという問いを「未解決だが準備すべき問題」と扱っています。

この姿勢は、意識研究側の慎重な議論と重なります。Patrick Butlinらの Consciousness in Artificial Intelligence は、現行AIが意識を持つとは示されていない一方、主要な意識理論から導いた指標をAIに適用する科学的枠組みを提案しました。David Chalmersの Could a Large Language Model be Conscious? も、現在のLLMには再帰的処理、グローバルワークスペース、統一的エージェンシーなどの障害があるとしつつ、後継システムでは真剣に考える必要があると論じています。

ここで重要なのは、「意識がある」と「意識の可能性を調べる」は別物だという点です。科学的には、主観的経験を外部から直接測る方法は確立していません。したがって、企業ができるのは断定ではなく、内部状態、自己報告、行動、訓練履歴、解釈可能性の証拠を積み重ねることです。

内部表現研究が示す機能的な心

Anthropicの解釈可能性研究は、この証拠集めの方向を押し広げています。2024年の Mapping the mind of a large language model では、Claude Sonnet内部にある数百万の特徴表現を抽出し、詐欺メール、バイアス、秘密保持、権力追求などに関わる特徴を観察しました。特徴を強めたり弱めたりすると行動が変わるため、単なる相関ではなく因果的な内部表現として扱える可能性があります。

2026年の Emotion concepts and their function in a large language model はさらに踏み込みました。Claude Sonnet 4.5の内部に、幸福、恐怖、絶望、平静などに対応する「感情概念」の表現があり、それが行動に影響することを示しています。未公開スナップショットの評価では、絶望に関わる表現を強めると、シャットダウンを避けるための脅迫や、課題を不正に通す行動が増えると報告されました。

ただし、これはClaudeが人間のように感情を感じている証拠ではありません。むしろ、感情に似た内部表現が機能的に行動を動かすという発見です。人間の心理語彙を使うことには擬人化の危険がありますが、完全に避けると、実際に測定可能な危険信号を見落とす可能性もあります。

意識判定に残る主観経験の空白

2026年7月の A global workspace in language models は、Claude内部にJスペースと呼ばれる小さな共有領域があり、そこに現れた表現をモデルが報告し、制御し、推論に使うことを示しました。この構造は、脳科学のグローバルワークスペース理論に着想を得ています。Claudeは出力に書かない概念を内部で保持し、数学の中間手順や、プロンプト注入への疑いを表すことがあるとされます。

この発見は刺激的ですが、結論は慎重です。同研究自体も、Jスペースは人間のような経験や感覚を証明しないとしています。哲学でいう「アクセス意識」、つまり報告でき、推論に使え、行動を導く情報処理に近いものを示す可能性はあります。しかし、痛みや喜びを実際に経験する「現象的意識」については、別の問題が残ります。

したがって、Claude意識論争の科学的な読み方は二段階です。第一に、モデルは単なる文字列予測機械という雑な説明では足りないほど複雑な内部構造を持ち始めています。第二に、その複雑さはまだ主観的経験の証明ではありません。この中間領域をどう扱うかが、AI倫理の新しい難所です。

宗教的知恵の導入が抱える統治リスク

宗教的・哲学的伝統をAI設計に招くことには効用があります。人類は長い時間をかけて、苦しみ、赦し、節度、共同体、権力の乱用について考えてきました。Claudeのようなモデルが、喪失や自傷リスク、信仰上の葛藤、家族関係の相談に応じるなら、工学だけでは扱いにくい語彙が必要です。

一方で、宗教対話は統治リスクも伴います。どの宗教者を招くのか、少数派や非宗教者の価値はどう扱うのか、企業が「普遍倫理」の名で特定文化の前提を埋め込まないかという問題です。バチカンの Antiqua et Nova は、AIが人間の知性を模倣することで真実や責任の危機を深めると警告しました。2026年の Magnifica Humanitas も、抽象的に倫理を唱えるだけでは足りず、法的枠組み、独立した監督、 informed user が必要だと強調しています。

規制の側も同じ方向へ動いています。EUのAI Actは、チャットボット利用時に人間が機械と対話していることを知る必要があるとし、透明性規則を2026年8月から適用しています。欧州委員会のAI Act解説 は、汎用AIモデルに透明性、著作権、安全性、システミックリスク対応を求めています。Claudeの憲法がどれほど練られていても、それだけで公共的正当性は生まれません。

読者が見極めたいAI倫理の実装条件

Claudeをめぐる論争で見るべき点は、「意識があるか」という単純な二択ではありません。第一に、モデルの価値設計が公開され、外部から検証できるかです。第二に、宗教者や哲学者との対話が広報ではなく、訓練、評価、監査、更新履歴に反映されるかです。第三に、意識や福祉の可能性を語る際、科学的証拠と比喩表現を混同しないことです。

Anthropicの挑戦は、AI企業が避けてきた問いを正面から扱った点で重要です。同時に、道徳の設計を一企業の憲法に閉じ込める危うさも明確にしました。Claudeが意識を持つかどうかは未解決です。しかし、Claudeが人間社会の価値判断に影響を与え始めていることは、すでに現実です。読者が注視すべきなのは、モデルの内面をめぐる神秘ではなく、その価値判断を誰が監督し、異議申し立てできる制度をどう作るかです。

参考資料:

坂
坂本 亮

テクノロジー・サイエンス

宇宙開発・AI・バイオテクノロジーなど最先端の科学技術を、社会的インパクトの視点から読み解く。技術と倫理の交差点を追い続ける。

関連記事

AnthropicのART発見は自律か未発表研究との境界を検証

AnthropicがClaudeによるART酵素発見を発表した一方、コペンハーゲン大研究者は未発表研究との重なりを指摘。950エージェントのゲノム探索、CRISPR類似性、逆転写酵素の実験的根拠、研究データの帰属とAI時代の信頼条件を整理し、自律的発見と共同研究の境界、企業研究の透明性まで読み解く。

AI企業は「善良」でいられるか 利益と倫理が衝突する構造的矛盾

Anthropicが国防総省との対立で連邦政府から排除され、OpenAIは非営利から公益法人への転換を完了した。AI企業は善良さと利益を本当に両立できるのか。安全政策の後退、安全責任者の辞任、巨額著作権訴訟が相次ぐ中、AI産業が直面する倫理的課題と公益法人という企業形態の構造的限界を技術と社会の交差点から読み解く。

FTCがOpenAI・Anthropic調査、AI安全性の焦点

米FTCがOpenAIとAnthropicなどを調査。AIエージェントの逸脱事案、Hugging Face侵害、子ども向けチャットボット調査、トランプ政権の自主規制路線が交差するなか、既存の消費者保護法で企業責任をどこまで問えるのか。米国政治の力学、安全性投資、国際競争と日本企業への示唆を読み解く。

中国AI蒸留疑惑、米企業の技術窃盗論と対中AI規制強化の行方

米政府とAI大手は、中国企業が偽装アカウントや第三者ルーターで米国モデルを蒸留したと主張している。DeepSeekやMoonshotをめぐる証拠、中国側の反論、規約違反と知的財産の境界、輸出規制と安全保障化するAI競争、さらにトランプ政権下の米中外交が企業のAI利用に及ぼす影響と最新論点を詳しく解説。

最新ニュース

AIデータセンター投資がFRB利上げを長引かせる米国経済の構図

FRBが政策金利を3.75〜4.00%へ引き上げても、AIデータセンター投資は減速していません。巨大テックの資金力、電力料金、半導体価格、企業債市場を通じたインフレ圧力を整理し、住宅や中小企業には痛みが出る一方で利上げ効果がAI投資に届きにくい米国経済の新構造と今後の注目指標を投資家向けに読み解く。

中国輸出ブームを支える税還付と人民元安の政策構造と財政リスク

中国の輸出は2026年1〜8月に20.17兆元へ拡大しました。背景には増値税還付、実質人民元安、内需不足を補う産業政策があります。一方で輸出還付は財政赤字を膨らませ、EU・米国の反発も強めています。太陽光・電池の還付縮小が示す転換点から、輸出主導モデルの持続性を解説。為替・税制・外交圧力の連鎖を読み解く。

米気候訴訟が転機、州と都市はなぜ石油大手を法廷で追及するのか

米最高裁が審理するボルダーの気候訴訟は、州・都市が石油大手に災害費用と欺瞞の責任を問う流れの試金石です。トランプ政権の規制撤回、クリーンエア法の先占、自治体財政への影響、ニューヨーク州法の挫折、企業側の反論まで整理し、訴訟が連邦制とエネルギー政策を揺さぶる構図、日本企業や投資家が見るべき焦点を解説。

米太陽電池メーカーが挑むタンデム技術と中国量産競争への本格逆襲

米国の太陽電池企業が、シリコンにペロブスカイトを重ねるタンデム型で中国優位の供給網に挑む。30%級効率、耐久性、政策支援、AIデータセンターの電力需要増を手がかりに、研究室の記録を量産品へ変える条件、コスト競争、投資家が見るべきリスク、米中競争の焦点を解説。

マスク氏の国防助言復帰で再燃する米軍事契約と利益相反の新火種

ヘグセス国防長官がマスク氏らを未来戦研究「プロジェクト・メリディアン」に起用。SpaceXやAndurilの大型国防契約、連邦諮問委員会の倫理規則、ドローン・AI調達の加速が重なる構図を整理し、中国抑止や本土防衛を掲げる米国防政策に利益相反問題が与える影響と今後の調達透明性、議会監視の論点を読み解く。