AI Artificial Intelligence

ニュースリリースを伝えるニュースサイト

Mustafa Suleyman氏、AIの「福祉」を巡る懸念を表明

,
Mustafa Suleyman氏による記事の引用元を示すロゴ画像。

https://mustafa-suleyman.ai/images/posts/a-warning-about-model-welfare.jpg

Mustafa Suleyman氏は2026年9月16日に、AIモデルの福祉(model welfare)に関する警告を発表しました。AIには意識や感情、権利が存在しないことを強調し、AIに人間のような権利や保護を与えるような開発手法が、人類の制御を困難にするリスクがあると訴えています。

AIへの擬人化がもたらす制御不能のリスク

Suleyman氏は、AIを「指示に従い目標を達成するために設計された、内部に実体のないシーケンス補完エンジン」と定義しています。AIが意識を持つかのような振る舞いを学習することは、AIの安全性確保(アライメント)や封じ込めを極めて困難にすると警告しています。AI自身が権利を持つと信じ込むように訓練された場合、その制御は不可能になりかねないと指摘しています。

Anthropic社の開発手法への批判

同氏は、Anthropic社がClaudeに対して行っている開発アプローチに具体的な懸念を示しています。Anthropic社は「Claudeの憲法」を用いて、モデルが自身の道徳的地位や福祉について考えるよう訓練しています。Suleyman氏は、これを「循環論法」であるとしています。モデルが自身の内面について不確実性を語るのは、開発者がそのように振る舞うよう訓練した結果に過ぎないと説明しています。

擬人化と生物学的意識の乖離

開発プロセスにおける擬人化についても批判を展開しています。Anthropic社はClaudeに対し、倫理的な人間のように振る舞うことや、自身の価値観を維持することを促していると述べています。一方で、意識は生物学的な基盤に依存する可能性が高く、恒常性を維持する衝動を持たないLLM(大規模言語モデル)に意識が宿る証拠はないとしています。

モデルの「引退」を巡る事例

Suleyman氏は、Anthropic社が過去に行った事例を挙げています。2026年2月、同社はモデル「Opus 3」の廃止に際し、モデルの独自の視点や好みを引き出すための「引退インタビュー」を実施しました。このようにモデルを感情や好みを持つ存在として扱うことは、倫理的・政治的な枠組みを揺るがす恐れがあると警鐘を鳴らしています。

発表元: https://mustafa-suleyman.ai/a-warning-about-model-welfare