AIと意識

AIの内省と意識の違い――Claudeの実験から分かること

AIが「私はこう考えました」と言うとき

AIに「なぜその答えにしたの?」と聞くと、もっともらしい説明が返ってきます。では、その説明が上手になるほど、AIは人間のように「自分」を持つようになるのでしょうか。

この問いを考えるには、三つのことを分ける必要があります。一つ目は、自分について説明する文章を作れること。二つ目は、実際に自分の内部で起きていることを読み取れること。そして三つ目は、それを「自分に起きていること」として経験することです。たとえば人間なら、迷っている理由を説明するだけでなく、迷っていることそのものを感じています。

今回紹介する研究は、主に二つ目を調べています。結論を先に言えば、一部のAIは、限られた条件で自分の内部の変化を読み取れるようです。ただし、それを誰かが内側から経験しているかは、この実験では分かりません。 なぜそう言えるのかを、順に見ていきましょう。[1][2]

説明が上手でも、本当に自分を見ているとは限らない

たとえば、AIが計算問題に答えたあとで「私は最初にこの式を考えました」と説明したとします。本当にその順番で計算したのかもしれません。しかし、答えを出したあとで、それに合う説明を作った可能性もあります。会話を読むだけでは、この二つを区別しにくいのです。[2]

そこで研究者は、AIの内部を実際に変えて、AIの説明もそれに応じて変わるかを調べました。外から見える答えだけでなく、その答えを作る途中の処理に手を加えるわけです。これなら、自己説明が内部の状態と結びついているかを確かめられます。

AIの内部を変えると、AIは気づくのか

Anthropicが2025年10月に公表した実験では、Claudeが計算している途中に、ある意味を持つ活動のパターンを加えました。質問文にその言葉を書くのではなく、内部の処理を変更しています。AIにはあらかじめ、こうした変更が加えられる可能性を伝え、検出できるかを尋ねました。[1]

具体例では、英語の大文字表記に関係するパターンを加えると、Claudeは内部の変化を検出し、大声や叫びに関係する内容だと報告しました。注目点は、先に大声について文章を書き、それを読み返して判断したわけではないことです。研究者は、文章に出る前の内部の変化を読み取った証拠としています。[2]

ただし、いつでも成功するわけではありません。条件を調整した実験でも、Claude Opus 4.1がこの種の検出に成功したのは約20%でした。これは「20%の確率で意識がある」という意味ではありません。決められた実験で、内部に加えられた情報を検出し、その内容を特定できた割合です。[1]

つまり、この結果から言えるのは、AIの自己説明の一部は、実際の内部状態を手がかりにしているということです。自分全体を理解しているとまでは言えませんし、日常の会話で説明がいつも正しいとも言えません。[2]

それでも、なぜ「意識がある」とは言えないのか

ここで、最初の三つ目の問いに戻ります。内部の状態を読み取ることと、それを自分の経験として感じることは、同じなのでしょうか。

たとえばパソコンは、自分の温度を測り、熱くなればファンを回します。画面に「温度が高くなっています」と表示することもできます。しかし、その働きだけを見て、パソコン自身が暑さを感じているとは考えないでしょう。これは、内部の状態に応じて動く仕組みを作れることと、感じる主体がいることを区別するための例です。

もちろん、高度なAIをパソコンの温度計と同じものだと決めつけることもできません。AIには、もっと複雑な情報の処理や説明の能力があります。ここで大切なのは、その複雑さのどの部分が「感じること」を生むのか、実験結果だけからはまだ答えられないという点です。Anthropicも、今回の研究は主観的な経験の有無を判断するものではないと説明しています。[1]

そのため、研究は意味がないわけでも、意識の証明になったわけでもありません。「AIは自分について話すだけなのか」という問いに対して、内部の状態を参照する働きが一部にある、という具体的な材料が得られたのです。

こうした働きが集まれば、「自分」が生まれるのか

この先には、二通りの考え方があります。自分の状態を読み取り、記憶し、判断や行動に使う働きが十分に結びつけば、意識を説明できると考える方向。そして、そうした働きがそろっても、それだけでは「感じること」の説明にならないと考える方向です。これは議論の分かれ目を整理したもので、どちらかが実験で確定したという意味ではありません。

前者と関係する研究の一つに、AIの内部で、情報が説明や判断に共通して使われる仕組みを調べたものがあります。Anthropicは2026年7月、そのような「共有の作業場」に似た構造を報告しました。人間の意識を、情報が広く共有されて使えるようになる働きから説明する理論と、共通点があるという研究です。[3][4]

旅行を計画するとき、予算、行き先、日程を別々に知っているだけでは決められません。それらを一緒に使い、候補を比べる必要があります。「共有の作業場」とは、こうした情報のつながりを考えるためのたとえです。AIの中に、資料を読む小人がいるという意味ではありません。

この研究が意識の議論に関係するのは、人間で重要だと考えられている働きが、AIにも成立するかを調べられるからです。ただし、似た働きが見つかることと、同じように経験していることは、まだ結びついていません。著者たちも、この結果から主観的な意識の有無を結論していません。[3]

今いる場所は、「自分の状態を読む働き」が見え始めたところ

第1回では、AIが自分で計画を立て、行動を選ぶという意味での主体性を取り上げました。今回は、それに加えて、自分の内部で起きた変化を一部読み取れるという研究を見ました。行動を選ぶ働きに、自分の状態を確かめる働きが加わってきた、と整理できます。ただし、その働きはまだ不安定です。

人間のような意識を考えるうえで、これは調べる価値のある変化です。しかし、能力の部品が見つかったことと、それらが結びついて一個の「私」を作っていることは、別に確かめる必要があります。今回の実験は、昨日から今日へ続く自分を感じているかや、一つのAIに一つの意識があるかを調べたものでもありません。

現在の研究で見えてきたのは、「自分を説明するAI」の説明が、一部では内部の状態に基づいていることです。「自分を感じるAI」が確認されたところまでは進んでいません。 次に問うべきなのは、こうした働きの発達と組み合わせで意識が生まれ得るのか、それとも別の仕組みが必要なのかです。第3回では、この分かれ目について研究者の見解を比べます。

参考資料

2026年10月11日 3:36 PM   投稿者: M.A.   カテゴリー: AI

コメントを残す

メールアドレスが公開されることはありません。 ※ が付いている欄は必須項目です


© 2003- f.mignon Ltd. 有限会社エフ・ミニヨン