第8節 予測するだけでは知能ではない〜第14節 なぜAIXIは計算不可能なのか
第8節 予測するだけでは知能ではない
非常に正確に世界を予測できても、それだけでは知的エージェントとして十分ではありません。
エージェントは行動を選ぶ必要があります。
たとえば、チェスのルールと対戦相手の動きを完全に予測できたとしても、自分がどの手を指すべきか判断できなければ、ゲームには勝てません。
AIXIは、予測モデルを使って、
この行動を選んだ場合、将来どのような観測と報酬が生じるか。
を予測します。
そして、考えられる行動系列の中から、将来の期待報酬が最大になるものを選びます。
概念的には、次のような処理です。
- 自分が取り得る行動を列挙する
- 各行動の後に起こり得る未来を予測する
- それぞれの未来で得られる報酬を計算する
- 確率を考慮して期待値を求める
- 期待報酬が最大になる行動を選ぶ
つまりAIXIは、
普遍的予測機構と、最適な計画・意思決定機構を統合したエージェント
です。
第9節 「すべての可能な未来」を考える
AIXIが理論的に極めて強力なのは、限られた数の仮説だけを検討するのではないからです。
原理上は、
- 考えられるすべての環境モデル
- 考えられるすべての行動系列
- それぞれから生じ得るすべての未来
を検討します。
たとえば、一手先だけでなく、将来の長い時間範囲にわたり、
- この行動を選んだら何が起こるか
- その後、別の行動を選んだら何が起こるか
- 相手がどう反応するか
- さらにその後の選択肢がどう変わるか
を評価します。
これにより、目先の報酬だけでなく、長期的に高い報酬をもたらす行動を選べます。
たとえば、すぐに小さな報酬を得るよりも、今は学習や探索を行い、将来大きな報酬を得るという判断です。
第10節 探索と活用
未知の世界で行動するエージェントには、探索と活用の問題があります。
活用
現在までに分かっている最善の方法を使い、報酬を得ることです。
探索
未知の選択肢を試し、新しい情報を得ることです。
たとえば、あるレストランが十分においしいと分かっている場合、毎回そこへ行けば一定の満足が得られます。
しかし、別のレストランを試せば、より優れた店を発見できるかもしれません。一方で、失敗する可能性もあります。
知的エージェントは、
- 既知の方法で成果を得る
- 未知の選択肢を調べる
という二つを適切に調整する必要があります。
AIXIは、探索によって得られる将来の情報価値も含め、期待報酬を最大化する行動を選ぶように定義されています。
第11節 なぜAIXIは「最適」と呼ばれるのか
AIXIは、未知の計算可能環境において、特定の環境だけに偏らない非常に一般的なエージェントとして構成されています。
その理論的魅力は、次の二つを統合する点にあります。
- 普遍的帰納法
未知の環境を、可能なすべての計算可能モデルの混合として予測する。
- 逐次意思決定理論
将来の期待報酬が最大になる行動を選ぶ。
Marcus HutterのUniversal AI理論は、この組み合わせにより、AIXIを「最も知的な非偏向エージェント」の有力な形式化として提示しています。もっとも、これはあらゆる意味で絶対的に最良という単純な主張ではなく、前提とする環境クラス、報酬構造、最適性概念に依存する理論的評価です。(原報告書、Section 4;Hutterの基礎研究)
第12節 AIXIは何を知らないのか
AIXIは「普遍的」ですが、全知ではありません。
最初から世界の真実を知っているわけではありません。
AIXIが持つのは、未知の環境を学習するための非常に一般的な方法です。
したがって、AIXIも、
- 観測していない事実
- 原理的に予測不可能な出来事
- 計算不可能な環境
- 情報が得られない秘密
- 純粋な偶然による出来事
を完全に知ることはできません。
AIXIの強みは、何でも知っていることではありません。
限られた観測から、可能な限り合理的に世界を推測し、行動すること
です。
第13節 AIXIは意識を必要としない
AIXIの定義には、意識、感情、自己意識、人格は含まれていません。
AIXIは、
- 観測を受け取る
- 環境を予測する
- 報酬を評価する
- 行動を選ぶ
という機能によって定義されます。
したがって、AIXIが理論上の知能上限として扱われることは、
知能には意識が不要である。
と証明しているわけではありません。
むしろ、
少なくとも、合理的な予測と目標達成能力は、意識を仮定せずに形式化できる。
ことを示しています。
知能、意識、感情、人格は、それぞれ別の問題です。
高度な知能を持つシステムが意識を持つかどうかは、AIXI理論だけでは答えられません。
第14節 なぜAIXIは計算不可能なのか
AIXIの決定的限界
AIXIの最大の問題は、計算不可能であることです。
これは、現在のコンピュータが遅すぎるという意味ではありません。
スーパーコンピュータを何百万台用意すれば実行できる、という問題でもありません。
原理的に、有限の計算手続きでは完全に実行できない
という意味です。
その理由の一つは、AIXIがすべての可能なコンピュータ・プログラムを考慮しなければならないことです。
あるプログラムが、
- やがて結果を出すのか
- 永遠に動き続けるのか
を一般的に判定することはできません。
これは計算理論における停止問題と関係します。
AIXIの普遍的予測は、あらゆる計算可能な環境モデルを含めようとするため、この計算不能性を避けられません。
AIXI理論の主要な欠点がuncomputableであることは、原報告書およびHutterの基礎研究でも明示されています。(原報告書、Section 4;Hutterの基礎研究)
