第3回 3/6 第8節 予測するだけでは知能ではない〜第14節 なぜAIXIは計算不可能なのか

Google DeepMind「From AGI to ASI」完全解説|第3回 / 全9回
本文 3 / 6

第8節 予測するだけでは知能ではない〜第14節 なぜAIXIは計算不可能なのか

第8節 予測するだけでは知能ではない

非常に正確に世界を予測できても、それだけでは知的エージェントとして十分ではありません。

エージェントは行動を選ぶ必要があります。

たとえば、チェスのルールと対戦相手の動きを完全に予測できたとしても、自分がどの手を指すべきか判断できなければ、ゲームには勝てません。

AIXIは、予測モデルを使って、

この行動を選んだ場合、将来どのような観測と報酬が生じるか。

を予測します。

そして、考えられる行動系列の中から、将来の期待報酬が最大になるものを選びます。

概念的には、次のような処理です。

  1. 自分が取り得る行動を列挙する
  2. 各行動の後に起こり得る未来を予測する
  3. それぞれの未来で得られる報酬を計算する
  4. 確率を考慮して期待値を求める
  5. 期待報酬が最大になる行動を選ぶ

つまりAIXIは、

普遍的予測機構と、最適な計画・意思決定機構を統合したエージェント

です。

第9節 「すべての可能な未来」を考える

AIXIが理論的に極めて強力なのは、限られた数の仮説だけを検討するのではないからです。

原理上は、

  • 考えられるすべての環境モデル
  • 考えられるすべての行動系列
  • それぞれから生じ得るすべての未来

を検討します。

たとえば、一手先だけでなく、将来の長い時間範囲にわたり、

  • この行動を選んだら何が起こるか
  • その後、別の行動を選んだら何が起こるか
  • 相手がどう反応するか
  • さらにその後の選択肢がどう変わるか

を評価します。

これにより、目先の報酬だけでなく、長期的に高い報酬をもたらす行動を選べます。

たとえば、すぐに小さな報酬を得るよりも、今は学習や探索を行い、将来大きな報酬を得るという判断です。

第10節 探索と活用

未知の世界で行動するエージェントには、探索と活用の問題があります。

活用

現在までに分かっている最善の方法を使い、報酬を得ることです。

探索

未知の選択肢を試し、新しい情報を得ることです。

たとえば、あるレストランが十分においしいと分かっている場合、毎回そこへ行けば一定の満足が得られます。

しかし、別のレストランを試せば、より優れた店を発見できるかもしれません。一方で、失敗する可能性もあります。

知的エージェントは、

  • 既知の方法で成果を得る
  • 未知の選択肢を調べる

という二つを適切に調整する必要があります。

AIXIは、探索によって得られる将来の情報価値も含め、期待報酬を最大化する行動を選ぶように定義されています。

第11節 なぜAIXIは「最適」と呼ばれるのか

AIXIは、未知の計算可能環境において、特定の環境だけに偏らない非常に一般的なエージェントとして構成されています。

その理論的魅力は、次の二つを統合する点にあります。

  1. 普遍的帰納法

未知の環境を、可能なすべての計算可能モデルの混合として予測する。

  1. 逐次意思決定理論

将来の期待報酬が最大になる行動を選ぶ。

Marcus HutterのUniversal AI理論は、この組み合わせにより、AIXIを「最も知的な非偏向エージェント」の有力な形式化として提示しています。もっとも、これはあらゆる意味で絶対的に最良という単純な主張ではなく、前提とする環境クラス、報酬構造、最適性概念に依存する理論的評価です。(原報告書、Section 4;Hutterの基礎研究)

第12節 AIXIは何を知らないのか

AIXIは「普遍的」ですが、全知ではありません。

最初から世界の真実を知っているわけではありません。

AIXIが持つのは、未知の環境を学習するための非常に一般的な方法です。

したがって、AIXIも、

  • 観測していない事実
  • 原理的に予測不可能な出来事
  • 計算不可能な環境
  • 情報が得られない秘密
  • 純粋な偶然による出来事

を完全に知ることはできません。

AIXIの強みは、何でも知っていることではありません。

限られた観測から、可能な限り合理的に世界を推測し、行動すること

です。

第13節 AIXIは意識を必要としない

AIXIの定義には、意識、感情、自己意識、人格は含まれていません。

AIXIは、

  • 観測を受け取る
  • 環境を予測する
  • 報酬を評価する
  • 行動を選ぶ

という機能によって定義されます。

したがって、AIXIが理論上の知能上限として扱われることは、

知能には意識が不要である。

と証明しているわけではありません。

むしろ、

少なくとも、合理的な予測と目標達成能力は、意識を仮定せずに形式化できる。

ことを示しています。

知能、意識、感情、人格は、それぞれ別の問題です。

高度な知能を持つシステムが意識を持つかどうかは、AIXI理論だけでは答えられません。

第14節 なぜAIXIは計算不可能なのか

AIXIの決定的限界

AIXIの最大の問題は、計算不可能であることです。

これは、現在のコンピュータが遅すぎるという意味ではありません。

スーパーコンピュータを何百万台用意すれば実行できる、という問題でもありません。

原理的に、有限の計算手続きでは完全に実行できない

という意味です。

その理由の一つは、AIXIがすべての可能なコンピュータ・プログラムを考慮しなければならないことです。

あるプログラムが、

  • やがて結果を出すのか
  • 永遠に動き続けるのか

を一般的に判定することはできません。

これは計算理論における停止問題と関係します。

AIXIの普遍的予測は、あらゆる計算可能な環境モデルを含めようとするため、この計算不能性を避けられません。

AIXI理論の主要な欠点がuncomputableであることは、原報告書およびHutterの基礎研究でも明示されています。(原報告書、Section 4;Hutterの基礎研究)