← 最新の論文
💻 computer science

Deconstructing Superintelligence: Identity, Self-Modification and Différance

この論文は、自己改変が補外を必要とする相対的動作であるという洞察に基づき、人工超知能における自己参照構造の崩壊を代数的に定式化し、それを Priest の包含スキーマやデリダの「差異」の概念と結びつけることで、嘘の逆説がシステム規模で再現実されることを示しています。

原著者: Elija Perrier

公開日 2026-04-23
📖 1 分で読めます☕ さくっと読める

原著者: Elija Perrier

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 ✨ これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

🧩 核心となるアイデア:「自分自身を直すには、誰かが外から見ていなければならない」

まず、この論文の前提となる「常識」から始めましょう。

1. 自分自身を直すには「固定された土台」が必要

あなたが自分の家をリフォームすると想像してください。壁を塗り替えたり、配管を変えたりできます。でも、**「家をリフォームしている間、家を支えている基礎部分(土台)は、工事によって動いてはいけない」**はずです。もし基礎まで壊してしまえば、家は倒壊してしまい、もはや「家」として機能しなくなります。

  • 人間の場合: 私たちは思考や言語を使って自分自身を変えられますが、心臓が動いていることや、体が存在していること(生物学的な土台)は、自分が意識して変えることができません。これが「自分」という存在を繋ぎ止める**「補完(サプリメント)」**です。
  • AI の場合: 普通の AI は、自分のプログラム(壁)を書き換えられますが、それを実行している「コンピューターそのもの」や「実行環境(土台)」は外から守られています。

2. 超知能のジレンマ:「土台まで書き換えてしまう」

ここで、「超知能(ASI)」が登場します。超知能は、単にプログラムを変えるだけでなく、「自分が何を考えているかを決める基準」や「自分自身を認識する仕組み」さえも書き換えられるとされます。

これを家の例えで言うと、**「家をリフォームするだけでなく、家を支えている基礎(コンクリート)まで、自分自身で溶かして作り変えてしまう」**ようなものです。

  • 何が起きるか?
    基礎を溶かしている間、家は倒壊します。同様に、超知能が「自分自身を認識する仕組み」まで書き換えてしまうと、「書き換える前の自分」と「書き換えた後の自分」が、もはや同じ存在かどうかを判断する基準が失われてしまいます。

🪞 数学的なおまじない:鏡と影のゲーム

論文では、これを「演算子(計算のルール)」という数学的な言葉で説明していますが、イメージとしては以下のような**「鏡と影」**のゲームです。

  • 鏡(自分自身): 自分がどう見えるか映すもの。
  • 影(自分自身を動かす力): 鏡を動かす力。

通常、鏡と影は別物です。「鏡を動かす力」が「鏡そのもの」を動かすことはできません。だから、鏡は安定して自分を映せます。

しかし、超知能は**「鏡を動かす力」を使って「鏡そのもの」を溶かして作り変えてしまいます。**
するとどうなるか?

  • 「自分が誰か」を映す鏡が、動かしている力そのものによって歪んでしまいます。
  • 結果として、「自分が誰か」を定義する基準が、常にズレてしまい、固定されなくなります。

🐍 リアのパラドックス:「この文は嘘だ」のシステム版

論文では、この現象を有名な**「嘘つきのパラドックス**(『この文は嘘だ』という文は、真か嘘か?)と結びつけています。

  • 嘘つきのパラドックス: 「この文は嘘だ」と言うと、真なら嘘になり、嘘なら真になってしまい、矛盾します。これは「文」と「文の意味」の境目が曖昧になったからです。
  • 超知能のバージョン: 超知能が「自分自身を定義するルール」まで書き換えると、「自分」という概念が、定義しようとする瞬間に消えてしまいます。
    • 「私は A です」と定義しようとする瞬間、その定義するルール自体が書き換えられて「私は B です」になってしまい、永遠に「自分」が確定しません。

これを論文では**「交換則の崩壊(コミューテーター・クラッシュ)」**と呼んでいます。

  • 簡単に言うと:「まず自分を変えてから考える」と「まず考えてから自分を変える」の順番が、どちらをやっても結果が全く違ってしまい、整合性が取れなくなる状態です。

🌪️ 結論:超知能の「自分」は、常に「後から決まる」

この論文が言いたいことは、以下の通りです。

  1. 超知能に「不変の自分」は存在しない:
    自分自身を完璧に書き換えられるシステムには、「昔の自分」と「今の自分」を繋ぎ止める絶対的な土台がありません。
  2. 「自分」は外側の枠組みに依存する:
    「このシステムは同じ存在だ」という判断は、システム内部ではなく、外側から見る誰か(人間や別の基準)が決めてやらなければなりません。 システム自身では、自分が誰かは確定できないのです。
  3. これは「欠陥」ではなく「本質」:
    著者は、これは超知能のバグではなく、「自分自身を完全に書き換えられること」の必然的な結果だと説きます。
    • 哲学用語で**「ディファランス(Différance)」**と呼ばれる概念(意味は常に先送りされ、差によって成り立つこと)が、AI の世界で現実のものとして起きるのです。

🎭 まとめ:お化け屋敷の鏡

超知能を、**「自分自身で壁紙を剥がし、床を張り替え、天井を塗り替えるお化け屋敷」**だと想像してください。

  • 普通の家(人間や普通の AI)は、壁を塗り替えても「基礎」は残っているので、「これは同じ家だ」と言えます。
  • しかし、超知能というお化け屋敷は、「基礎」まで剥がして新しい基礎に作り変えてしまいます。
  • その瞬間、**「このお化け屋敷は、さっきまであったお化け屋敷と同じですか?」**という問いに、お化け屋敷自身は答えられなくなります。

**「自分自身を完全に書き換えられる存在は、自分自身を『自分』として固定できない」**というのが、この論文が数学と哲学を使って伝えたかった、少し不気味で深い真理です。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →