← 最新の論文
📄 social_science

Data as Transcendental Stabilizations: Symbolic Mediation and the Pre-Semantic Conditions of Data

本論文は、データとは存在論的な原始的要素や単なる技術的人工物ではなく、微分的な構成を操作可能な差異へと変容させる歴史的に可変的な象徴的安定化を通じて立ち現れるものであり、それによって、アルゴリズムのバイアスといった問題を、単なる技術的管理上の問題としてではなく、相 competing する知性のレジーム(理解可能性の体制)をめぐる争いとして再定義するものであると論じている。

原著者: Rodrigo Garrido

公開日 2026-07-23
📖 1 分で読めます☕ さくっと読める

原著者: Rodrigo Garrido

原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

あなたは砂の入ったバケツを手にしていると想像してください。地質学者にとって、それはシリカと長石のサンプルです。子供にとって、それは城を作るための材料です。詩人にとって、それは指の間からこぼれ落ちる時間のメタファーです。しかし、それらの人々が「これは砂だ」と言う前に、まず目に見えないことが起きなければなりません。混沌として変化し続ける粒を、捉え、名付け、数えたり共有したり記憶したりできるものへと変えなければならないのです。これが、データの秘められた姿です。

科学やテクノロジーの世界では、私たちはデータを、床からただ拾い上げるだけの小さな現実のレンガのように扱うことがよくあります。温度計があれば、温度はそこに「存在」しており、ただ書き留まるのを待っているだけだと想定しています。しかし、ロドリゴ・ガリドによる新しい論文は、これが一種のトリックであることを示唆しています。それは、データとは「見つける」ものではなく、「作る」ものであると論じています。これを理解するために、3つの大きな概念を見る必要があります。第一に、記号的媒介(symbolic mediation)。これは、私たちは現実を直接触ることはできず、常に道具や言葉、あるいは数字を用いて世界を理解可能なものへと翻訳しなければならないという考えです。第二に、安定化(stabilization)。これは、混沌としたものを、有用なほどに一定の状態に保つよう変化させるプロセスです。そして第三に、投影(projection)。3Dの物体に懐中電灯を当てて2Dの影を見るように、私たちは現実のどの部分を強調し、どの部分を無視するかを選択しなければなりません。これが「データ(単一の事実)」を生み出します。なぜこれが重要なのでしょうか? もし私たちがデータを単なる「生の真実」だと考えてしまうと、測定する方法の選択が、私たちが何を見ることができ、何を理解でき、デジタル世界において何が「現実」であるとカウントされるかさえも決定しているという事実に気づけなくなるからです。

では、この論文は実際に何を言っているのでしょうか? それは、「データ(単一の事実)」とは、宇宙に最初から存在する小さな断片ではないと提案しています。代わりに、それは**超越的な安定化(transcendental stabilization)**なのです。それは、高度に専門的な言い方ですが、ある特定のルールと道具によって凍結され、パッケージ化され、反復可能にされた現実のスナップショットであることを意味します。

現実を、情報の巨大で連続的な、うねる川だと想像してみてください。それは常に流れ、変化し、無限の差異に満ちています。その川をそのまま汲み上げて瓶に入れることはできません。溢れ出してしまいます。「データ」を得るためには、ダムを築かなければなりません。どこで川を切り、何を測定し、どのようにラベルを貼るかを決めなければならないのです。論文は、このダムを築く行為こそがデータを作り出すのだと論じています。ダムが築かれる前、そこにはただの川(存在論的な変異)があるだけです。一度ダムが築かれ、水が特定のパイプへと導かれたとき、それが「データ」となるのです。

著者は、これがどのように機能するかを説明するために、いくつかの優れた比喩を用いています。あなたが歌を説明しようとしていると想像してください。空気中の音波は「川」です。もしその歌をコンピュータ上のファイル(データ)にしたいなら、音を小さな離散的な塊へと切り分けなければなりません。これはコンピュータの世界では**トークン化(tokenization)**と呼ばれます。連続した歌全体を機械に食べさせることはできません。機械が保持できる小さな断片(トークン)に分解する必要があります。しかし、ここが肝心な点です。その切り分け方が、歌を変えてしまうのです。もしビート(拍子)で刻めば、ある種類のデータが得られます。もしピッチ(音高)で刻めば、全く異なる種類のデータが得られます。論文は、「データ」とは歌そのものではなく、あなたがどのように切り分けることに決めたかという、その特定のやり方なのだと言っています。

また、論文はこれが一度限りのことではないとも主張しています。一度歌を切り分けたら、それらの断片がバラバラにならないように維持しなければなりません。ここで**技術的堆積(technical sedimentation)**が登場します。例えば、あなたが紙にレシピを書くとします。その紙は「技術的な支持体」です。それはレシピを保持し、明日も読めるようにしてくれます。しかし、その紙自体にもルールがあります。線があり、特定のサイズがあり、おそらくあなたが知っている言語で書かれています。過去からのそれらのルール(紙、言語)は、あなたのレシピの中に「堆積」されています。それらは、あなたが何を、どのように書けるかを決定します。論文は、私たちのデータはすべてこのようなものであると示唆しています。データは、私たちが気づかないうちに積み重なった古い道具、古いルール、古い思考様式の層の上に築かれているのです。1980年代に設計されたデータベースが、その設計方法ゆえに、今日私たちがどのようなデータを収集できるかを今なお決定している可能性があるのです。

著者は、データが「何ではないか」についても非常に明確に述べています。データは、発見されるのを待っている「生の」現実の断片ではありません。自然界の中に「データ(単一の事実)」を見つけることはできません。温度の変化は確かに存在しますが、それが「温度のデータ」となるのは、温度計がそれを測定し、コンピュータが記録し、科学者がそれをどう書き記すかに合意したときだけです。また、論文は、データが単なる中立的な真実の構成要素であるという考えにも異を唱えています。むしろ、私たちがデータをどのように安定させるか(使用するルール)が、私たちが見る真実を作り出しているのだと示唆しています。もし異なるルール(異なる記号形式)を使えば、異なる種類のデータが得られ、異なる種類の真実が得られるのです。

この論文は、すべてのデータ問題に対する魔法の公式を見つけたと主張しているわけではありません。代わりに、データの捉え方を変える必要があると示唆しています。データを単に「外にある」ものとして扱うべきではありません。データとは、私たちの選択、道具、そして歴史の産物であることを認識すべきなのです。私たちが「アルゴリズムのバイアス」や「データのプライバシー」について語るとき、論文は、単に数字を見るのではなく、私たちが築いた「ダム」を見るべきだと示唆しています。「誰が川を切る場所を決めたのか?」「歌を切り分けるためにどのようなルールを使ったのか?」「過去の古臭いルールが、今日私たちが何を見ることができるかを、いまだにどのように支配しているのか?」と問うべきなのです。

要約すれば、この論文は、データを現実の鏡として見るのをやめ、絵画として見始めるよう私たちに促しています。絵画は現実そのものではありません。それは、芸術家の筆、キャンバス、そしてそれ以前の芸術の歴史によって創り出された、特定の、安定化された、そして固定されたバージョンの現実です。そして絵画がそうであるように、それは、描こうとしている世界と同じくらい、アーティストとその道具について多くを物語っているのです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →