The Ephemeral Web and the Case for Proactive Archiving
パキスタン大使館国際学校・カレッジ・テヘランの事例研究とデジタル脆弱性に関する著者の個人的経験に照らして、本論文は、ウェブの構造的な一時性を克服し組織の記憶を保存するために、能動的かつ自動化されたアーカイブがウェブサイトの維持管理における標準的な構成要素とならなければならないと主張する。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
以下は、概念を明確にするためのアナロジーを用いて、平易な日常言語で書かれたこの論文の説明です。
大きなアイデア:ウェブは石の記念碑ではなく、砂の城です
私たちの多くは、インターネットは永続的だと考えています。写真や記事をオンラインに投稿すれば、公園の像のようにそこに永遠に残ると想定しています。
この論文の著者は、これが危険な幻想であると主張しています。実際、ウェブは浜辺の砂の城に似ています。潮(時間)、風(リデザイン)、通りかかる人々(機関の移動や閉鎖)は、それが消えてしまうことに誰も気づくまで、それを洗い流したり完全に形を変えたりしてしまいます。
この論文の主要なメッセージはシンプルです:砂の城が洗い流されるのを待ってからその写真の保存を試みるべきではありません。城を築いている最中に写真を撮るべきなのです。
この論文の背景にある物語
著者のメリクサは、テヘランにあるパキスタン大使館国際学校に通っていました。彼が卒業した後、その学校はほぼすべてを変えました。
- 新しい建物へ移転しました。
- 新しい校長が就任しました。
- 新しいウェブサイトの住所(URL)になりました。
- ロゴや外観を変更しました。
古いウェブサイトが消えたとき、著者は学校がかつて是什么样だったという歴史が消滅していることに気づきました。まるで学校が記憶喪失になったかのようでした。彼は将来の生徒たちがこれらの変更以前に学校がどう見えていたかを見られるようにしたいと考え、ウェブサイトを自動的に保存するロボットを構築しました。
「ロボット」の仕組み
著者は無料のツールを用いて、小さな自動化プログラム(「デジタル司書」)を構築しました。その仕組みは以下の通りです。
- 偵察員: プログラムは学校のウェブサイトを訪問し、すべてのリンクを見つけ出しました(家のすべての部屋を見つける偵察員のように)。
- ランダム化: プログラムには時間制限(4 時間しか働けない労働者のように)があったため、見つけた最初の数ページだけを保存するのではなく、ページリストをシャッフルして、実行するたびにサイトの異なる部分を保存するようにしました。
- タイムカプセル: これらのページの複製を、古いウェブサイトを保存する巨大な公共図書館である「ウェイバック・マシン」に送信し、永久に保管させました。
意外な展開:司書さえも脆い
著者は問題を解決したと考えましたが、厳しい教訓を学びました:歴史を保存するために使用するツールもまた、脆いのです。
このロボットは GitHub という無料プラットフォーム上で動作していました。著者はしばらくの間、それを確認しませんでした。プラットフォーム側が活動を見ていなかったため、放棄されたものと判断して自動的にロボットをオフにしました。ロボットはバグによって壊れたのではなく、ルールによってオフにされたのです。
アナロジー: あなたが美術館を見張る警備員を雇ったと想像してください。しかし、警備会社には「警備員が 60 日間動かなければ、退職したとみなして施錠する」というルールがあります。美術館は安全ですが、警備員はいなくなります。これは著者に、保存システムも監視される必要があることを教えました。
なぜこれが誰にとっても重要なのか
この論文は、インターネットへの扱い方を変える必要がある理由として、以下の 3 つの大きな点を指摘しています。
- リデザインは消しゴムです: 会社や学校がウェブサイトを「現代的」に見せるために更新する際、古いバージョンを誤って削除することがよくあります。家の改装をして、元の間取りの設計図や写真を捨ててしまうようなものです。新しい家は素晴らしいですが、歴史は消えてしまいます。
- インターネットはオフにされ得ます: 著者はイランに住んでおり、政府が時折インターネットを完全に遮断することがあります。技術的にはウェブサイトがまだ「オンライン」であっても、運営者がインターネットの遮断によりツールにアクセスできない場合、そのサイトは幽霊のようになります。そこには存在しますが、更新も保存もできません。
- 「予防的」な保存が必要です: 現在、人々はウェブサイトが壊れたり消えたりした後にのみ保存しています。著者は、変更される前に保存すべきだと主張しています。
- 悪い方法: ウェブサイトがなくなるまで待ち、その後、(しばしば存在しない)バックアップを必死に探すこと。
- 良い方法: 学校がウェブサイトを更新する際、システムが更新プロセスの一部として「前」のバージョンを自動的に保存すること。それは文書で「保存」を押すのと同じくらい当然のことであるべきです。
結論
著者は、デジタルの歴史を保存することは、少数の専門家だけの特別な仕事であってはならないと結論づけています。それはウェブサイトを構築し維持する際の自然な一部であるべきです。
私たちがこれを行わなければ、将来の世代は自らの過去を理解する能力を失うことになります。彼らは単にファイルを失うだけでなく、自分たちが誰であり、コミュニティがいかに成長してきたかを見る能力を失うことになります。
要約すれば: インターネットは移ろいやすいものです。もし私たちが歴史を記憶したいのであれば、インクが乾いている間にそれを記す者になるべきであり、ページが白紙になるまで待つべきではありません。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。