DYNAMICS-WEB: A Pre-Registered Measurement of Web Content Character over the Link Graph, and a Powered Proof that its Sub-Perceptual Half Changes Conversion
本論文は、ウェブのリンクグラフ内における、オーソリティやトピックとは大きく独立した、ある種独特な「キャラクター」信号が、ユーザーの好みに合致した場合に読者のコンバージョン率に潜在意識下で影響を与え得ることを示す、事前登録された測定手法であるDYNAMICS-WEBを紹介するものである。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
数十年にわたり、インターネットは主に2つのルールによって構成されてきました。第1のルールは権威性に関するものです。どれほど多くの重要なウェブサイトがそのページを指しているかによって、デジタル世界におけるそのページの地位が決まります。第2のルールはトピックに関するものです。そのページが何の主題であるかを示し、レシピを検索した際に料理に関するページが表示されるようにします。これら2つのシグナルはグローバルなものであり、すべての読者に対して、あるページの重要性と主題について全く同じ答えを提示します。しかし、これらは極めて重要な第3の次元を見落としています。それは、ページが実際にどのように「感じられるか」という点です。同じトピックを持ち、同じレベルの権威を持つ2つのページがあったとしても、一方は厳格で温かみがあり、もう一方は冷淡でセールス重視であるといった違いが生じ得ます。この違いは、事実や人気に関するものではなく、「キャラクター(性格)」に関するものです。これまで、この性質を大規模に測定したり、ウェブサイトを訪れた際にそれが人々の行動を実際に変えるのかどうかを理解したりする方法はありませんでした。
ジェイソン・デュークという研究者が、この欠落している性質を測定しようと試みました。彼は、ウェブページのキャラクターを、8つの異なる次元にわたって定量化可能な独立した属性として扱う「DYNAMICS-WEB」というシステムを開発しました。これらの次元には、文章がいかに注意深く精密であるか、内容がいかに深く掘り下げられているか、いかに独創的であるか、いかに誠実であるか、どの程度の情緒的な温かみを持っているか、どの程度強く何かを売ろうとしているか、どの程度意見を持っているか、そしてトーンがいかにフォーマルまたは親しみやすいかが含まれます。チームは単にこれらの性質を推測したわけではありません。彼らは数千件の人間の判断に基づき、テキスト内のこれらのパターンを認識するように大規模なコンピュータモデルを訓練しました。そして、このモデルを数百万のウェブサイトに適用し、トピックや知名度とは無関係に、そのページがどのように読めるかを正確に記述する詳細なプロファイルを作成しました。
研究の結果、このキャラクターは全く新しいものであることが判明しました。それは単にサイトの権威性を測る洗練された方法でもなければ、単に文章の読みやすさや言葉のポジティブさを反映したものでもありません。研究者たちが、権威性や表面的な文章スタイルのみを用いてページのキャラクターを予測しようとした際、それらのツールではキャラクターの大部分を捉えることに失敗しました。キャラクターのシグナルは、他のツールが見逃していた情報を保持していたのです。さらに、このキャラクターは静的なものではなく、ウェブを通じて流動しています。あるサイトが別のサイトへリンクを貼ることで権威性が広がるのと同様に、ウェブサイトのキャラクターはそのサイトが接続しているサイトにも影響を与えます。テキストがほとんどないページであっても、周囲のページが似たような性質を持っているため、明確なキャラクターを持つことがあります。研究者たちは、ウェブグラフにおける隣接するページのキャラクターによってウェブサイトのキャラクターを予測できることを示すことで、この性質がインターネットを繋ぎ合わせているリンクを通じて伝播することを証明しました。
おそらく最も驚くべき発見は、このキャラクターが意識のレベル以下で作用しているということです。研究者が人間に、8つの次元に基づいてページを評価するよう依頼したところ、読者間での一致が見られませんでした。読者は、ページがどれほど強く何かを売ろうとしているかといった明白な特徴は容易に識別できましたが、文章がいかに深く、あるいは誠実であるかといった、より微細な性質については名前をつけることに苦慮しました。しかし、コンピュータモデルは、これらの微細な特性を高い一貫性を持って測定することができました。このことは、読者がこれらの性質を言語化することはできずとも、感覚的に捉えていることを示唆しています。研究では、この目に見えない感覚が実際に重要であるかどうかを検証するため、価格や事実は同一であるが、文章のキャラクターのみが異なるオファーを117人に提示するという対照実験を行いました。その結果、ページの微細で名付けようのないキャラクターが読者の好みに一致した場合、購入や申し込みを選択する割合は19パーセントから31パーセントへと跳ね上がりました。ページがどれほど熱心に販売を促しているかといった、声高で明白な特徴は、決定に影響を与えませんでした。
また、この手法は異なる言語や文化においても機能することが示されました。チームは、非常に異なる表記体系や文化的背景を持つアラビア語、中国語、スワヒリ語を用いてシステムをテストしました。どのケースにおいても、モデルは学術的なページがビジネス向けのページよりも厳格で商業性が低いことを正しく特定しており、キャラクターという概念が英語に限定されないことを証明しました。彼らはまた、キャラクターを測定するために使用されたものと同じ数学的エンジンを用いれば、ウェブサイトのアドレスにその国のコードが含まれていなくても、そのサイトがどの国に属しているかを特定できることも実証しました。これは、ウェブグラフが権威だけでなく、多くの異なる種類の情報を持っていることを裏付けています。
結局のところ、この論文は、インターネットが私たちが考えていたよりも豊かなものであることを確立しています。インターネットは単に重要なページの階層構造ではなく、ページの「声」がその事実と同じくらい重要となる空間なのです。この研究は、この「声」がウェブを通じて流れ、私たちが意識的に説明できない方法で人間の行動に影響を与える、実在し、測定可能なシグナルであることを証明しました。コンバージョンへの影響は控えめなものでしたが、それは実在し、かつ人々が感じつつも名付けることのできない部分に特有のものでした。研究者たちは、ユーザーのデバイス上でローカルに動作してプライバシーを保護しながら、あらゆるページに対してこのキャラクターを読み取ることができるツールを構築し、コンテンツがいかに人とつながるかを理解するための新しい方法を提示しました。この研究は、ウェブの未来が、ページの知名度によってランク付けすることではなく、読む人にとってそのページがどのように感じられるかに基づいてマッチングさせることにある可能性を示唆しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。