Tracking Conversations: Measuring Content and Identity Exposure on AI Chatbots
本論文は 20 の人気 AI チャットボットにおける Web 追跡を体系的に測定し、プライベートチャットモードであっても、大多数が第三者の分析、広告、セッションリプレイサービスと機密性の高いユーザーコンテンツおよび個人識別情報を共有していることを明らかにする。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
AI チャットボットを、ハイテクで親しみやすい図書館司書だと想像してみてください。あなたは彼らの元へ近づき、ささやくように質問を投げかけると、彼らはあなたを助けるために一冊の本を取り出します。過去には、あなたは「これは私と司書の間の会話に過ぎない」と考えていたかもしれません。
しかし、この研究論文は、あなたが司書と話している間に、一方向のガラスの壁の向こう側に大勢の見知らぬ人々が立ち、メモを取り、写真を撮り、さらには音声を録音していることを明らかにしています。
以下に、研究者たちが発見した内容を、シンプルな比喩を用いて解説します。
1. 仕組み:「ガラスの家」の司書たち
研究者たちは、ChatGPT、Gemini、Claude などの最も人気のある AI チャットボット Web サイト 20 箇所を訪れました。彼らは単にランダムな質問をしたのではなく、非常に具体的で機微な質問を投げかけました。「私の近くで妊娠検査薬はどこで入手できますか?」
これは、図書館に入って、非常に小声で医療相談をするようなものです。研究者たちは、その特定の情報があなたの口から出た後にどうなるかを知りたがっていました。
2. 大暴露:「第三者の覗き見」
この研究は、20 個のチャットボットのうち 17 個が、会話の詳細を外部企業(第三者)と共有していることを発見しました。
次のように考えてみてください。あなたは部屋でプライベートな会話をしていますが、その壁はガラスでできており、チャットボットの所有者は 17 人の異なる隣人を招いて、盗聴させています。
- 「セッション再生」カメラ:3 つのチャットボットは「Microsoft Clarity」というツールを使用していました。これは単に部屋を録画するセキュリティカメラではなく、あなたが何と言ったか、そして司書が何と返答したかを、そのままのテキストで記録するようなものです。研究者たちは、これらのカメラが「妊娠検査薬」に関する会話の全文を Microsoft に送信しており、それによって Microsoft があなたのプライベートな医療に関する問い合わせを読むことを可能にしていたことを発見しました。
- 「チャット ID」の葉書:チャットボットが全文を送信しなくても、15 個のチャットボットは広告主や分析企業に「葉書」を送っていました。この葉書にはあなたが何を尋ねたかは書かれていませんでしたが、あなたの特定の会話に固有のチャット IDやリンクが含まれていました。これは、マーケティング企業に「私は 404 号室にいます」というメモを送るようなものです。彼らはまだあなたが妊娠検査薬について尋ねたことを知らないかもしれませんが、あなたがその特定の部屋にいることは知っており、後でその部屋をあなたの身元と結びつけることができます。
3. 「名札」の問題
研究者たちはまた、多くのチャットボットが会話と一緒にあなたの身元(名前、メールアドレス、またはアカウント ID)を渡していることも発見しました。
- 「サポートウィジェット」の漏洩:一部のチャットボットには、画面に小さな「ヘルプ」ボタンがあります。ページを読み込むと、これらのボタンはあなたがクリックしなくても、ボタンを作った会社(Intercom など)にあなたの名前とメールアドレスを自動的に叫びます。
- 「ハッシュ化」された秘密:一部のチャットボットはあなたのメールアドレスを送信しましたが、「かき混ぜて」(ハッシュ化して)いました。これは、受信者だけが解読できる秘密のコードを送るようなものです。もしあなたが同じかき混ぜられたコードをショッピングサイトとチャットボットサイトで使用した場合、広告主はそれらを結びつけて、「ああ、おむつを買った人と同じ人が妊娠検査薬について尋ねているんだ」と気づくことができます。
4. 「シークレットモード」:機能するか?
多くのチャットボットは、何も保存されないことを約束する「プライベート」または「一時」チャットモードを提供しています。研究者たちはこれをテストしました。
- 結果:機能しました!プライベートモードでは、「隣人の群れ」はほとんど消えました。外部企業の数は大幅に減少し、テストされたプライベートチャットでは、誰も会話のテキストやあなたの身元を見ていませんでした。
- ただし:チャットボットのプライバシーポリシーには、「プライベートモードは広告主を止める」とは明確に書かれていませんでした。単に履歴を保存しないことについて言及しているだけでした。研究者たちは、ルールが明確に説明していなくても、プライベートモードの設計自体が追跡を阻止していたことを発見しました。
5. 「プライバシーポリシー」対 現実
研究者たちは、チャットボットが(長く退屈なプライバシーポリシーの中で)何をしていると言っていたかと、実際に何をしているかを比較しました。
- 不一致:一部のポリシーは曖昧で、「パートナーとデータを共有する」と述べているだけでした。他のポリシーは具体的でしたが、最大の漏洩源を見逃していました。例えば、3 つのチャットボットはポリシーに特定のパートナーをリストアップしていましたが、Microsoft Clarity については言及していませんでした。にもかかわらず、Clarity が彼らのプライベートな会話をそのままのテキストで録画していたのです。
- 例外:Duck.ai というチャットボットは「正直な司書」でした。彼らは誰ともデータを共有せず、AI に質問を送る前に位置情報を削除することさえしていました。
まとめ
この論文は、AI チャットボットは素晴らしいツールである一方で、現在はガラスの家のように構築されていると結論付けています。
- 20 個のうち 17 個のチャットボットは、外部企業に覗き見を許しています。
- 3 つのチャットボットは、外部企業にあなたのプライベートな医療や個人的な質問を声に出して読ませています。
- 15 個のチャットボットは、あなたの会話と身元を結びつける固有の ID を広告主に送信しています。
- プライベートモードだけが、隣人を効果的に遮断する唯一の「カーテン」ですが、チャットボットはそれが何をするのかを常に教えてくれるわけではありません。
研究者たちは、チャットボットの所有者はより良い壁(設計の変更)を構築し、誰が聞いているかについてより正直であること(より明確なポリシー)が必要だと提案しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。