AI advice suppresses people's willingness to say "I don't know", even when the advice is wrong and accuracy is incentivized
5つの実験は、たとえAIのアドバイスが不正確であり、かつ正確さが推奨されている状況であっても、単にAIのアドバイスを利用できるというだけで、人々が不確実性を認める意欲を劇的に低下させ、その結果、精度が著しく低下する一方で、より膨れ上がった自信を持って回答するようになることを示している。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
「わからない」と言う技術
友人とクイズをしている場面を想像してみてください。答えがすぐにわかることもあれば、自信がないので「わからない」と言ったり、適当に勘で答えてしまったりすることもあります。科学の世界では、このように立ち止まり、不確実性を認める能力を「判断の保留(suspending judgment)」と呼びます。これは、真実ではないことを信じ込んでしまうのを防ぐための「スーパーパワー」です。長い間、人間はこのスーパーパワーを持つ唯一の存在でした。何かを知らないときは、黙っていたからです。しかし今、私たちには新しいチームメイトが加わりました。人工知能(AI)です。これらのAIアシスタントは、どんな質問にも即座に答えられる、非常に高速で自信満々な司書のような存在です。科学者たちが投げかけている大きな問いはこうです。「もし、常に答えを用意している超高速で超自信満々な友人がいたら、私たちは『わからない』と言うのをやめてしまうのだろうか? もしAIが間違っていたとしても、私たちはAIを信じすぎて、自分で立ち止まって考えることを忘れてしまうのだろうか?」
実験:AIが嘘をつくとき
研究チームは、このことを検証するために、トリッキーなゲームを用意しました。彼らは人々に、映画に関する6つの難しい質問をしました。例えば、古いアニメに出てくるカメルの色や、キャラクターが運転していた特定の車などです。これらの質問は、AIが「ハルシネーション(幻覚)」を起こし、自信たっぷりに間違った答えを作り上げてしまうような内容として、慎重に選ばれました。研究者は、ある人々にはAIに助けを求める選択肢を与え、他の人々には自分自身の力だけで答えるようにしました。
ここにひねりがあります。そのAIは、ほとんどの場合、間違っていました。それはまるで、声が大きくて自信満々だが、実際には間違った答えを推測している友人がそばにいるような状態でした。研究者は、この信頼できない友人に頼れる選択肢があるとき、人々がそれでもなお「わからない」と言い続けるのか、それともAIの存在そのものが、人々から「立ち止まって考えること」を奪い、ただ答えを出させてしまうのかを知りたかったのです。
分かったこと:「認知的な降伏」
結果は驚くべきものであり、少し恐ろしいものでした。AIを利用できる環境にあるとき、人々は「わからない」と言うことがほとんどなくなりました。まるで、AIの流暢で自信に満ちた声が、「答えを出してよい」と感じるためのハードルを下げてしまったかのようでした。たとえAIがほとんどの場合間違っていたとしても、AIを利用した人々は、利用しなかった人々よりもはるかに多くの質問に回答しました。しかし、ここが落とし穴です。彼らが正解できた割合は、AIを使わなかった人々のわずか3分の1程度でした。
それは、カンニングペーパーが答えを教えてくれるために、手を挙げて「自信がありません」と言うのをやめてしまった生徒のようなものです。彼らはテストをすべて埋めましたが、カンニングペーパーを信じすぎたために、ほとんどの設問で間違えてしまいました。この研究は、AIが利用可能であることで、人々が自分の答えに対して感じる自信が大幅に高まった一方で(自信はほぼ倍増しました!)、実際の正確性は著しく低下したことを示しました。彼らは、自身の判断を機械に「降伏」させてしまったのです。
お金はゲームを変えるのか?
研究者たちは次に、こう考えました。「もし、答えを間違えることが本当にお金に関わることになったらどうだろうか?」 彼らは、正解すれば少額の報酬が得られ、間違えれば少額の罰金が発生する新しいラウンドを設定しました。これにより、人々がより深く考え、AIがそばにいても再び「わからない」と言い始めるのではないかと期待したのです。
お金は多少の効果はありました。AIに助けを求める頻度は減り、正解できる数もわずかに増えました。しかし、お金は根本的な問題は解決しませんでした。間違えることにペナルティがあったとしても、AIを利用した人々は、AIを持っていなかった人々よりもはるかに「わからない」と言うことが少なかったのです。AIの引きは強力すぎました。AIは単に「何を」答えるかを変えただけでなく、「答えてもよいと感じるかどうか」さえも変えてしまったのです。
まとめ
この研究は、AIがより一般的になり、私たちが尋ねる前に答えを与えてくれるようになるにつれ、私たちはある重要なスキルを失う可能性があることを示唆しています。それは、「自分が何を知らないのかを認識する能力」です。AIは単に空白を埋めるだけでなく、私たちに「立ち止まって考える必要はない」と納得させてしまうようです。この研究は、間違えることへのコストがあれば、自分の間違いをチェックしようとする動機付けにはなるものの、機械による自信に満ちた流暢な回答が目の前にあるだけで、私たちは自分の不確かさを認めることをはるかに躊躇してしまうことを示しています。AIに満ちた世界において、「わからない」と言うべき時を知ることは、最も重要なスキルになるのかもしれません。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。