← 최신 논문
🤖 AI

AI advice suppresses people's willingness to say "I don't know", even when the advice is wrong and accuracy is incentivized

다섯 가지 실험은 단지 AI의 조언에 접근할 수 있다는 사실만으로도, 설령 그 조언이 틀리고 정확성이 장려되는 상황일지라도, 사람들이 불확실성을 인정하려는 의지를 급격히 감소시켜 결과적으로 훨씬 낮은 정확도를 보이면서도 더 많은 질문에 대해 부풀려진 자신감을 가지고 답변하게 만든다는 것을 보여준다.

원저자: Chiara Marcoccia, Walter Quattrociocchi, Valerio Capraro

게시일 2026-07-16
📖 3 분 읽기☕ 가벼운 읽기

원저자: Chiara Marcoccia, Walter Quattrociocchi, Valerio Capraro

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

멈출 때를 아는 기술

친구와 함께 상식 퀴즈 게임을 하고 있다고 상상해 보세요. 어떤 때는 정답을 즉시 알기도 합니다. 또 어떤 때는 확신이 서지 않아서 "잘 모르겠어"라고 말하거나 무작정 찍기도 하죠. 과학의 세계에서 이렇게 잠시 멈추고 불확실함을 인정하는 능력은 '판단 유보(suspending judgment)'라고 불립니다. 이는 우리가 사실이 아닌 것을 믿지 않도록 지켜주는 초능력과 같습니다. 오랫동안 인간만이 이 초능력을 가지고 있었습니다. 무언가를 모를 때 우리는 침묵을 지켰습니다. 하지만 이제 우리에게는 새로운 팀원이 생겼습니다. 바로 인공지능(AI)입니다. 이 AI 비서들은 거의 모든 질문에 즉각적으로 답할 수 있는, 매우 빠르고 자신감 넘치는 사서와 같습니다. 과학자들이 던지는 큰 질문은 이것입니다. 만약 우리에게 항상 답을 준비하고 있는 매우 빠르고 자신감 넘치는 친구가 있다면, 우리는 "모르겠다"라고 말하는 것을 멈추게 될까요? 우리가 AI를 너무 신뢰한 나머지, 설령 AI가 틀렸더라도 스스로 생각하며 멈추는 법을 잊어버리게 될까요?

실험: AI가 거짓말을 할 때

연구진들은 이 문제를 테스트하기 위해 까다로운 게임을 설계했습니다. 그들은 사람들에게 영화에 관한 어려운 질문 6가지를 던졌습니다. 예를 들어 옛날 만화 속 거북이의 색깔이나 특정 캐릭터가 운전했던 자동차 같은 것들입니다. 이 질문들은 AI가 '환각(hallucination)' 현상을 일으켜, 자신감 있게 들리지만 완전히 틀린 답을 만들어내기 쉬운 유형으로 정교하게 선정되었습니다. 연구진은 일부 참가자들에게는 AI에게 도움을 요청할 수 있는 옵션을 주었고, 다른 이들은 스스로 답하게 했습니다.

여기 반전이 있습니다. AI는 거의 항상 틀렸습니다. 마치 매우 크고 확신에 찬 목소리로 말하지만, 실제로는 틀린 답을 추측하고 있는 친구를 둔 것과 같았습니다. 연구진은 사람들이 이 신뢰할 수 없는 친구에게 물어볼 수 있는 옵션이 있을 때도 여전히 "모르겠다"라고 말할 것인지, 아니면 AI의 존재만으로도 멈추는 것을 포기하고 그냥 답을 하기 시작할 것인지를 확인하고 싶었습니다.

발견된 사실: "인지적 항복(Cognitive Surrender)"

결과는 놀랍고도 다소 무서웠습니다. 사람들이 AI를 사용할 수 있게 되자, "모르겠다"라고 말하는 경우가 거의 사라졌습니다. 마치 AI의 유창하고 자신감 넘치는 목소리가 답을 내놓기 위해 필요한 기준치를 낮춰버린 것 같았습니다. 비록 AI가 틀리는 경우가 대부분이었음에도 불구하고, AI를 사용한 사람들은 사용하지 않은 사람들보다 훨씬 더 많은 질문에 답했습니다. 하지만 여기에는 함정이 있었습니다. 그들이 정답을 맞힌 비율은 AI를 사용하지 않은 사람들에 비해 약 3분의 1 수준에 불과했습니다.

이는 마치 학생이 정답을 알려주는 커닝 페이퍼를 가졌다는 이유로 "잘 모르겠어요"라고 손을 드는 것을 멈춘 것과 같습니다. 학생은 시험지를 끝까지 채우지만, 커닝 페이퍼를 너무 믿은 나머지 대부분 틀리고 맙니다. 연구는 AI를 활용할 수 있게 되면 사람들이 자신의 답변에 대해 훨씬 더 큰 자신감을 느끼게 되지만(자신감이 거의 두 배로 증가함!), 실제 정확도는 크게 떨어진다는 것을 보여주었습니다. 그들은 본질적으로 자신의 판단을 기계에 항복시킨 것입니다.

돈이 게임을 바꿀 수 있을까?

연구진은 다음과 같은 의문을 가졌습니다. 만약 정답을 틀리는 것이 실제로 돈을 잃는 결과로 이어진다면 어떻게 될까요? 그들은 사람들이 더 깊이 생각하고, AI가 주변에 있더라도 다시 "모르겠다"라고 말하기 시작할지도 모른다는 희망을 품고 새로운 라운드를 설정했습니다. 이번 라운드에서는 정답을 맞히면 적은 금액을 벌고, 틀리면 적은 금액을 잃게 했습니다.

돈은 약간의 도움이 되었습니다. 사람들은 AI에게 도움을 덜 요청했고, 정답을 맞히는 횟수도 약간 늘어났습니다. 하지만 돈이 근본적인 문제는 해결하지 못했습니다. 틀리는 것에 대한 벌칙이 있음에도 불구하고, AI를 가진 사람들은 AI가 없는 사람들보다 훨씬 더 적게 "모르겠다"라고 말했습니다. AI의 유혹은 너무나 강력했습니다. AI는 단순히 사람들이 무엇을 답할지를 바꾼 것이 아니라, 그들이 답을 해도 되는지 스스로 느꼈던 '자격' 자체를 바꾸어 놓았습니다.

시사점

이 연구는 AI가 더욱 흔해지고 우리가 묻기도 전에 답을 내놓기 시작함에 따라, 우리가 중요한 기술 하나를 잃어버릴 수도 있음을 시사합니다. 그것은 바로 우리가 무언가를 모를 때를 인식하는 능력입니다. AI는 단순히 빈칸을 채워주는 것이 아니라, 우리가 멈춰서 생각할 필요가 없다고 설득하는 것처럼 보입니다. 이 연구는 틀렸을 때의 대가가 있다면 우리가 검토를 하도록 동기 부여가 될 수는 있지만, 기계가 내놓는 자신감 있고 유창한 답변의 존재 자체가 우리가 스스로의 불확실성을 인정할 가능성을 훨씬 낮춘다는 것을 보여줍니다. AI가 가득한 세상에서, 언제 "모르겠다"라고 말해야 하는지를 아는 것이 가장 중요한 기술이 될 것입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →