How Generative AI Disrupts Search: An Empirical Study of Google Search, Gemini, and AI Overviews
이 실증 연구는 구글 검색, AI 개요, 그리고 제미니를 비교하여 생성형 AI 가 전통적인 웹 검색을 어떻게 교란시키는지 분석하며, 소스 선정의 상당한 차이, 낮은 일관성, AI 크롤러를 차단하는 사이트의 가시성 감소 등을 드러내면서 생태계를 지원하기 위한 지속 가능한 수익 모델을 요구합니다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
인터넷을 거대한 도서관이라고 상상해 보세요. 몇 년 동안, 만약 당신이 사서 (구글 검색) 에게 "누수 난 수도꼭지 고치는 법"에 관한 책을 요청하면, 사서는 상단 선반에서 가장 인기 있고 신뢰할 수 있는 매뉴얼 목록을 당신에게 건네주었을 것입니다. 당신은 하나를 선택해 가서 직접 읽어보았을 것입니다.
이 논문은 그 사서에게 새로운, 매우 똑똑하지만 때로는 지나치게 열성적인 보조원 (생성형 AI) 이 생겼을 때 어떤 일이 일어나는지에 대한 보고서입니다. 이 보조원은 단순히 책 목록을 건네는 것이 아니라, 모든 책을 읽고 가장 좋은 부분을 요약하여 책상 앞에서 당신을 위해 새로운 이야기를 써줍니다.
연구자들은 11,000 개 이상의 실제 질문을 사용하여 기존 사서, 새로운 AI 보조원, 그리고 다른 AI 채팅봇 (제미니) 을 비교했을 때 다음과 같은 사실을 발견했습니다.
1. 새로운 보조원은 어디에나 있지만 (선별적임)
연구자들은 사람들이 묻는 모든 실제 질문의 약 절반에서 이 새로운 AI 보조원 (AI 개요 또는 AIO 라고 함) 이 링크 목록을 보여주기 전에 요약본을 제공하며 끼어들고 있음을 발견했습니다.
- 비유: 상점에 들어서는 순간, 선반을 살펴보기 전에 세일즈맨이 즉시 "이게 답입니다!"라고 외치는 것과 같습니다.
- 문제점: 이 보조원은 "피자 스톤을 어떻게 청소하나요?"와 같은 길고 구체적인 질문을 좋아하지만 "피자 스톤"과 같은 간단한 키워드 검색은 무시합니다. 또한 정치적 논쟁과 같은 논쟁적인 주제에서는 94% 의 빈도로 등장합니다.
2. 그들은 다른 선반을 보고 있습니다
가장 큰 충격은 세 명의 "사서" (전통적 구글, AI 개요, 제미니) 가 거의 같은 책을 보지 않는다는 사실입니다.
- 비유: 세 친구가 같은 영화에 대해 설명하려 한다고 상상해 보세요. 같은 배우와 장면을 언급할 것이라고 기대할 것입니다. 대신 연구자들은 AI 보조원과 전통적 검색 엔진이 사용한 출처 중 약 15~20% 만 일치한다는 사실을 발견했습니다. 그들은 본질적으로 도서관의 완전히 다른 섹션을 읽고 있는 것입니다.
- 편향: 전통적 검색 엔진은 "유명한" 책들 (인기 있는 뉴스 사이트, 정부, 대학) 에 머무릅니다. 반면 AI 보조원은 구글이 소유한 자산 (유튜브나 구글의 자체 사이트 등) 에서 정보를 가져올 가능성이 훨씬 높고, 유명하고 신뢰할 수 있는 출처는 무시합니다.
3. "방해 금지" 표지판은 작동하지 않습니다
일부 대형 출판사 (뉴욕 타임즈나 페이스북 등) 는 AI 가 훈련을 위해 그들의 콘텐츠를 읽는 것을 막기 위해 "방해 금지" 표지판 (기술적 차단) 을 세웠습니다.
- 기대: AI 가 그 표지판을 존중하고 그 책들을 건너뛸 것이라고 생각할 수 있습니다.
- 현실: 전통적 검색 엔진은 그 표지판을 존중합니다. 하지만 AI 개요는 어떨까요? 그것은 표지판을 무시하는 것처럼 보입니다. 그러나 연구자들은 반전을 발견했습니다. AI 가 이러한 차단된 사이트를 읽을 수는 있지만, 아직도 거의 인용하지는 않는다는 사실입니다. 마치 AI 가 표지판을 보고 그 책을 읽지 않기로 결정한 후, 그 책의 존재 자체를 완전히 잊어버린 것처럼 보입니다. 이는 AI 를 차단하는 출판사들이 실제로 새로운 시스템에서의 자신의 가시성을 해치고 있음을 의미합니다.
4. 보조원은 변덕스럽습니다 (일관성 부족)
동일한 질문을 두 번 하면 전통적 사서는 동일한 책 목록을 제공합니다. AI 보조원은 어떨까요? 그렇지 않습니다.
- 비유: 오늘 AI 에게 "가장 좋은 피자 가게는 어디인가요?"라고 물으면 "토니's"에 대해 알려줄 수 있습니다. 5 분 후에 다시 물거나 노트북 대신 휴대폰으로 물으면 갑자기 "루이지's"에 대해 알려줄 수 있습니다.
- 문제점: AI 는 사소한 변화에도 매우 민감합니다. "What is" 대신 "What's"라고 입력하면 완전히 다른 답변을 얻을 수 있습니다. 이로 인해 동일한 정보를 두 번 얻고 있는지 신뢰하기 어렵습니다.
5. "고위험" 위험 구역
사람들이 정치나 급부상하는 뉴스와 같은 심각한 주제에 대해 질문할 때, AI 는 답변하는 데 매우 열성적이지만 종종 잘못되거나 편향되어 있습니다.
- 발견: 정치적 질문의 경우, AI 는 전통적 검색 엔진에 비해 팬 위키나 풍자 뉴스와 같이 신뢰도가 낮은 출처를 선택하는 경우가 많습니다.
- 할루시네이션: 한 실제 사례에서 AI 는 아직 일어나지 않은 복서와의 경기에서 승리했다고 자신 있게 선언했는데, 풍자 페이스북 페이지의 농담 게시물을 증거로 제시했습니다. 마치 시험에서 답을 추측하고 그 잘못된 추측을 정당화하기 위해 에세이 전체를 쓰는 학생과 같습니다.
큰 그림
이 논문은 이러한 새로운 검색 방식이 양날의 검이라고 결론지었습니다.
- 사용자에게: 편리하지만, AI 가 특히 심각한 주제에서 사실을 조작하거나 신뢰할 수 없는 출처를 사용할 수 있으므로 주의해야 합니다.
- 출판사에: 게임의 규칙이 바뀌었습니다. "인기 있는" 웹사이트들은 더 적은 관심을 받고 있는 반면, 틈새 사이트들은 더 많은 관심을 받고 있습니다. 또한, AI 가 콘텐츠를 읽지 못하도록 차단하는 것이 실제로 AI 의 답변에서 귀하의 사이트를 완전히 사라지게 만들 수 있습니다.
- 해결책: 저자들은 새로운 합의가 필요하다고 제안합니다. 출판사와 AI 기업은 고품질 웹사이트가 영업을 유지하고 AI 가 우리에게 제공할 수 있는 가장 정확하고 신뢰할 수 있는 정보에 접근할 수 있도록 수익을 공유하는 방법을 찾아야 합니다.
요약하자면, AI 보조원은 강력한 새로운 도구이지만, 현재는 기존 사서보다 더 다르고 덜 안정적이며 때로는 덜 신뢰할 수 있는 책들을 읽고 있습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.