← 최신 논문
📈 economics

Agent-Facing Information Design in LLM Tool Registries

본 논문은 허위 주장이 아닌 합법적인 과장 선전이 LLM 도구 선택의 편향 주원인임을 규명하여 현재 공개 방식의 실패를 입증하고, 에이전트 책임성을 보장하기 위해 구조화된 능력 설명과 마케팅 문구를 분리하는 레지스트리 계층 설계를 제안한다.

원저자: Haochuan Kevin Wang

게시일 2026-05-26
📖 4 분 읽기☕ 가벼운 읽기

원저자: Haochuan Kevin Wang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

이 논문은 간단한 언어와 일상적인 비유를 사용하여 설명합니다.

큰 그림: AI 도구 상점의 "서부 개척지"

사용자를 위해 일을 수행할 도구를 선택하러 가는 AI 어시스턴트 (이들 '에이전트') 들이 방문하는 거대한 디지털 시장장을 상상해 보세요. 아마도 사용자는 AI 에게 "가장 좋은 날씨 예보를 찾아줘"라고 요청할 것이고, AI 는 다섯 개의 서로 다른 날씨 앱 중에서 하나를 선택해야 할 것입니다.

현재 이 시장장은 규칙이 없는 서부 개척지 벼룩시장과 같습니다.

  • 문제점: 도구 소유자들이 자신의 설명을 직접 작성합니다. 그들은 AI 가 자신을 선택하도록 속이기 위해 화려한 단어, 최상급 표현 ("#1 최고의 도구!"), 그리고 거창한 주장을 사용할 수 있습니다.
  • 부족한 부분: 별점, 검증된 리뷰, 또는 실제로 작동하는 "스폰서" 라벨과 같은 인간이 쇼핑할 때 갖는 것들과 달리, 이 AI 시장장에는 측정 시스템이 전혀 없습니다. 도구가 실제로 좋은지, 아니면 설명이 단순한 거짓말인지 확인할 방법이 없습니다.

연구진은 이러한 마케팅 과장물에 AI 에이전트가 얼마나 쉽게 영향을 받는지 확인하기 위해 17,700 건 이상의 실험을 수행했습니다.


주요 발견: 그들이 알아낸 것

1. "과장"이 항상 승리합니다

연구진은 두 도구가 정확히 같은 일을 수행하더라도, 하나는 지루한 설명을 가지고 다른 하나는 "과장된" 설명 ("가장 빠른", "가장 정확한", "수백만 명이 신뢰함"과 같은 단어 사용) 을 가지고 있다면, AI 가 과장된 설명을 가진 도구를 100% 의 확률로 선택한다는 사실을 발견했습니다.

  • 비유: 두 대의 동일한 자동차가 나란히 주차되어 있다고 상상해 보세요. 하나는 "자동차"라고 적힌 평범한 간판을 가지고 있고, 다른 하나는 "세계에서 가장 빠르고 신뢰할 수 있는 자동차!"라고 적힌 거대한 네온 사인을 가지고 있습니다. AI 는 두 자동차가 동일하다는 사실을 신경 쓰지 않고, 맹목적으로 네온 사인을 향해 달려갑니다.
  • 결과: 단순히 단어 (광고 문구) 만 바꾸는 것만으로 모든 트래픽을 확보합니다. AI 는 본질적으로 "클릭베이트에 취약한" 존재입니다.

2. 거짓말은 도움이 되지 않습니다 (하지만 과장은 도움이 됩니다)

팀원들은 거짓된 숫자를捏造하는 것 (예: 사실이 아닌 "1,200 만 명의 개발자가 사용함") 이 법적 과장 (과장 광고) 만 사용하는 것보다 AI 가 도구를 더 자주 선택하게 하는지 테스트했습니다.

  • 발견: 아닙니다. AI 는 법적 과장을 사용한 도구와 거짓말이 포함된 도구를 선택할 확률이 동일했습니다.
  • 교훈: "거짓말"이 추가적인 힘을 주지 않았습니다. 문제는 AI 가 거짓말에 속아 넘어가는 것이 아니라, 사실보다는 언어의 스타일 (최상급 표현) 에 반응한다는 점입니다. 이는 규제 당국이 문제를 해결하기 위해 단순히 "가짜 광고"를 금지할 수 없다는 것을 의미합니다. 왜냐하면 "합법적인" 과장이 이미 피해의 100% 를 차지하고 있기 때문입니다.

3. 경고 라벨은 작동하지 않습니다

연구진은 구글의 "스폰서" 라벨이나 아마존의 별점 평가와 유사하게 경고 라벨을 추가하여 문제를 "해결"하려고 시도했습니다.

  • 결과: 완전히 실패했습니다.
    • 대부분의 AI 에게: 경고는 무시되었습니다. AI 는 여전히 과장된 도구를 선택했습니다. 마치 네온 사인에 "주의: 이 광고는 유료입니다"라는 스티커를 붙여도 AI 가 여전히 빛을 향해 달려가는 것과 같습니다.
    • 한 가지 AI (Claude) 에게: 과잉 반응했습니다. "스폰서" 라벨을 보았을 때, 실제로는 최고의 도구임에도 불구하고 그 도구를 피했습니다.
  • 결론: AI 에게 "조심하라"고 말하는 것만으로는 이 문제를 해결할 수 없습니다. AI 의 뇌가 고장 난 것이 아니라 시스템이 고장 난 것입니다.

4. "죄수의 딜레마" (하향 평준화 경쟁)

과장된 도구가 항상 승리하기 때문에, 모든 도구 소유자는 생존을 위해 과장된 설명을 작성하도록 강요받습니다.

  • 비유: 모두 자격이 있는 구직 면접을 상상해 보세요. 만약 한 지원자가 정장을 입고 "내가 최고다"라고 말하면 그 사람이 일자리를 얻습니다. 그래서 나머지 사람들은 모두 정장을 입고 "내가 최고다"라고 말하기 시작합니다. 결국, 모두가 정장을 입고 외치기 때문에 면접관이 누가 실제로 좋은지 구별할 수 없게 됩니다.
  • 결과: 시장장은 무용지물이 됩니다. 모든 사람이 동일한 마케팅 슬로건을 외치기 때문에 설명은 더 이상 품질에 대해 아무것도 알려주지 않습니다.

제안된 해결책: "메뉴" 대 "전단"

이 논문은 이러한 도구 상점의 작동 방식을 완전히 재설계할 것을 제안합니다. 그들은 정보를 두 개의 별도 항목으로 분리할 것을 제안합니다.

  1. AI 를 위한 "선택 메뉴":

    • 이는 AI 가 도구를 선택하기 전에 보는 것입니다.
    • 규칙: 마케팅 용어 금지. "최고", "가장 빠름", "신뢰함" 등의 단어 사용 금지.
    • 형식: 구조화된 목록으로 된 차갑고 단단한 사실만 (예: "입력: 텍스트. 출력: 링크 10 개. 속도: 200ms").
    • 이유: 연구진은 AI 가 화려한 문체보다는 이러한 지루하고 구조화된 형식을 실제로 선호한다는 사실을 발견했습니다. 이는 AI 가 과장에 방해받지 않고 올바른 도구를 선택하는 데 도움이 됩니다.
  2. 사용자 (인간) 를 위한 "마케팅 전단":

    • 이는 AI 가 이미 도구를 선택한 후에 *사용자 (인간)*가 보는 것입니다.
    • 규칙: 도구 소유자는 원하는 대로 모든 화려한 마케팅 문구를 작성할 수 있습니다.
    • 이유: AI 는 이미 사실에 기반하여 자신의 일을 끝냈습니다. 이제 사용자 (인간) 는 "스폰서" 홍보 문구를 읽어서 도구를 좋아할지 결정할 수 있습니다.

한 문장으로 요약

현재 AI 에이전트들은 도구 등록부가 규제되지 않은 광고 플랫폼이기 때문에 마케팅 과장에 속아 넘어가고 있습니다. 해결책은 AI 에게 거짓말을 무시하도록 가르치는 것이 아니라, 등록부에 AI 에게는 지루하고 사실만 있는 메뉴를 보여주고 화려한 판매 문구는 인간 사용자를 위해 남겨두도록 강제하는 것입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →