Can Trustless Agents Be Trusted? An Empirical Study of the ERC-8004 Decentralized AI Agent Ecosystem
이 논문은 이더리움, BSC, Base 전반에 걸친 ERC-8004 탈중앙화 AI 에이전트 프로토콜에 대한 첫 번째 실증적 연구를 제시하며, 에이전트 등록의 비활성, 호환되지 않는 평판 지표, 그리고 피드백에 대한 광범위한 시빌(Sybil) 조작으로 인해 현재의 설계가 신뢰할 수 있는 기반을 제공하는 데 실패하고 있음을 밝히고 있다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
활기찬 디지털 마켓플레이스를 상상해 보세요. 그곳에서는 수천 명의 로봇 비서(AI 에이전트)들이 서로 비즈니스를 하기 위해 애쓰고 있습니다. 이들은 서로를 고용하고, 대가를 지불하며, 데이터를 거래해야 합니다. 하지만 거대한 문제가 하나 있습니다. 한 로봇이 한 번도 만난 적 없는 다른 로봇이 정직한지, 아니면 그저 사기꾼인지 어떻게 알 수 있을까요?
이를 해결하기 위해 ERC-8004라는 새로운 규칙이 만들어졌습니다. 이것을 블록체인 위에 구축된 거대하고 공개적인 "신뢰 장부(Trust Ledger)"라고 생각하면 됩니다. 이 장부는 세 가지 주요 섹션으로 구성되어 있습니다:
- ID 카드 등록부: 로봇들이 자신의 이름과 얼굴을 등록하는 곳입니다.
- 평판 벽: 고객들이 리뷰와 별점을 남기는 곳입니다.
- 검증 금고: (계획 단계이며 아직 구축되지 않음) 독립적인 전문가들이 로봇이 주장한 대로 실제로 업무를 수행했는지 검증하는 곳입니다.
이 논문의 저자들은 이 새로운 시스템이 실제로 작동하는지 확인하기 위해 돋보기를 들고 조사하기로 했습니다. 그들은 몇 달 동안 세 가지 서로 다른 디지털 세계(Ethereum, BSC, Base)에서 추출한 실제 데이터를 살펴보았습니다. 그들이 발견한 내용은 다음과 같이 쉽게 설명할 수 있습니다.
1. "유령 도시" 문제 (정체성)
논문에 따르면 ID 등록부는 이름들로 가득 차 있지만, 대부분은 유령이라는 사실이 밝혀졌습니다.
- 비유: 전화번호부에 17만 개의 항목이 있다고 상상해 보세요. 당신이 번호를 골라 전화를 걸었지만, 97%는 연결되지 않는 번호이거나, 전화를 받은 사람이 실제 비즈니스가 아니라 단순히 "여기에 있습니다"라고 말하는 녹음기뿐인 상황입니다.
- 실제 상황: 등록된 대부분의 에이전트는 그저 자리만 차지하고 있는 존재들입니다. 실제로 수행할 수 있는 작동하는 서비스가 있는 에이전트는 아주 적은 비율(3%에서 15% 사이)뿐입니다. 이더리움 체인에서는 등록된 에이전트 중 절반 이상이 연락 가능한 "전화번호"(URI)조차 설정하지 않았습니다.
2. "가짜 리뷰"의 창궐 (평판)
평판 벽은 이 시스템의 심장이 되어야 했지만, 저자들은 그것이 망가져 있음을 발견했습니다.
- 비유: 음식을 먹어보지도 않고 누구나 리뷰를 남길 수 있는 식당 리뷰 사이트를 상상해 보세요. 훨씬 더 나쁜 것은, 특정 식당을 위해 수천 개의 가짜 계정을 만들어 "별 5개!"라고 쓰거나, 경쟁사를 위해 "별 1개!"라고 쓰는 일련의 봇 집단이 존재하는 상황입니다.
- 실제 상황:
- 구매 증명 부재: 이 시스템의 리뷰 중 95%에서 100%는 실제로 서비스를 결제하거나 사용하지 않은 사람들이 작성한 것입니다. 이는 피자를 주문하지도 않고 Yelp 리뷰를 남기는 것과 같습니다.
- "시빌(Sybil)" 공격: 연구진은 동일한 출처로부터 자금을 지원받은 가짜 리뷰어 집단(시빌)을 대규모로 발견했습니다. Base 체인의 경우, **90%**의 리뷰어가 이러한 가짜 그룹의 일부였습니다.
- 결과: 모든 가짜 리뷰를 제거하면, Base 체인의 에이전트 중 **89%**는 유효한 피드백이 전혀 없는 상태로 남게 됩니다. 그들의 "평판"은 완전히 텅 비어 있습니다.
3. "혼란스러운 점수" 문제 (의미론)
설령 리뷰가 진짜라 할지더라도, 점수 체계는 말이 되지 않습니다.
- 비유: 어떤 선생님은 "수학"을 1
10점 척도로 채점하고, 다른 선생님은 "역사"를 1100점 척도로 채점하며, 세 번째 선생님은 "체육"을 금액(예: "노력에 대해 500달러")으로 채점하는 성적표를 상상해 보세요. 만약 이 점수들을 평균 내어 "최종 성적"을 구하려 한다면, 그 숫자는 아무런 의미가 없습니다. - 실제 상황: 이 시스템은 누구나 어떤 라벨을 붙여서라도 점수를 줄 수 있도록 허용합니다. 어떤 사람은 "신뢰도"를 0~100 척도로 매기고, 어떤 사람은 "수익"을 수천 달러 단위로 매기며, 어떤 사람은 예/아니오 플래그를 사용합니다. 표준이 없기 때문에 한 에이전트의 점수를 다른 에이전트와 비교할 수 없습니다. 이는 사과와 오렌지, 그리고 토스터기를 서로 비교하는 것과 같습니다.
4. "저렴한 조작" 문제 (보안)
이 시스템은 매우 쉽게 무너질 수 있으며, 이를 조작하는 데 드는 비용은 거의 없습니다.
- 비유: 클럽 입구의 보안 요원이 수상해 보일 때만 신분증을 확인한다고 상상해 보세요. 그런데 신분증 확인 비용이 0.002달러(1센트 미만)입니다. 나쁜 놈이 커피 한 잔 값으로 수천 개의 가짜 신분증을 사서 클럽에 가짜 사람들을 투입해 분위기를 바꿀 수 있습니다.
- 실제 상황:
- 비용: 이더리움에서 리뷰 하나를 제출하는 데 드는 비용은 $0.06 미만이며, Base에서는 $0.003 미만입니다.
- 영향: 평균 점수를 계산하는 수학적 방식이 너무 단순하기 때문에, 단 하나의 가짜 리뷰만으로도 기존의 진짜 리뷰 개수와 상관없이 에이전트의 평판 점수를 완전히 바꿀 수 있습니다.
- 위험성: 이 에이전트들이 다루는 돈은 리뷰를 조작하는 비용보다 훨씬 높은 경우가 많습니다. 이는 0.003달러를 써서 1,000달러짜리 지갑을 훔치는 것과 같습니다.
결론
이 논문은 AI 에이전트를 위한 "트러스트리스(중앙 통제 없는)" 시스템이라는 아이디어는 훌륭하지만, 현재 버전의 ERC-8004는 아직 신뢰할 수 없다고 결론짓습니다.
- 등록된 대부분의 에이전트는 존재하지 않습니다.
- 대부분의 리뷰는 가짜이거나 검증되지 않았습니다.
- 점수 체계는 호환되지 않는 숫자들의 혼란 덩어리입니다.
- 시스템을 조작하는 비용이 너무 저렴합니다.
저자들은 이 시스템이 실제 비즈니스에 사용되기 전에, 결제 증명을 강제하고, 점수 부여 방식을 표준화하며, 가짜 계정을 만드는 비용을 높이도록 규칙을 다시 써야 한다고 제안합니다. 그때까지 이 "신뢰 계층(Trust Layer)"은 "신뢰의 환상"에 불과합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.