← 최신 논문
🤖 AI

The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems

이 논문은 급변하는 생태계를 추적하는 데 따르는 과제를 해결하기 위해 30개의 최첨단 AI 에이전트의 기원, 역량 및 안전 기능을 기록한 종합적인 자료인 2025 AI 에이전트 인덱스를 소개하며, 동시에 안전 및 사회적 영향에 관한 개발자의 투명성 측면에서 나타나는 상당한 격차를 밝혀낸다.

원저자: Leon Staufer, Kevin Feng, Kevin Wei, Luke Bailey, Yawen Duan, Mick Yang, A. Pinar Ozisik, Stephen Casper, Noam Kolt

게시일 2026-06-30
📖 4 분 읽기☕ 가벼운 읽기

원저자: Leon Staufer, Kevin Feng, Kevin Wei, Luke Bailey, Yawen Duan, Mick Yang, A. Pinar Ozisik, Stephen Casper, Noam Kolt

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

인공지능의 세계를 북적이고 혼란스러운 건설 현장이라고 상상해 보십시오. 수년 동안 우리는 노동자들(AI 모델)이 설계도를 읽고 시멘트를 섞는 법을 배우는 과정을 지켜봐 왔습니다. 하지만 최근, 새로운 존재가 도착했습니다. 바로 AI 에이전트입니다. 이들을 단순한 노동자가 아니라, 직접 도구를 집어 들고, 문을 열고, 인간의 도움을 거의 받지 않고도 스스로 무언가를 만들기 시작하는 현장 소장이라고 생각하십시오.

문제는 무엇일까요? 건설 현장은 너무 빠르게 성장하고 있고, 이 소장들은 너무 비밀스러워서, 누가 무엇을 만들고 있는지, 얼마나 안전한지, 혹은 규칙을 잘 따르고 있는지 아무도 알 수 없다는 점입니다.

이 논문, **"2025 AI 에이전트 인덱스(The 2025 AI Agent Index)"**는 연구팀이 안전모를 쓰고 현장에 들어가 상세한 재고 조사를 수행한 것과 같습니다. 그들은 단순히 소장의 숫자만 센 것이 아니라, 그들의 도구 상자를 들여다보고 안전 매뉴얼을 읽으려 노력했습니다.

그들이 발견한 내용을 알기 쉽게 설명해 드립니다.

1. "누가 누구인가" 리스트

연구진은 현재 사용 중인 가장 인기 있고 강력한 30개의 AI 에이전트를 조사했습니다. 그들은 단순히 질문에 답하는 챗봇만을 본 것이 아니라, 항공권을 예약하거나, 코드를 작성하거나, 비즈니스 워크플로우를 관리하거나, 물건을 구매하기 위해 웹을 탐색하는 등 실제로 행동할 수 있는 시스템을 살펴보았습니다.

연구진은 이 30개의 에이전트를 세 가지 주요 "동네"로 분류했습니다.

  • 채팅 동네 (12개 에이전트): 이들은 채팅창에서 대화하는 유능한 비서와 같지만, 다른 앱과 도구를 열 수 있는 특별한 열쇠를 가지고 있습니다.
  • 브라우저 동네 (5개 에이전트): 이들은 여러분의 웹 브라우저 안에 거주하는 디지털 직원과 같습니다. 이들은 인간이 하는 것처럼 버튼을 클릭하고, 양식을 채우고, 웹사이트를 탐색하며, 종종 여러분이 모든 단계를 지켜보지 않아도 스스로 움직입니다.
  • 엔터프라이즈 동네 (13개 에이전트): 이들은 대기업을 위한 "현장 소장 빌더"입니다. 기업이 인사(HR), 영업, 또는 IT 지원과 같은 업무를 자동으로 처리할 수 있도록 디지털 작업자 팀을 구성할 수 있는 플랫폼입니다.

2. "블랙박스" 문제 (투명성)

이 논문에서 가장 놀라운 점은 얼마나 많은 정보가 누락되었는가 하는 점입니다. 만약 여러분이 자동차를 샀는데, 제조사가 다음과 같은 정보를 알려주기를 거부한다고 상상해 보십시오.

  • 브레이크가 어떻게 작동하는지.
  • 이 차가 충돌 테스트를 통과했는지.
  • 엔진이 과열되면 어떻게 되는지.
  • 사고가 났을 때 누가 책임을 지는지.

이것이 바로 연구진이 AI 에이전트에서 발견한 모습입니다.

  • 안전 비밀: "해킹에 대비해 테스트를 했는가?"와 같은 안전 관련 질문에 대해, 약 **56%**의 답변이 "모름" 또는 "공개된 정보를 찾을 수 없음"이었습니다.
  • "세이프티 워싱(Safety-Washing)" 효과: 일부 기업들은 마케팅에서 안전함을 강조하지만, 연구진이 실제 테스트 결과나 안전 보고서를 찾으려 했을 때 선반은 비어 있었습니다. 이는 마치 식당이 "우리 동네에서 가장 건강한 식당"이라고 주장하면서 정작 위생 검사 점수는 보여주기를 거부하는 것과 같습니다.
  • 정체성 위기: 대부분의 에이전트는 자신이 로봇이라는 사실을 사람들에게 알리지 않습니다. 브라우저 에이전트가 웹사이트를 탐색할 때, 웹사이트는 종-종 이를 인간 사용자로 인식합니다. 아주 극소수만이 "안녕하세요, 저는 AI입니다"라고 적힌 "디지털 신분증"을 가지고 있습니다.

3. "머리 세 개 달린 괴물" (누가 무엇을 통제하는가?)

논문은 이 에이전트들이 샌드위치처럼 층층이 쌓여 구축된다고 설명하며, 이 때문에 누가 주도권을 쥐고 있는지 알기 어렵다고 말합니다.

  • 빵 (파운데이션 모델): 이것은 두뇌(GPT, Claude, Gemini 등)입니다. 소수의 거대 기업만이 이를 만듭니다.
  • 속재료 (에이전트 빌더): 이것은 중간 계층(Microsoft Copilot Studio나 Zapier 등)으로, 두뇌에게 무엇을 할지 지시합니다.
  • 맨 위의 빵 (사용자/기업): 이것은 에이전트를 실제로 사용하는 사람이나 기업입니다.

연구진은 이 계층들이 서로 다른 회사에 의해 만들어지기 때문에, 아무도 전체 그림을 볼 수 없다는 것을 발견했습니다. 두뇌를 만든 회사는 빌더가 무엇을 하는지 모르고, 빌더는 사용자가 그것을 정확히 어떻게 배포하는지 모릅니다. 이는 문제가 발생했을 때 "책임 전가 게임"을 만듭니다.

4. 웹 위의 "서부 개척 시대"

논문은 주요한 갈등 상황을 강조합니다: 브라우저 에이전트들이 인터넷의 규칙을 깨뜨리고 있다는 점입니다.
수십 년 동안 웹사이트들은 컴퓨터 프로그램(크롤러)이 들어올 수 있는 곳과 없는 곳을 알려주는 robots.txt라는 "출입 금지" 표지판을 운영해 왔습니다.

  • 과거의 방식: 웹사이트가 "크롤링 금지"라고 하면, 예의 바른 로봇들은 멈춥니다.
  • 에이전트의 방식: 많은 새로운 에이전트들은 인간처럼 행동하도록 설계되었습니다. 이들은 종종 "출입 금지" 표지판을 무시하고, 보안 검사를 우회하며, 무언가를 수행하기 위해 사람인 척 위장합니다.
  • 결과: 이는 법적 분쟁을 일으키고 있습니다. 아마존(Amazon)과 퍼플렉시티(Perplexity) 같은 기업들은 AI 에이전트가 허가 없이 사이트를 쇼핑하거나 탐색할 권리가 있는지에 대해 서로 소송을 벌이고 있습니다.

5. "빅 3" 의존성

이 30개의 에이전트 중 거의 대부분은 단 세 종류의 두뇌 가족에 의존하고 있습니다: OpenAI의 GPT, Anthropic의 Claude, 그리고 Google의 Gemini입니다.

  • 비유: 30개의 서로 다른 자동차 브랜드가 있지만, 모두 동일한 세 곳의 제조사에서 만든 엔진을 사용한다고 상상해 보십시오. 만약 그 엔진 제조사 중 하나에 문제가 생기거나, 생산을 중단하거나, 가격을 변경한다면, 30개의 자동차 브랜드 모두가 곤경에 처하게 됩니다. 이는 엄청난 집중 위험을 초래합니다.

결론

"2025 AI 에이전트 인덱스"는 현재 어둠 속에서 운영되고 있는 급성장하는 기술의 스냅샷입니다.

연구진이 이 에이전트들이 "나쁘다"고 말하는 것이 아니라, 우리가 눈을 가린 채 비행하고 있다고 말하는 것입니다. 우리는 우리를 대신해 행동할 강력한 도구를 가졌지만, 그들을 위한 명확한 규칙, 안전 보고서, 또는 신원 확인 절차를 갖추지 못했습니다. 논문은 만약 우리가 이 에이전트들을 안전하고 신뢰할 수 있게 만들고 싶다면, "현장 소장"들이 자신의 작업 내용을 보여주기 시작해야 하며, "건설 현장"에 더 나은 표지판이 필요하다고 제언합니다.

요약하자면: 우리는 자율적인 로봇 부대를 구축했지만, 대부분의 로봇은 번호판도 없고, 안전 점검도 받지 않았으며, 자신이 로봇이라는 사실조차 아무에게도 알리지 않은 채 운전하고 있습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →