Measuring agentic artificial intelligence intensity in banking: a validated disclosure-based index and identification strategy for estimating effects on bank performance and systemic risk
본 논문은 은행업계에서 자율적 AI 실행과 자문 시스템을 구분하기 위해 설계된 새로운 공시 기반 측정 도구인 에이전틱 AI 강도 지수(AAII)를 소개 및 검증하며, 해당 지수가 은행의 성과와 체계적 위험에 미치는 영향을 추정하기 위한 포괄적인 식별 전략을 개설한다.
원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
금융 세계에서 인공지능은 오랫동안 유능한 조수 역할을 해왔습니다. 수년 동안 이러한 시스템은 보고서를 초안하고, 데이터를 요약하거나, 인간 관리자가 고려해야 할 다음 최선의 단계를 제안하는 디지털 서기 역할을 수행해 왔습니다. 최종 결정의 열쇠를 쥐고 운전대를 잡고 있는 것은 여전히 인간입니다. 그러나 이제 중대한 변화가 일어나고 있습니다. 은행들이 단순히 제안하는 것을 넘어 행동하는 새로운 종류의 지능을 배치하기 시작했습니다. 이들은 복잡한 금융 워크플로우를 계획하고 위임된 권한으로 거래를 실행할 수 있는 에이전트형 시스템(agentic systems)입니다. 일단 이러한 시스템에 행동을 위한 승인이 내려지면, 이 시스템은 모든 움직임에 대해 인간의 승인을 기다리지 않고도 자금을 이동시키거나, 대출을 승인하거나, 부채를 결제할 수 있습니다. 조언에서 행동으로의 이러한 전환은 금융의 위험과 효율성의 근본적인 성격을 변화시키지만, 연구자와 규제 기관들에게는 해결되지 않은 중요한 문제가 남아 있습니다. 바로 그것을 어떻게 측정하느냐 하는 것입니다.
지금까지는 단순히 인공지능에 대해 이야기만 하는 은행과, 실제로 운영의 주도권을 자율적인 기계에 넘겨준 은행을 구별할 수 있는 신뢰할 만한 방법이 없었습니다. 기존의 방법들은 기술에 대한 모든 언급을 동일하게 취급하여, 고객의 질문에 답하는 챗봇과 독립적으로 결제를 실행하는 소프트웨어 에이전트 사이의 차이를 식별하지 못했습니다. 명확한 측정 도구가 없다면, 이러한 새로운 시스템이 은행을 더 효율적으로 만드는지, 아니면 더 위험하게 만드는지, 혹은 둘 다인지 알 수 없습니다. 인도 다야난다 사가르 대학교(Dayananda Sagar University)의 연구팀은 '에이전트형 AI 강도 지수(Agentic AI Intensity Index)'라는 새롭고 엄격하게 테스트된 도구를 개발함으로써 이 간극을 메웠습니다. 이 지수는 단순히 은행이 기술을 얼마나 자주 언급하는지를 세는 것이 아니라, 은행이 자율적인 시스템에 중대한 금융 결정을 내리고 실행할 수 있는 권한을 어느 정도까지 위임했는지를 측정합니다.
연구진은 단순히 새로운 점수를 만들어낸 것이 아니라, 그 점수가 실제적이고 신뢰할 수 있도록 보장하는 완전한 과학적 프로토콜을 구축했습니다. 그들은 먼저 연례 보고서, 규제 공시, 경영진이 투자자들과 대화하는 실적 발표 녹취록을 포함하여 은행의 수천 페이지에 달하는 공개 문서를 수집했습니다. 이 텍스트들로부터 그들은 실제 권한 위임을 설명하는 문장을 식별하는 방법을 개발했습니다. 그들은 시스템이 인간의 승인을 기다리는 상태를 설명하는 언어와, 정해진 권한 범위 내에서 스스로 행동하는 상태를 설명하는 언어를 구분했습니다. 이 구분이 정확한지 확인하기 위해 학술 연구자, 은행 기술 책임자, 중앙은행 감독관을 포함한 전문가 패널을 구성했습니다. 이 전문가들은 두 차례의 토론을 통해 키워드와 구절 목록을 정교화했으며, 어떤 용어가 진정한 자율적 행동을 나타내고 어떤 용어가 단순한 홍보용 미사여구에 불지 않는지에 대해 합의했습니다.
키워드 목록이 확정된 후, 연구팀은 이 방법이 일관되게 작동하는지 테스트했습니다. 그들은 여러 명의 훈련된 코더들이 동일한 문장들을 읽게 하여, 특정 시스템이 진정으로 자율적인지에 대해 서로 동의하는지 확인했습니다. 또한 방대한 양의 텍스트를 분류하기 위해 고급 컴퓨터 모델을 사용했지만, 결정적인 안전장치를 두었습니다. 즉, 컴퓨터가 고차원의 자율적 행동을 식별할 때마다 인간 전문가가 이를 검토하여 분류를 확인하도록 했습니다. 이러한 '인간 참여형(human-in-the-loop)' 접근 방식은 시스템이 모호하거나 오해의 소지가 있는 언어에 속는 것을 방지했습니다. 그런 다음 연구진은 이 새로운 지수가 원래 의도한 바를 제대로 측정하는지 확인하기 위해, 특정 유형의 엔지니어를 구하는 채용 공고, 자율 시스템에 대한 특허 출원, 그리고 은행이 이러한 기술을 배포한 것으로 알려진 사례 등 독립적인 증거들과 비교했습니다. 결과는 이 지수가 진정한 자율 역량을 가진 은행과 단순히 일반적인 디지털 전환을 논하는 은행을 성공적으로 분리해 냈음을 보여주었습니다.
이 작업의 핵심은 각 은행의 에이전트형 AI 도입 강도에 따라 점수를 부여하는 지수 그 자체입니다. 이 점수는 단순히 단어의 빈도를 세는 것이 아니라, 은행이 기계에 부여한 권한의 수준에 따라 가중치가 부여됩니다. 정해진 한도 내에서 결제를 실행하는 시스템은 단순히 인간의 검토를 위한 권고안을 작성하는 시스템보다 더 높은 점수를 받습니다. 연구진은 또한 어떤 은행은 기술에 대해 훨씬 더 많이 기술한다는 점을 고려하여 데이터를 정규화함으로써, 높은 점수가 단순히 말을 많이 하는 것이 아니라 진정한 권한의 위임을 반영하도록 했습니다. 이를 통해 거대한 글로벌 은행과 작은 지역 금융 기관 사이의 공정한 비교가 가능해집니다. 이 지수는 향후 다음과 같은 절박한 질문들에 답하기 위해 사용되도록 설계되었습니다. 의사결정 권한을 기계에 넘기는 것이 은행을 더 효율적으로 만드는가, 아니면 예측 불가능한 새로운 위험을 초래하는가? 이것이 은행이 사기를 더 빠르게 탐지하도록 돕는가, 아니면 새로운 취약점을 만드는가?
이 논문은 특정 결과를 측정하기보다는 측정 도구를 만드는 데 집중한 방법론적 연구이므로, 이러한 성과 질문에 대한 최종적인 답을 제공하지는 않습니다. 대신, 다른 연구자와 규제 기관이 사용할 수 있는 명확하고 반복 가능한 전략을 제시합니다. 연구진은 지수를 어떻게 구성하고, 어떻게 검증하며, 은행의 규모나 경제 상황과 같은 다른 요인들로부터 자율형 AI의 효과를 격리하기 위해 통계 모델에서 어떻게 사용하는지를 구체적으로 명시합니다. 연구진은 에이전트형 AI로의 전환이 복잡하며, 그 이득과 위험은 은행이 이러한 시스템을 얼마나 잘 거버넌스(관리)하느냐에 따라 크게 달라질 것이라고 인정합니다. 그들은 이러한 기술의 영향이 은행의 내부 감독 품질, 기술적 성숙도, 그리고 해당 은행이 운영되는 규제의 엄격함에 따라 달라질 것이라고 제안합니다.
검증된 도구를 제공함으로써, 이 연구는 금융의 미래를 이해하는 데 있어 주요한 장벽을 제거합니다. 이를 통해 금융계는 막연한 "디지털 전환"이라는 주장에서 벗어나, 머신 자율성으로 향하는 구체적이고 실질적인 변화를 측정하기 시작할 수 있습니다. 연구진은 진정한 에이전트형 행동의 신호를 일반적인 기술 논의의 소음으로부터 분리하는 것이 가능하다는 것을 보여주었습니다. 이러한 명확성은 돌이킬 수 없는 자동 결제의 위험을 이해해야 하는 감독관들과, 자신들이 자금을 지원하는 기관의 진정한 역량을 가늠하려는 투자자들에게 필수적입니다. 연구는 기술이 급속히 발전하고 있지만, 새로운 프로토콜에 명시된 엄격한 검증 단계를 준수한다면 그 도입을 정밀하게 측정하는 능력 또한 이제 손에 닿는 곳에 있다고 결론짓습니다. 이 토대는 자율 시스템의 효과를 다른 금융 혁신과 동일한 엄격함으로 연구할 수 있는, 증거 기반 분석의 새로운 시대를 위한 발판을 마련합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.