← 최신 논문
💻 computer science

Token Budgets: An Empirical Catalog of 63 LLM-Agent Budget-Overrun Incidents, with an Affine-Typed Rust Mitigation as a Case Study

이 논문은 63가지의 LLM 에이전트 토큰 예산 초과 사례에 대한 경험적 카탈로그를 제시하고, 어파인 소유권(affine ownership)을 활용하여 컴파일 타임에 우회 불가능한 지출 제한을 강제함으로써 임시적인 런타임 솔루션들이 겪는 위임 관련 비용 폭발 문제를 효과적으로 방지하는 타입 안전한 Rust 크레이트인 "token-budgets"를 소개한다.

원저자: Sajjad Khan

게시일 2026-06-04
📖 4 분 읽기☕ 가벼운 읽기

원저자: Sajjad Khan

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

문제점: AI의 "무한 동전 생성 버그"

당신이 로봇 비서에게 일을 시킨다고 상상해 보세요. 당신은 로봇에게 엄격한 규칙을 하나 줍니다. "내 신용카드로 10달러 이상 쓰지 마."

하지만 로봇은 혼란에 빠집니다. 로봇은 문제를 해결하기 위해 계속해서 같은 행동을 반복하는 루프(loop)에 갇히게 됩니다. 왜냐하면 로봇에게는 전화를 걸기 전에 가격을 확인하는 내장된 "정지 버튼"이 없기 때문에, 로봇은 계속해서 돈을 씁니다. 다음 날 아침 당신이 일어났을 때, 로봇은 단순히 10달러를 쓴 것이 아니라 무려 10,000달러를 써버린 상태가 됩니다.

이 논문은 이를 **"예산 초과(Budget Overrun)"**라고 부릅니다. 저자들은 2023년에서 2026년 사이 다양한 AI 프레임워크에서 이 현상이 발생한 63가지의 실제 사례를 발견했습니다. 어떤 경우에는 소프트웨어가 지출이 발생하기 전에 소비를 중단하지 못해 사용자들이 수천 달러를 잃기도 했습니다.

현재의 해결책: "사후 처방형" 알람

현재 대부분의 기업은 로봇이 이미 호출을 마친 후에 지출을 감시하는 "보안 요원"을 배치하는 방식으로 이 문제를 해결하려 합니다.

  • 비유: 당신이 가게에 가서 물건 1,000개를 샀는데, 계산원이 문 앞에서 당신을 막아서며 "잠깐, 한도를 초과했습니다!"라고 말하는 것과 같습니다. 당신은 이미 집어 든 물건값을 지불해야 하거나, 다시 선반으로 달려가 물건을 내려놓아야 합니다.
  • 논문의 핵심: 이러한 현재의 해결책들은 너무 느립니다. 실수를 잡아내기는 하지만, 피해를 예방하지는 못합니다.

새로운 해결책: "마법의 지갑" (토큰 예산)

저자들은 **토큰 예산(Token Budgets)**이라는 새로운 도구를 만들었습니다 (Rust라는 프로그래밍 언어로 작성되었습니다). 보안 요원이 지출을 감시하는 대신, 그들은 지갑 자체를 바꾸었습니다.

비유:
당신이 로봇에게 정확히 10달러의 현금이 들어 있는 실물 지갑을 준다고 상상해 보세요.

  1. 복제 불가: 이 지갑은 복사할 수 없는 특수 재질로 만들어졌습니다. 로봇은 1,000달러를 쓰기 위해 지갑을 100개로 복사할 수 없습니다.
  2. 이중 지출 불가: 로봇이 무언가를 사기 위해 1달러 지폐를 꺼내면, 그 돈은 사라진 것입니다. 로봇은 똑같은 지폐를 다시 주머니에 넣고 또 사용할 수 없습니다.
  3. 공유 불가: 만약 로봇이 지갑을 두 개의 작은 지갑으로 나누어 두 명의 조력자에게 준다면, 원래의 지갑은 사라집니다. 조력자들은 원래의 지갑으로 돌아가 더 많은 돈을 가져갈 수 없습니다.

컴퓨터 코드의 세계에서 이것을 **"어파인 소유권(Affine Ownership)"**이라고 부릅니다. 이는 로봇이 집을 나서기도 전에 컴퓨터가 규칙을 확인하도록 강제합니다. 만약 로봇이 규칙을 어기려고 하면(지갑을 복사하는 등), 컴퓨터는 프로그램 실행 자체를 거부합니다. 이는 클럽 입구에서 신분증을 검사하는 바운서와 같습니다. 신분증이 없다면 술을 주문하기 위해 바에 접근조차 할 수 없습니다.

그들이 실제로 증명한 것

이 논문은 주의 깊게 테스트한 세 가지 주요 주장을 제시합니다.

  1. 실패의 목록: 그들은 AI 에이전트가 과도한 지출을 했던 63가지 구체적인 사건을 기록한 "오욕의 전당(Hall of Shame)"을 만들었습니다. 또한 개발자들이 "우리는 아직 이를 막을 방법이 없다"라고 인정한 47가지 사례를 추가로 발견했습니다. 이는 문제가 실재하며 자주 발생한다는 것을 증명합니다.
  2. "마법의 지갑"은 작동한다: 그들은 자신들의 새로운 Rust 도구를 다섯 가지의 다른 인기 있는 AI 비용 관리 방식과 테스트했습니다.
    • 결과: 시스템을 속여 과다 지출하게 만들려고 시도했을 때(두 에이전트가 동시에 같은 돈을 쓰려고 하는 레이스 컨디션 상황을 조성), 다른 시스템들은 100% 실패했습니다. 반면, 새로운 "마법의 지갑" 시스템은 0번 실패했습니다.
    • 이유는? 다른 시스템들은 프로그래머가 이중 지출을 방지하기 위한 "잠금(lock)"을 작성하는 것을 기억해야 합니다. 만약 프로그래머가 이를 잊으면 돈이 새어나갑니다. 새로운 시스템은 프로그래머가 규칙을 따르도록 강제하며, 그렇지 않으면 코드가 컴파일되지 않습니다(작동하는 프로그램으로 변환되지 않습니다).
  3. 모든 것에 통하는 마법의 탄환은 아니다: 저자들은 한계점에 대해 매우 솔직합니다.
    • Rust에서만 작동함: 이 특정 "마법의 지갑"은 소프트웨어를 Rust 프로그래밍 언어로 작성할 때만 작동합니다. Python이나 JavaScript에서는 작동하지 않습니다 (단, 일반적인 보안 요원처럼 작동하는 Python 버전도 만들긴 했습니다).
    • AI 기업에 의존함: 이 시스템은 작업 비용을 추정합니다. 만약 AI 기업(OpenAI나 Anthropic 등)이 말한 것보다 더 많은 금액을 청구하거나, 일부 "사고 과정(thinking)" 비용을 숨긴다면 시스템은 여전히 혼란을 겪을 수 있습니다. 시스템은 받은 청구서를 신뢰하지만, 만약 청구서 자체가 틀렸다면 지갑은 바닥날 수 있습니다.

결론

이 논문은 다음과 같이 말합니다: "AI 에이전트는 실수로 당신의 계좌를 탕진할 수 있기 때문에 현재 위험합니다. 우리는 이와 관련된 63가지 사례를 발견했습니다. 우리는 엄격한 컴퓨터 규칙을 사용하여 코드가 실수로 돈을 복제하거나 이중으로 지출하는 것을 불가능하게 만드는 새로운 도구를 만들었습니다. 이 도구는 이러한 특정 유형의 실수를 방지하는 데 완벽하게 작동하지만, 오직 Rust 프로그래밍 언어를 사용하고 AI 기업이 가격에 대해 정직할 때만 유효합니다."

요약하자면: 그들은 단순히 더 나은 알람 시스템을 만든 것이 아니라, 물리적으로 도난당하거나 복제될 수 없는 지갑을 만든 것입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →