← 최신 논문
💻 computer science

Reducing Token Usage of State-in-Context Agents using Minification

이 논문은 state-in-context 에이전트 프레임워크의 재현을 제시하며, 코드 축소(minification) 기술을 적용하는 것이 해상도율(resolution rate)의 12퍼센트 포인트 하락을 대가로 입력 토큰 사용량을 42% 감소시킨다는 것을 입증함으로써, 더 비용 효율적인 소프트웨어 엔지니어링 에이전트를 위한 유망한 절충안을 제공한다.

원저자: Nicolas Hrubec, Jürgen Cito

게시일 2026-06-02
📖 3 분 읽기☕ 가벼운 읽기

원저자: Nicolas Hrubec, Jürgen Cito

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 고장 난 기계를 고치기 위해 매우 유능하지만 비용이 아주 많이 드는 컨설턴트를 고용한다고 상상해 보십시오. 이 기계는 거대하고 복잡한 소프트웨어 프로그램(코드베이스)이며, 컨설턴트는 AI입니다.

AI가 매뉴얼의 한 구절이나 설계도의 한 페이지를 읽을 때마다 비용이 발생합니다. AI가 읽어야 하는 페이지가 많아질수록 청구 금액은 올라갑니다.

문제점: 너무 많은 서류 작업

연구진들은 AI 에이전트들이 소프트웨어 버그를 수정하려고 할 때 서류 더미에 파묻힌다는 사실을 발견했습니다. 그들은 실제 코드라는 "설계도"를 읽는 데 전체 비용의 약 **90%**를 소비합니다. 지침이나 살펴봐야 할 파일 목록은 그에 비해 아주 미미합니다.

이는 마치 탐정에게 범죄를 해결하라고 고용해 놓고, 정작 범죄 현장을 보기 전에 도시의 전화번호부 전체를 읽게 강요하는 것과 같습니다. 탐정은 지치고, 청구서는 엄청나게 불어나며, 너무 많은 텍스트 양에 압도되어 단서를 놓칠 수도 있습니다.

해결책: "Minification" (축소 광선)

이 논문은 **Minification(최소화)**이라는 기술을 소개합니다. 이것을 코드를 위한 "축소 광선"이라고 생각하십시오.

소프트웨어의 세계에서 코드는 종로 종종 여백, 주석(인간을 위한 메모), 그리고 calculate_total_revenue_for_the_month와 같은 긴 변수명을 포함합니다. 이것들은 인간이 읽기에는 좋지만, 컴퓨터에게는 그저 "군더더기"일 뿐입니다.

연구진들은 AI에게 코드를 보내기 전에 이 코드를 "축소"하기 위해 일련의 변환 과정을 적용했습니다:

  1. 군더더기 제거: 빈 줄, 주석, 문서화를 제거했습니다.
  2. 압축하기: 수학 기호 주변의 불필요한 공백을 제거했습니다 (예: a + ba+b로 변경).
  3. 이름 줄이기: 긴 변수명을 짧은 것으로 변경했습니다 (calculate_total_revenue_for_the_monthx로 변경).
    • 중요한 세부 사항: AI가 혼란을 느끼지 않도록, 연구진은 x가 실제로 calculate_total_revenue_for_the_month를 의미한다는 것을 알려주는 "번역 사전"을 함께 제공했습니다.

실험: 축소 광선은 효과가 있는가?

연구팀은 100개의 실제 소프트웨어 버그를 다루는 표준화된 테스트인 SWE-bench를 통해 이를 테스트했습니다. 그들은 강력한 AI 모델인 GPT-5-mini를 사용하여 이 버그들을 수정하도록 했습니다.

결과:

  • 좋은 소식: "축소 광선"은 비용을 절감하는 데 놀라운 효과를 보였습니다. AI가 읽어야 할 텍스트 양을 42% 줄였습니다. 이는 비용 측면에서 엄청난 감소입니다.
  • 나쁜 소식: AI의 문제 해결 능력은 다소 떨어졌습니다. 성공률이 12%포인트 하락했습니다 (성공률 50%에서 38%로 감소).

트레이드오프(Trade-off):
이 논문은 코드를 축소함으로써 많은 돈을 아낄 수 있지만, AI가 해결하는 문제의 수가 줄어든다는 점을 받아들여야 한다고 결론짓습니다. 이는 효율성(비용)과 효과성(성공률) 사이의 절충안입니다.

큰 주의사항: "들여쓰기" 함정

특히 문제를 일으켰던 특정 유형의 축소가 있었습니다: 바로 **Dedentation(들여쓰기 제거)**입니다.

파이썬(Python) 코드는 명령어를 어떻게 그룹화할지 알기 위해 들여쓰기(줄 시작 부분의 공백)에 의존합니다. 연구진은 토큰을 아끼기 위해 공백 수를 줄이려고 시도했습니다.

  • 발생한 현상: AI가 혼란을 겪었습니다. AI가 보기에는 올바른 것처럼 보이는 수정안을 작성했지만, 실제로는 공백이 잘못되어 깨진 코드가 되었습니다.
  • 비유: 이는 요리사에게 "양파를 다지세요"라고 말하면서, 어떻게 칼을 잡아야 하는지에 대한 지침을 제거한 것과 같습니다. 요리사는 시도하지만, 결과물은 엉망이 됩니다.
  • 해결책: 논문은 만약 이 방법을 사용하고 싶다면, AI가 답을 작성한 후에 공백을 자동으로 수정해 주는 "안전망"이 필요하다고 제안합니다. 이 안전망 없이는 성공률이 급락합니다.

요 요약

이 논문은 코드를 필수적인 요소로만 압축함으로써 AI 소프트웨어 엔지니어를 훨씬 저렴하게 만들 수 있음을 보여줍니다.

  • 비용: 크게 감소합니다 (읽어야 할 텍스트 42% 감소).
  • 성능: 완만하게 감소합니다 (버그 해결 건수 12% 감소).
  • 주의사항: 코드가 의미를 갖추기 위해 필요한 "문법"(들여쓰기)을 제거할 때는 매우 주의해야 합니다.

연구진은 다른 사람들이 자신의 소프트웨어 프로젝트에 이 "축소 광선"을 시도해 볼 수 있도록 도구를 GitHub에 공개했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →