← 최신 논문
🤖 AI

Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable

이 논문은 고수준의 행동 요구사항을 특정 소스 코드 위치로 자동 매핑함으로써 로컬라이제이션 병목 현상을 극복하고 복잡한 AI 에이전트 하네스의 진화 효율성과 품질을 향상시키는, 행동 중심 표현 방식인 Harness Handbook과 행동 유도 점진적 공개(BGPD) 방법을 소개한다.

원저자: Ruhan Wang, Yucheng Shi, Zongxia Li, Zhongzhi Li, Yue Yu, Junyao Yang, Kishan Panaganti, Haitao Mi, Dongruo Zhou, Leoweiliang

게시일 2026-07-16
📖 3 분 읽기☕ 가벼운 읽기

원저자: Ruhan Wang, Yucheng Shi, Zongxia Li, Zhongzhi Li, Yue Yu, Junyao Yang, Kishan Panaganti, Haitao Mi, Dongruo Zhou, Leoweiliang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 방금 아주 똑똑한 로봇 비서를 만들었다고 상상해 보세요. 당신은 로봇에게 거대한 AI 모델인 '두뇌'를 주고 이렇게 명령했습니다. "가서 내 컴퓨터를 고쳐!" 하지만 두뇌만으로는 충분하지 않습니다. 로봇에게는 몸체와 신경계, 그리고 손가락을 어떻게 움직이고, 드라이버를 어떻게 잡으며, 언제 작업이 끝났는지 아는 법에 대한 지침이 필요합니다. AI의 세계에서 이 '몸과 신경계'를 **하네스(harness)**라고 부릅니다. 이것은 AI에게 언제 말해야 하는지, 언제 도구를 사용해야 하는지, 그리고 방금 무엇을 했는지 어떻게 기억할지를 알려주는 소프트웨어 계층입니다.

이제, 그 로봇을 업그레이드하고 싶다고 상상해 봅시다. 예를 들어, 파일을 삭제하기 전에 더 신중하게 행동하도록 만들거나, 혹은 작업을 한 번 확인하는 대신 세 번 확인하도록 만들고 싶을 수 있습니다. 옛날 방식이라면, 인간 프로그래머가 로봇의 신경계 중 정확히 어디에 "작업을 확인하라"는 규칙이 숨겨져 있는지 알아내기 위해 수천 줄의 코드를 뒤져야 했을 것입니다. 이는 마치 지도 없이 거대하고 엉킨 실타래 속에서 특정 신경 하나를 찾아내려는 것과 같습니다. 코드는 종종 여러 다른 파일에 흩어져 있고, 다른 로직과 뒤섞여 있어 추적하기 어렵습니다. 만약 단 한 군데라도 놓친다면, 당신의 로봇은 실수로 파일을 삭제할 수도 있습니다. 이 논문은 이러한 숨겨진 지점들을 찾아내어 우리의 AI 조력자들을 안전하게 업그레이드할 수 있도록 하는 좌절스러운 문제를 다룹니다.

Ruhan Wang과 동료들이 이끄는 연구진은 가장 큰 병목 현상이 AI에게 변화를 만드는 방법을 가르치는 것이 아니라, 인간(또는 다른 AI 에이전트)이 어디에서 변화를 만들어야 할지를 파악하도록 돕는 것이라는 점을 깨달았습니다. 그들은 이 문제를 **행동 국소화(behavior localization)**라고 부릅니다. 이를 해결하기 위해 그들은 **하네스 핸드북(Harness Handbook)**이라는 것을 발명했습니다.

하네스 핸드북을 단순히 파일 목록이 아니라, 로봇의 행동에 대한 사용자 매뉴얼이라고 생각하십시오. 정보를 "파일 A, 파일 B, 파일 C"(코드가 보통 저장되는 방식)로 정리하는 대신, 핸드북은 "로봇이 실제로 무엇을 하는가"를 기준으로 정보를 정리합니다. 이는 마치 "만약 로봇이 '작업 완료' 신호를 처리하는 방식을 바꾸고 싶다면, 그 신호가 처리되는 세 가지 특정 위치는 여기이며, 이들이 서로 어떻게 통신하는지는 다음과 같다"라고 적힌 가이드북을 가진 것과 같습니다.

연구팀은 로봇의 코드를 읽고 스마트한 AI를 사용하여 연결 관계를 매핑함으로써 이 핸드북을 자동으로 생성하는 시스템을 구축했습니다. 이 지도를 사용하는 방법을 그들은 **행동 유도 점진적 공개(Behavior-Guided Progressive Disclosure)**라고 부릅니다. 당신이 복잡한 시계를 고치려고 노력하고 있다고 상상해 보십시오. 500개의 톱니바퀴와 스프링 더미를 멍하니 바라보는 대신, 당신은 먼저 "시간 알림" 섹션을 보여주고, 그다음 "시침" 톱니바퀴로 줌인하며, 마지막으로 돌려야 할 정확한 나사를 강조해 주는 매뉴얼을 펼칩니다. 핸드북은 AI 코드에 대해 이와 같이 작동합니다. 즉, 시스템이 무엇을 하는지에 대한 높은 수준의 개요에서 시작하여, 사용자를 편집이 필요한 구체적인 코드 라인까지 안내합니다.

연구진은 이 아이디어를 두 가지 실제 AI 시스템(Terminus-2 및 Codex)에 대해 테스트했습니다. 그들은 코딩 에이전트들에게 "작업 점수를 매기기 전에 확인 요청을 세 번 하도록 만들어라"와 같은 간단한 요청을 바탕으로 변경을 수행하도록 했습니다. 그들은 두 그룹을 비교했습니다. 한 그룹은 전통적인 방식(파일 검색)으로 코드를 찾아야 했고, 다른 그룹은 하네스 핸드북을 사용했습니다.

결과는 명확했습니다. 핸드북을 사용한 그룹은 편집할 적절한 지점을 찾는 데 훨씬 더 뛰어났습니다. 그들은 실수를 덜 저질렀고, 건드리지 말아야 할 것을 실수로 변경하는 일도 없었으며, 이 모든 과정을 더 적은 컴퓨팅 자원(AI가 생각하는 데 사용하는 화폐와 같은 '토큰')을 사용하여 수행했습니다. 핸드북은 코드가 지저ка롭거나, 여러 파일에 흩어져 있거나, 시스템의 드문 부분에 숨겨져 있을 때 특히 유용했습니다. 실제로 핸드북을 사용하는 에이전트들은 지도를 가지고 있는 덕분에 "더 약한" AI 모델이 "더 강한" 모델과 거의 대등한 성능을 낼 수 있을 정도로 코드를 잘 찾아냈습니다.

이 논문은 AI 시스템이 더 복잡해짐에 따라, 우리는 단순히 더 똑똑한 두뇌에만 의존할 것이 아니라 더 나은 지도가 필요하다고 제안합니다. 하네스 핸드북은 코드를 파일이 있는 곳이 아니라 시스템이 무엇을 하는지를 중심으로 정리한다면, 이러한 강력한 에이전트를 진화시키는 과정을 훨씬 더 안전하고, 빠르고, 신뢰할 수 있게 만들 수 있음을 증명합니다. 이는 거대한 실타래를 푸는 혼란스러운 작업을 잘 정돈된 도서관을 통한 단순하고 안내된 여정으로 바꾸어 놓습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →