← 최신 논문
💬 NLP

KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization

KAPSO는 git 기반의 실험 엔진, 구조화된 지식 시스템, 그리고 인지 메모리 계층을 통합하여 코드 산출물을 반복적으로 개선하고 코딩 에이전트의 장기적 실패를 극복함으로써 자율적인 프로그램 합성 및 최적화를 강화하는 모듈형 지식 기반 프레임워크입니다.

원저자: Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani

게시일 2026-02-03
📖 4 분 읽기☕ 가벼운 읽기

원저자: Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 복잡한 기계, 예를 들어 고성능 레이스 카를 만들려고 한다고 상상해 보세요. 하지만 단 하나의 설계도도 가지고 있지 않습니다. 대신 당신에게는 "가능한 가장 빠른 차를 만든다"라는 목표가 있습니다.

과거에는, 만약 당신이 똑똑한 컴퓨터 비서(AI 코딩 에이전트)에게 이것을 만들어 달라고 요청했다면, 그 AI는 자동차 전체를 한 번에 작성하려고 했을 것입니다. 만약 엔진이 걸리지 않는다면, AI는 혼란에 빠지거나, 이전에 시도했던 것을 잊어버리거나, 똑같은 실수를 반복해서 저지르게 될 것입니다. 그것은 마치 어제 어떤 도구를 사용했는지 계속 까먹는 건축가와 같습니다.

KAPSO는 소프트웨어를 구축하는 방식을 바꾸는 새로운 프레임워크입니다. KAPSO는 AI에게 "코드를 쓰고 끝내라"라고 명령하는 대신, 코딩을 장기적인 과학 실험으로 취급합니다. KAPSO는 단순히 코드를 쓰는 것이 아니라, 수천 번의 작은 테스트를 실행하고, 완벽한 기록을 유지하며, 무엇이 효과적이었는지 기억함으로써 더 잘 쓰는 법을 배웁니다.

KAPSO가 어떻게 작동하는지 세 가지 간단한 부분으로 나누어 설명하겠습니다.

1. "Git 네이티브" 실험 노트 (실험 엔진)

모든 실험을 단 하나도 버리지 않는 과학자를 상상해 보세요. 새로운 아이디어를 시도할 때마다, 그들은 단순히 종이에 휘갈겨 쓰는 것이 아니라, 완전히 새롭고 격리된 노트(하나의 "브랜치")를 엽니다.

  • KAPSO가 하는 일: AI가 코드를 수정하거나 개선하려고 시도할 때마다, KAPSO는 버전 관리 시스템(Git과 같은)에서 별도의 안전한 "브랜치"를 생성합니다.
  • 왜 중요한가: 만약 실험이 실패하더라도, AI는 정신을 잃지 않습니다. AI는 그 특정 노트를 다시 살펴보고, 정확히 무엇이 잘못되었는지 확인한 뒤, 원래의 작업을 망가뜨리지 않고 다른 경로를 시도할 수 있습니다. 이는 마치 탐정이 모든 단서에 대해 사건 파일을 보관하는 것과 같이 완벽한 이력을 유지합니다.

2. "슈퍼 사서" (지식 시스템)

당신이 그 레이스 카를 만들고 있는데, 엔진에 관한 모든 자동차 매뉴얼, 모든 공학 교과서, 그리고 모든 블로그 포스트가 담긴 도서관을 이용할 수 있다고 상상해 보세요.

  • KAPSO가 하는 일: AI는 그냥 추측하지 않습니다. KAPSO는 수천 개의 실제 코드 저장소, 과학 논문, 내부 가이드를 읽어내는 "지식 시스템"을 가지고 있습니다. 그리고 이 방대한 양의 정보를 구조화된 지도("지식 그래프")로 정리합니다.
  • 왜 중요한가: AI가 막혔을 때, 단순히 환각(hallucination)을 일으켜 해결책을 내놓는 것이 아닙니다. AI는 사서에게 묻습니다. "이런 서스펜션 시스템을 이전에 만들어 본 사람이 있나요? 무엇이 효과적이었나요?" AI는 특정하고 검증된 아이디어를 불러와 현재 프로젝트에 붙여넣음으로써, 무작위적인 추측이 아닌 전문가 수준의 엔지니어링을 사용하도록 보장합니다.

3. "기억 코치" (인지 메모리)

당신의 연습 과정을 지켜보는 코치를 상상해 보세요. 당신이 똑같은 돌에 세 번 걸려 넘어졌을 때, 코치는 단순히 "다시 해봐"라고 말하지 않습니다. 대신 "헤이, 지난 화요일을 기억해 봐. 네가 시계를 보느라 그 돌에 걸렸던 거야. 다음번에는 트랙을 봐"라고 말합니다.

  • KAPSO가 하는 일: KAPSO는 모든 성공적이거나 실패한 실험으로부터 얻은 "학습된 교훈"을 저장하는 "인지 메모리"를 가지고 있습니다. AI는 특정 오류 패턴(예: "데이터가 비어 있을 때 이 코드가 충돌함")과 성공적인 기술들을 기억합니다.
  • 왜 중요한가: 이것은 AI가 똑같은 실수를 두 번 하지 않도록 막아줍니다. 만약 실패한다면, AI는 즉시 이전 시도의 "교훈"을 회상하고 전략을 조정합니다. 이는 길고 좌절스러운 오류의 반복을 빠르고 스마트한 학습 곡선으로 바꿉니다.

이 모든 것이 함께 작동하는 방식

KAPSO는 **"Evolve(진화)"**라고 불리는 루프로 실행됩니다:

  1. Ideate (구상): AI가 목표를 보고 사서에게 아이디어를 요청합니다.
  2. Build (구축): AI는 안전하고 격리된 "브랜치"에서 코드를 작성합니다.
  3. Test (테스트): AI는 엄격한 "Evaluator(평가자, 자동차가 충분히 빠른지 확인하는 심판)"를 대상으로 코드를 실행합니다.
  4. Learn (학습): 만약 실패하면, 코치가 개입하여 로그를 검토하고 AI에게 다음에 무엇을 수정해야 할지 알려줍니다.
  5. Repeat (반복): 코드가 완벽해질 때까지 이 과정을 반복합니다.

결과: 효과가 있었는가?

논문에서는 KAPSO(결과에서는 이를 "Leeroo"라고 부름)를 두 가지 매우 까다로운 영역에서 다른 최고 수준의 AI 코딩 에이전트들과 비교 테스트했습니다.

  • MLE-Bench (머신러닝 경진대회): 이것을 무언가를 예측하기 위한 최적의 AI 모델을 만드는 콘테스트라고 생각하세요. KAPSO는 모든 오픈 소스 에이전트를 제쳤으며, 특히 가장 어려운 과제에서 두드러졌습니다. 다른 에이전트들이 복잡한 문제로 고전하는 동안, KAPSO는 계속해서 개선하며 훨씬 높은 점수에 도달했습니다.
  • ALE-Bench (휴리스틱 최적화): 이것을 엄격한 시간 제한 내에서 최선의 솔루션을 찾아야 하는 수학 퍼즐 콘테스트라고 생각하세요. KAPSO는 이전 최고 에이전트(ALE-Agent)보다 더 높은 점수를 달성하면서도, 실제로 컴퓨팅 파워에 드는 비용은 더 적게 사용했습니다.

핵심 요약

KAPSO는 단순히 코드를 작성하는 도구가 아니라, 소프트웨어 구축의 전체 라이프사이클을 관리하는 시스템입니다. 완벽한 기록 유지 시스템, 방대한 인간 지식의 도서관, 그리고 실수로부터 배우는 기억력을 결 조합함으로써, KAPSO는 코딩의 혼란스러운 과정을 신뢰할 수 있는 단계별 최적화 루프로 변화시킵니다. 이는 어려운 문제에 있어서, 비밀은 단순히 코드를 더 빨리 쓰는 것이 아니라, 모든 시도로부터 배우는 방법을 아는 것임을 증명합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →