KISS Sorcar: A Stupidly-Simple General-Purpose and Software Engineering AI Assistant
KISS Sorcar 는 5 계층 계층 구조, 테스트를 통한 자체 검증, 그리고 git 격리를 활용하는 1,850 줄 규모의 최소 에이전트 프레임워크를 기반으로 구축된 무료 오픈소스 VS Code 확장 프로그램으로, 장기 소프트웨어 엔지니어링 작업에서 기존 도구인 Claude Code 와 Cursor Composer 보다 우수한 62.2% 의 Terminal Bench 2.0 통과율을 달성합니다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
상상해 보세요. Sorcar라는 이름의 천재적이고 초지능적인 인턴이 있다고 가정해 봅시다. 이 인턴은 코드 작성, 퍼즐 해결, 컴퓨터 도구 활용에 탁월한 재능을 지니고 있습니다. 하지만 어떤 인턴이든 그렇듯, 몇 가지 독특한 습관이 있습니다: 쉽게 지쳐서 '뇌 공간'이 부족해지기도 하고, 작은 실수로 하루 전체가 망가질 수도 있으며, 혼란의 루프에 갇히기도 합니다.
이 논문은 이 인턴이 무너지지 않고 진지한 소프트웨어 엔지니어링 작업을 수행할 수 있도록 관리하는 KISS Sorcar라는 시스템을 소개합니다. 'KISS'는 'Keep It Simple, Stupid(간단하게 유지하라, 바보야)'의 약자로, 이것이 핵심 철학입니다: 거대하고 복잡한 로봇 두뇌를 만드는 대신, 매우 단순하고 계층화된 관리 시스템을 구축한 것입니다.
다음은 간단한 비유를 통해 설명한 시스템의 작동 방식입니다:
1. 5 층 관리 팀
모든 일을 한 번에 처리하려는 거대한 두뇌 하나 대신, 이 시스템은 각자 하나의 특정 업무를 담당하는 다섯 명의 관리자 팀을 사용합니다. 지휘 계통을 따라 계승되는 릴레이 경주라고 생각해 보세요:
- 1 층: 주자 (KISS Agent)
이는 기본 작업자입니다. '생각하고, 행동하고, 다시 생각하라'는 간단한 규칙을 따릅니다. 엄격한 예산 (지갑과 같음) 을 가지고 있으며, 돈이나 단계가 떨어지면 중단합니다. 이는 실제로 AI 모델과 대화하는 엔진입니다. - 2 층: 메모 작성자 (Relentless Agent)
주자는 짧은 기억력 (작은 메모지) 을 가지고 있습니다. 한 페이지에 담기에는 너무 큰 작업이 있다면 메모 작성자가 개입합니다. 주자가 페이지를 채우면, 메모 작성자는 지금까지 일어난 일을 상세히 요약하고 페이지를 지운 뒤 새로운 세션을 시작합니다. 이를 통해 인턴은 처음을 잊지 않고 며칠 동안 프로젝트에 종사할 수 있습니다. - 3 층: 도구 사용자 (Sorcar Agent)
이 계층은 인턴에게 도구 상자를 제공합니다. 파일을 열고, 명령어를 입력하고, 인터넷을 검색하며, 심지어 웹 브라우저를 제어할 수도 있습니다. 이는 시스템의 '손'입니다. - 4 층: 대화 파트너 (Chat Sorcar Agent)
이 계층은 대화를 기억합니다. 오늘 인턴과 대화하고 내일 돌아오면, 이 계층은 인턴이 어제 논의한 내용을 기억하도록 보장하여 처음부터 다시 시작할 필요가 없게 합니다. - 5 층: 안전 요원 (Worktree Sorcar Agent)
이는 가장 중요한 안전 장치입니다. 인턴이 그림을 그리고 있다고 상상해 보세요. 이 계층은 원래 캔버스에 직접 그림을 그리는 대신, 연습할 수 있는 별도의 동일한 복사본('worktree') 을 제공합니다.- 실수를 저지르면 복사본만 버리면 됩니다. 원래 그림은 안전합니다.
- 잘 해내면, 그들의 변경 사항만 신중하게 원래 캔버스에 복사할 수 있습니다.
- 이는 인턴이 실수로 전체 코드베이스를 망가뜨리는 것을 방지합니다.
2. '엄격한 교사' (시스템 프롬프트)
이 논문은 AI 모델 자체가 똑똑하지만, 전문 엔지니어처럼 행동하려면 엄격한 규칙이 필요하다고 주장합니다. 제작자들은 거대한 '규칙서'(시스템 프롬프트) 를 작성하여 엄격한 교사 역할을 하게 했습니다.
단순히 "코드를 작성하라"고 말하는 대신, 규칙은 다음과 같이 말합니다:
- "쓰기 전에 읽으라": 먼저 읽지 않은 이상 절대 파일을 건드리지 마십시오.
- "수정하기 전에 테스트하라": 버그를 발견하면 그것이 고장 났음을 증명하는 테스트를 작성한 후 수정하십시오.
- "AI 쓰레기 금지": 불필요하고 쓸모없는 텍스트를 작성하지 마십시오. 직접적이고 정확하게 하십시오.
- "작업 확인": "완료했다"고 말하기 전에, 작동함을 증명하기 위해 체크리스트 (린터, 테스트, 타입 체크) 를 실행해야 합니다.
이 논문은 AI 를 늦추고 이러한 엔지니어링 습관을 따르도록 강제함으로써, 시간이 조금 더 걸리더라도 코드 품질이 극적으로 향상된다고 주장합니다.
3. 결과: 마술인가?
제작자들은 Terminal Bench 2.0이라는 어려운 벤치마크에서 KISS Sorcar 를 테스트했는데, 이는 일련의 복잡한 코딩 퍼즐과 같습니다.
- 점수: KISS Sorcar 는 작업의 **62.2%**를 해결했습니다.
- 경쟁: 동일한 기본 AI 모델을 사용하여 다른 유명한 AI 코딩 도구 (Claude Code 는 58%, Cursor Composer 2 는 61.7%) 보다 더 좋은 성적을 거두었습니다.
이 논문은 이것이 단순히 '더 똑똑한' 모델을 갖는 것보다 조직화와 규율이 더 중요하다는 것을 증명한다고 주장합니다. 단순하고 잘 관리된 시스템이 더 복잡한 시스템보다 더 뛰어난 성과를 낼 수 있습니다.
4. '자기 학습' 기능
한 가지 멋진 기능은 시스템이 사용자로부터 배운다는 점입니다. 인턴에게 "변수 이름에 카멜 케이스를 사용하는 것을 싫어한다"고 말하면, 시스템은 이를 USER_PREFS.md라는 특별한 파일에 기록합니다. 다음에 도움을 요청할 때, 인턴은 이 규칙을 자동으로 기억합니다. 마치 인턴이 서서히 사용자의 개인적인 코딩 스타일을 완벽하게 모방하는 복제본이 되어가는 것과 같습니다.
5. 큰 결론
이 논문은 "전문가들의 황금기"에 진입하고 있다는 대담한 관찰로 끝납니다.
- 고급 AI 모델 (Claude Opus 4.6 등) 과 대화하는 방법을 아는 전문가라면 놀라운 것들을 구축할 수 있습니다.
- AI 가 너무 똑똑해서 인간이 실제로 프로세스의 '느린 부분'이 될 수도 있습니다.
- 저자들은 미래에 사람들이 거대 소프트웨어 회사에 의존하는 것을 멈추고 대신 이러한 AI 어시스턴트를 사용하여 자신만의 맞춤형 소프트웨어 도구를 구축할 것이라고 제안합니다.
요약하자면: KISS Sorcar 는 강력한 AI 를 엄격한 엔지니어링 규칙과 안전망으로 감싸는 단순한 오픈소스 도구입니다. 이는 AI 를 마법의 지팡이가 아닌, 최고의 작업을 수행하기 위해 좋은 관리자, 깨끗한 작업 공간, 그리고 체크리스트가 필요한 고도로 숙련된 근로자로 대우합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.