← 최신 논문
🤖 machine learning

Early Adoption of Agentic Coding Tools by GitHub Projects

이 연구는 2,300개의 GitHub 저장소에 걸친 25,000개 이상의 에이전트 생성 풀 리퀘스트를 분석하여, 에이전트 기반 코딩 도구의 집중적인 도입은 여전히 적은 수의 프로젝트 집단에 국한되어 있는 반면, 성공적인 통합은 단일 인간 감독 모델에 크게 의존하며 프로젝트 규모와 생산성에 따라 상당히 달라진다는 점을 밝혀냈다.

원저자: Maliha Noushin Raida, Daqing Hou

게시일 2026-07-16
📖 4 분 읽기☕ 가벼운 읽기

원저자: Maliha Noushin Raida, Daqing Hou

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

소프트웨어 개발의 세계를 수백만 명의 사람들이 한 줄의 코드씩 쌓아 올리며 거대한 디지털 마천루를 건설하는, 북적이는 대규모 건설 현장이라고 상상해 보십시오. 수년 동안 이 현장의 노동자들은 다음 벽돌을 제안하거나 흔들리는 벽을 고치는 데 도움을 주는 '스마트 비서'—도구들을 사용해 왔습니다. 하지만 최근, 새로운 종류의 노동자가 도착했습니다: 바로 '에이전틱(agentic)' 도구입니다. 이들을 단순히 옆에서 속삭이며 제안을 건네는 비서가 아니라, 준자율적인 인턴이라고 생각하십시오. 이 디지털 인턴들은 설계도를 보고, 새로운 방 하나를 통째로 만들고, 전등이 제대로 작동하는지 확인하기 위해 테스트까지 수행한 뒤, 프로젝트 매니저의 문을 두드리며 "이걸 넣어도 될까요?"라고 물을 수 있습니다. 이러한 변화는 소프트웨어를 구축하는 속도를 높여줄 것이라는 기대를 불러일으키지만, 동시에 큰 질문을 던집니다: 실제 인간 팀은 이 새로운 디지털 인턴들과 어떻게 함께 일할 것인가? 그들에게 건물 전체의 열쇠를 맡길 것인가, 아니면 엄격한 통제권을 유지할 것인가? 이것은 오픈 소스 프로젝트들이 이 새로운 인간-에이전트 파트로십의 규칙을 찾아가는 과정에 대한 이야기입니다.

"GitHub 프로젝트의 에이전틱 코딩 도구의 초기 도입(Early Adoption of Agentic Coding Tools by GitHub Projects)"이라는 논문은 수천 개의 소프트웨어 프로젝트가 이 새로운 디지털 인턴들을 어떻게 다루고 있는지 조사하는 탐정 소설과 같습니다. 연구진은 방대한 양의 데이터를 살펴보았습니다: 2,361개의 서로 다른 GitHub 프로젝트에서 발생한 25,264개의 '풀 리퀘스트(pull request, 새로운 코드를 추가해 달라는 공식 요청)'입니다. 그들은 특정 3개월 기간(2025년 5월, 6월, 7월)에 집중하여 세 가지 인기 있는 AI 코딩 에이전트인 Copilot, Codex, Claude Code를 추적했습니다. 그들의 목표는 세 가지 주요 질문에 답하는 것이었습니다: 얼마나 많은 프로젝트가 실제로 이 도구들을 사용하고 있는가? 이 도구들을 사용할 때 이 프로젝트들의 생산성은 어떠한가? 그리고 가장 중요한 것은, 인간과 에이전트가 어떻게 협력하고 있는가?

조사 결과는 다음과 같으며, 이는 여러분이 예상하는 것보다 훨씬 더 미묘합니다.

첫째, 연구진은 이 도구들이 수천 곳에서 사용되고 있음에도 불구하고, '중요한 작업(heavy lifting)'은 건설 현장의 아주 작은 구석에서 일어나고 있다는 것을 발견했습니다. 만약 여러분이 무작위로 프로젝트를 하나 뽑는다면, 그 3개월 동안 에이전트가 만든 요청은 중앙값(중간 지점) 기준으로 단 12개에 불과했습니다. 이는 새로운 종류의 전동 공구가 존재하더라도, 대부분의 건설팀은 한 달에 한두 번 정도만 그것을 사용하는 것과 같습니다. 이 연구는 '집중적인 도입'이 여전히 상대적으로 작은 일부 프로젝트에 집중되어 있음을 시사합니다. 하지만 반전이 있습니다: 팀의 규모가 매우 중요합니다. 소규모 프로젝트(기여자 15명)는 훨씬 더 적극적으로 뛰어들었습니다. 이들은 팀원들의 도구 사용 비율이 더 높았고, 평균적으로 거대 기업형 프로젝트보다 훨씬 더 많은 에이전트 활동을 생성했습니다. 실제로 소규모 프로젝트는 저장소당 평균 약 50개의 에이전트 요청을 생성한 반면, 중형 및 대형 프로젝트는 평균 5~7개에 불과했습니다. 마치 작은 크루들이 디지털 인턴들이 마음껏 뛰놀도록 내버려 두는 경향이 있는 반면, 큰 팀들은 여전히 매우 신중하다는 것을 보여줍니다.

둘째, 팀은 생산성을 살펴보며 "사람 한 명당 실제로 얼마나 많은 코드가 구축되는가?"를 물었습니다. 그들은 인간 개발자 한 명이 3개월 동안 약 36개의 요청을 처리한다는 업계 벤치마크와 결과를 비교했습니다. 결과는 대부분의 프로젝트가 이 선 아래에 머물러 있음을 보여주었습니다. 단 1%(2,361개 프로젝트 중 25개)만이 이 36개 요청의 기준치를 초과했습니다. 이는 도구들이 능력이 있더라도, 대부분의 팀이 아직 에이전트 작업을 대량으로 생성하고 있지는 않다는 것을 시사합니다. 기준선 위로 올라간 극소수의 프로젝트는 대부분 소규모 프로젝트였으며, 이는 에이전트를 통한 높은 생산성이 우리가 아직 완전히 이해하지 못한 특정 프로젝트 조건에 달려 있을 수 있음을 나타냅니다.

마지막으로, 연구는 인간과 에이전트 사이의 '춤'을 살펴보았습니다. 실제로 누가 주도권을 쥐고 있는가? 답은 압도적으로 한 사람입니다. 거의 79%의 경우, 단 한 명의 인간 개발자가 에이전트의 작업을 검토하고 해당 작업을 프로젝트에 병합(merge)했습니다. 이것은 '단독 감독(solo oversight)' 모델입니다. 선생님이 학생의 숙제를 채점한 뒤 동료에게 두 번째 의견을 묻지 않고 즉시 성적부에 기록하는 모습을 상상해 보십시오. 규모가 큰 프로젝트들은 조금 더 많은 팀워크(여러 명의 검토자)를 보여주기도 했지만, 대다수의 경우 인간-에이전트 협업은 일대일 관계였습니다. 논문은 이 강력한 에이전트들조차도 검토하고 승인하는 인간의 역할이 여전히 중심적이며, 팀 기반의 안전망으로 대체되지 않았음을 시사합니다.

요약하자면, 이 논문은 초기 실험의 모습을 그려내고 있습니다. 디지털 인턴들은 여기에 와 있으며, 일부 작고 민첩한 팀들 내에서 열심히 일하고 있지만, 대부분의 프로젝트에게 이들은 아직 발을 담그는 단계에 불과합니다. 이 연구는 이 도구들이 진정으로 소프트웨어 개발을 변화시키기 위해서는 단순히 에이전트를 더 똑똑하게 만드는 것뿐만 아니라, 인간 팀이 에이전트가 생성한 작업을 신뢰하고, 검토하고, 관리하기 위해 어떻게 조직되어야 하는지가 관건이라고 제안합니다. 이 파트너십의 미래는 에이전트가 마음껏 달리게 하는 것과 인간의 손이 운전대를 꽉 잡게 하는 것 사이의 적절한 균형을 찾는 데 달려 있습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →