Early Adoption of Agentic Coding Tools by GitHub Projects
Este estudo analisa mais de 25.000 pull requests gerados por agentes em 2.300 repositórios do GitHub para revelar que, embora a adoção intensiva de ferramentas de codificação agênticas permaneça concentrada em um pequeno subconjunto de projetos, a integração bem-sucedida depende fortemente de modelos de supervisão humana única e varia significamente conforme o tamanho e a produtividade do projeto.
Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo
Imagine o mundo do desenvolvimento de software como um canteiro de obras massivo e movimentado, onde milhões de pessoas estão construindo arranha-céus digitais, linha por linha de código. Durante anos, os trabalhadores neste canteiro usaram "assistentes inteligentes" — ferramentas que sugerem o próximo tijolo ou ajudam a consertar uma parede bamba. Mas recentemente, um novo tipo de trabalhador chegou: a ferramenta "agêntica". Pense nestas não como assistentes que apenas sussurram sugestões, mas como estagiários semiautônomos. Estes estagiários digitais podem olhar para uma planta, construir um quarto inteiro novo, testá-lo para garantir que as luzes funcionem e até bater na porta do gerente de projeto para perguntar: "Podemos colocar isto aqui?". Esta mudança é emocionante porque promete acelerar a forma como construímos software, mas também levanta uma grande questão: Como as equipes humanas reais realmente trabalham com estes novos estagiários digitais? Elas confiam neles com as chaves de todo o edifício? Ou mantêm uma coleira curta? Esta é a história de como os projetos de código aberto estão tentando descobrir as regras desta nova parceria entre humanos e agentes.
O artigo "Early Adoption of Agentic Coding Tools by GitHub Projects" atua como uma história de detetive, investigando como milhares de projetos de software estão lidando com estes novos estagiários digitais. Os pesquisadores analisaram um enorme volume de dados: 25.264 "pull requests" (que são basicamente pedidos formais para adicionar novo código) de 2.361 projetos diferentes no GitHub. Eles focaram em uma janela específica de três meses (maio, junho e julho de 2025) e rastrearam três agentes de codificação de IA populares: Copilot, Codex e Claude Code. O objetivo deles era responder a três perguntas principais: Quantos projetos estão realmente usando estas ferramentas? Quão produtivos são estes projetos ao usar elas? E, mais importante, como humanos e agentes estão trabalhando juntos?
Aqui está o que a investigação revelou, e é um pouco mais matizado do que você poderia esperar.
Primeiro, os pesquisadores descobriram que, embora estas ferramentas estejam sendo usadas em milhares de lugares, o "trabalho pesado" está acontecendo em um canto muito pequeno do canteiro de obras. Se você escolhesse um projeto aleatório, a mediana (o ponto central) gerava apenas um a dois pedidos feitos por agentes durante esses três meses. É como descobrir que, embora exista uma nova ferramenta elétrica, a maioria das equipes de construção só a usa uma ou duas vezes por mês. O estudo sugere que a "adoção intensiva" ainda está concentada em um subconjunto relativamente pequeno de projetos. No entanto, há uma reviravolta: o tamanho da equipe importa muito. Projetos pequenos (com 1 a 5 colaboradores) foram muito mais ansiosos para mergulhar de cabeça. Eles tinham uma porcentagem maior de seus membros de equipe usando as ferramentas e, em média, geravam muito mais atividade de agentes do que os projetos massivos, de tamanho corporativo. De fato, projetos pequenos geraram, em média, cerca de 50 pedidos de agentes por repositório, enquanto projetos médios e grandes geraram apenas 5 a 7. Parece que as equipes menores estão mais dispostas a deixar os estagiários digitais correrem soltos, enquanto as grandes equipes ainda estão sendo muito cautelosas.
Segundo, a equipe olhou para a produtividade, perguntando: "Quanto código é realmente construído por pessoa?" Eles compararam suas descobertas com um benchmark da indústria que sugere que um desenvolvedor humano pode lidar com cerca de 36 pedidos em três meses. Os resultados mostraram que a maioria dos projetos ficou abaixo dessa linha. Apenas uma fração minúscula — apenas 25 dos 2.361 projetos (cerca de 1%) — conseguiu exceder essa marca de 36 pedidos. Isso sugere que, embora as ferramentas sejam capazes, a maioria das equipes ainda não está gerando um volume massivo de trabalho de agentes. Os poucos projetos que foram acima da linha eram majoritariamente os pequenos, indicando que a alta produtividade com estas ferramentas pode depender de condições específicas do projeto que ainda não compreendemos totalmente.
Finalmente, o estudo observou a "dança" entre humanos e agentes. Quem está realmente no comando? A resposta é, esmagadoramente, uma única pessoa. Em quase 79% dos casos, um único desenvolvedor humano era quem revisava o trabalho do agente e também quem o integrava ao projeto. É um modelo de "supervisão solo". Imagine um professor corrigindo o dever de casa de um aluno e, imediatamente, colocando-o no livro de notas sem pedir uma segunda opinião a um colega. Embora projetos maiores tenham mostrado um pouco mais de trabalho em equipe (com múltiplas pessoas revisando), a grande maioria das vezes, a colaboração humano-agente é uma relação de um para um. O artigo sugere que, mesmo com estes agentes poderosos, o papel humano de revisar e aprovar permanece central e não foi substituído por uma rede de segurança baseada em equipe.
Em resumo, este artigo pinta o quadro de um experimento inicial. Os estagiários digitais estão aqui, e estão trabalhando duro em algumas equipes ágeis e pequenas, mas para a maioria dos projetos, eles ainda estão apenas molhando os pés. O estudo sugere que, para que estas ferramentas verdadeiramente transformem o desenvolvimento de software, não se trata apenas de tornar os agentes mais inteligentes; trata-se de como as equipes humanas se organizam para confiar, revisar e gerenciar o trabalho que estes agentes produzem. O futuro desta parceria depende de encontrar o equilíbrio certo entre deixar os agentes correrem e manter uma mão humana firmemente no volante.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.