Early Adoption of Agentic Coding Tools by GitHub Projects
Questo studio analizza oltre 25.000 pull request generate da agenti attraverso 2.300 repository GitHub per rivelare che, sebbene l'adozione intensiva di strumenti di codifica agentica rimanga concentrata in un piccolo sottoinsieme di progetti, l'integrazione di successo si basa fortemente su modelli di supervisione umana singola e varia significativamente in base alle dimensioni del progetto e alla produttività.
Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo
Immaginate il mondo dello sviluppo software come un enorme e frenetico cantiere edile dove milioni di persone stanno costruendo grattacieli digitali, una riga di codice alla volta. Per anni, i lavoratori di questo cantiere hanno usato "assistenti intelligenti" — strumenti che suggeriscono il mattone successivo o aiutano a sistemare un muro traballante. Ma recentemente, è arrivato un nuovo tipo di lavoratore: lo strumento "agente". Pensate a questi non come ad assistenti che sussurrano solo suggerimenti, ma come a dei tirocinanti semi-autonomi. Questi tirocinanti digitali possono guardare una planimetria, costruire un'intera nuova stanza, testarla per assicurarsi che le luci funzionino e persino bussare alla porta del project manager per chiedere: "Possiamo inserire questo?". Questo cambiamento è entusiasmante perché promette di velocizzare il modo in cui costruiamo il software, ma solleva anche una grande domanda: come lavorano realmente i team umani con questi nuovi tirocinanti digitali? Si fidano di loro consegnando le chiavi dell'intero edificio, o tengono un guinzaglio corto? Questa è la storia di come i progetti open-source stiano cercando di capire le regole di questa nuova partnership uomo-agente.
Il documento "Early Adoption of Agentic Coding Tools by GitHub Projects" agisce come un romanzo investigativo, indagando come migliaori di progetti software stiano gestendo questi nuovi tirocinanti digitali. I ricercatori hanno esaminato una massa enorme di dati: 25.264 "pull request" (che sono fondamentalmente richieste formali per aggiungere nuovo codice) provenienti da 2.361 diversi progetti su GitHub. Si sono concentrati su una specifica finestra di tre mesi (maggio, giugno e luglio 2025) e hanno tracciato tre popolari agenti di codifica IA: Copilot, Codex e Claude Code. Il loro obiettivo era rispondere a tre domande principali: Quanti progetti stanno effettivamente usando questi strumenti? Quanto sono produttivi questi progetti quando li usano? E, cosa più importante, come lavorano insieme umani e agenti?
Ecco cosa ha rivelato l'indagine, ed è un po' più sfumato di quanto si possa aspettare.
In primo luogo, i ricercatori hanno scoperto che, sebbene questi strumenti vengano utilizzati in migliaia di posti, il "lavoro pesante" sta avvenendo in un angolo molto piccolo del cantiere. Se sceglieste un progetto a caso, il valore mediano (il punto centrale) generava solo uno o due contributi creati dall'agente durante quei tre mesi. È come scoprire che, sebbene esista un nuovo tipo di elettroutensile, la maggior parte delle squadre di costruzione lo usa solo una o due volte al mese. Lo studio suggerisce che l'"adozione intensiva" è ancora concentrata in un sottoinsieme relativamente piccolo di progetti. Tuttavia, c'è un colpo di scena: la dimensione del team conta molto. I progetti piccoli (con 1 a 5 contributori) erano molto più desiderosi di tuffarsi nell'esperienza. Avevano una percentuale più alta di membri del team che utilizzavano gli strumenti e, in media, generavano molta più attività dell'agente rispetto ai progetti di dimensioni aziendali massicce. Infatti, i piccoli progetti hanno mediamente circa 50 richieste dell'agente per repository, mentre i progetti medi e grandi ne hanno mediati solo 5 o 7. Sembra che le squadre più piccole siano più disposte a lasciare che i tirocinanti digitali corrano selvaggiamente, mentre i grandi team siano ancora molto cauti.
In secondo luogo, il team ha esaminato la produttività, chiedendosi: "Quanto codice viene effettivamente costruito per persona?". Hanno confrontato i loro risultati con un benchmark del settore che suggerisce che un programmatore umano possa gestire circa 36 richieste in tre mesi. I risultati hanno mostrato che la maggior parte dei progetti si è posizionata al di sotto di questa linea. Solo una minuscola frazione — appena 25 dei 2.361 progetti (circa l'1%) — è riuscita a superare quel limite di 36 richieste. Ciò suggerisce che, sebbene gli strumenti siano capaci, la maggior parte dei team non sta ancora generando un volume massiccio di lavoro tramite l'agente. I pochi progetti che sono andati sopra la linea erano principalmente quelli piccoli, indicando che l'alta produttività con questi strumenti potrebbe dipendere da specifiche condizioni del progetto che non comprendiamo ancora appieno.
Infine, lo studio ha osservato la "danza" tra umani e agenti. Chi è davvero al comando? La risposta è schiacciante: una sola persona. In quasi il 79% dei casi, un singolo sviluppatore umano era colui che revisionava il lavoro dell'agente e anche colui che lo integrava nel progetto. È un modello di "supervisione solitaria". Immaginate un insegnante che corregge i compiti di uno studente e poi li inserisce immediatamente nel registro senza chiedere un secondo parere a un collega. Sebbene i progetti più grandi mostrassero un po' più di lavoro di squadra (con più persone che revisionavano), la stragrande maggioranza delle volte, la collaborazione uomo-agente è una relazione uno-a-uno. Il documento suggerisce che, anche con questi nuovi agenti così potenti, il ruolo umano di revisione e approvazione rimane centrale e non è stato sostituito da una rete di sicurezza basata sul team.
In breve, questo documento dipinge l'immagine di un esperimento iniziale. I tirocinanti digitali sono qui, e stanno lavorando sodo in alcuni team piccoli e agili, ma per la maggior parte dei progetti, stanno ancora solo bagnando i piedi. Lo studio suggerisce che, affinché questi strumenti possano veramente trasformare lo sviluppo del software, non si tratta solo di rendere gli agenti più intelligenti; si tratta di come i team umani si organizzano per fidarsi, revisionare e gestire il lavoro che questi agenti producono. Il futuro di questa partnership dipende dal trovare il giusto equilibrio tra il lasciare che gli agenti corrano e il mantenere una mano umana saldamente sul volante.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.