← Neueste Arbeiten
🤖 machine learning

Early Adoption of Agentic Coding Tools by GitHub Projects

Diese Studie analysiert über 25.000 von Agenten generierte Pull Requests über 2.300 GitHub-Repositories hinweg, um aufzuzeigen, dass die intensive Nutzung agentischer Codierungswerkzeuge zwar in einer kleinen Teilmenge von Projekten konzentriert bleibt, eine erfolgreiche Integration jedoch stark von Modellen mit menschlicher Einzelaufsicht abhängt und signifikant nach Projektgröße und Produktivität variiert.

Ursprüngliche Autoren: Maliha Noushin Raida, Daqing Hou

Veröffentlicht 2026-07-16
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Maliha Noushin Raida, Daqing Hou

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich die Welt der Softwareentwicklung als eine riesige, geschäftige Baustelle vor, auf der Millionen von Menschen digitale Wolkenkratzer bauen, Zeile für Zeile Code. Jahrelang haben die Arbeiter auf dieser Baustelle „intelligente Assistenten“ genutzt – Werkzeuge, die den nächsten Ziegel vorschlagen oder helfen, eine wackelige Wand zu reparieren. Doch vor kurzem ist eine neue Art von Arbeiter eingetroffen: das „agentische“ Werkzeug. Betrachten Sie diese nicht als Assistenten, die nur Vorschläge flüstern, sondern als semi-autonome Praktikanten. Diese digitalen Praktikanten können einen Bauplan lesen, ein ganz neues Zimmer bauen, es testen, um sicherzustellen, dass das Licht funktioniert, und sogar an die Tür des Projektmanagers klopfen, um zu fragen: „Können wir das einbauen?“ Dieser Wandel ist aufregend, weil er verspricht, die Art und Weise, wie wir Software bauen, zu beschleunieren, aber er wirft auch eine große Frage auf: Wie arbeiten echte menschliche Teams tatsächlich mit diesen neuen digitalen Praktikanten zusammen? Vertrauen sie ihnen die Schlüssel zum gesamten Gebäude an oder halten sie sie an einer kurzen Leine? Dies ist die Geschichte der Frage, wie Open-Source-Projekte versuchen, die Regeln dieser neuen Mensch-Agent-Partnerschaft festzulegen.

Das Paper „Early Adoption of Agentic Coding Tools by GitHub Projects“ fungiert wie eine Detektivgeschichte, die untersucht, wie tausende von Softwareprojekten mit diesen neuen digitalen Praktikanten umgehen. Die Forscher untersuchten einen riesigen Datenberg: 25.264 „Pull Requests“ (welche im Grunde formale Anfragen sind, um neuen Code hinzuzufügen) aus 2.361 verschiedenen Projekten auf GitHub. Sie konzentrierten sich auf ein spezifisches Zeitfenster von drei Monaten (Mai, Juni und Juli 2025) und verfolgten drei populäre KI-Coding-Agenten: Copilot, Codex und Claude Code. Ihr Ziel war es, drei Hauptfragen zu beantworten: Wie viele Projekte nutzen diese Werkzeuge tatsächlich? Wie produktiv sind diese Projekte bei der Nutzung dieser Werkzeuge? Und, was am wichtigsten ist: Wie arbeiten Menschen und Agenten zusammen?

Hier ist das, was die Untersuchung enthüllte, und es ist etwas nuancierter, als man vielleicht erwarten würde.

Erstens fanden die Forscher heraus, dass diese Werkzeuge zwar an tausenden Stellen eingesetzt werden, die „schwere Arbeit“ jedoch in einer sehr kleinen Ecke der Baustelle stattfindet. Wenn man ein zufälliges Projekt auswählen würde, generierte der Median (der Mittelpunkt) nur ein bis zwei agentengenerierte Anfragen während dieser drei Monate. Es ist, als würde man feststellen, dass zwar ein neues Elektrowerkzeug existiert, die meisten Baustellenmannschaften es aber nur ein- oder zweimal im Monat benutzen. Die Studie legt nahe, dass die „intensive Nutzung“ noch auf eine relativ kleine Teilmenge von Projekten konzentriert ist. Es gibt jedoch eine Wendung: Die Größe des Teams spielt eine große Rolle. Kleine Projekte (mit 1 bis 5 Mitwirkenden) waren viel eifriger, einzusteigen. Sie hatten einen höheren Prozentsatz an Teammitgliedern, die die Werkzeuge nutzten, und generierten im Durchschnitt weit mehr Agenten-Aktivität als die massiven, unternehmensgroßen Projekte. Tatsächlich generierten kleine Projekte im Durchschnitt etwa 50 Agenten-Anfragen pro Repository, während mittlere und große Projekte im Durchschnitt nur 5 bis 7 generierten. Es scheint, als ließen die kleineren Crews die digitalen Praktikanten eher wild um sich herumwerken, während die großen Teams immer noch sehr vorsichtig sind.

Zweitens untersuchte das Team die Produktivität mit der Frage: „Wie viel Code wird pro Person tatsächlich gebaut?“ Sie verglichen ihre Ergebnisse mit einem Branchen-Benchmark, der besagt, dass ein menschlicher Entwickler in drei Monaten etwa 36 Anfragen bearbeiten kann. Die Ergebnisse zeigten, dass die meisten Projekte unter dieser Linie lagen. Nur ein winziger Bruchteil – gerade einmal 25 der 2.361 Projekte (etwa 1 %) – schaffte es, diesen Wert von 36 Anfragen zu übertreffen. Dies deutet darauf hin, dass die Werkzeuge zwar fähig sind, die meisten Teams aber noch keine massiven Volumina an Agenten-Arbeit generieren. Die wenigen Projekte, die über die Linie kamen, waren überwiegend die kleinen, was darauf hindeutet, dass hohe Produktivität mit diesen Werkzeugen von spezifischen Projektbedingungen abhängen könnte, die wir noch nicht vollständig verstehen.

Schließlich untersuchte die Studie den „Tanz“ zwischen Menschen und Agenten. Wer hat eigentlich das Sagen? Die Antwort ist überwältigend eine einzige Person. In fast 79 % der Fälle war ein einzelner menschlicher Entwickler derjenige, der die Arbeit des Agenten überprüfte und auch derjenige, der sie in das Projekt übernahm (mergte). Es ist ein Modell der „Solo-Aufsicht“. Stellen Sie sich vor, ein Lehrer korrigiert die Hausaufgaben eines Schülers und trägt sie dann sofort ins Notenbuch ein, ohne einen Kollegen um eine zweite Meinung zu bitten. Während größere Projekte etwas mehr Teamarbeit zeigten (mit mehreren Personen, die überprüften), ist die Mensch-Agent-Kollaboration in der überwiegenden Mehrheit der Fälle eine Eins-zu-eins-Beziehung. Das Paper legt nahe, dass selbst mit diesen leistungsfähigen Agenten die menschliche Rolle der Überprüfung und Genehmigung zentral bleibt und nicht durch ein teambasiertes Sicherheitsnetz ersetzt wurde.

Kurz gesagt: Dieses Paper zeichnet das Bild eines frühen Experiments. Die digitalen Praktikanten sind da, und sie arbeiten hart in einigen kleinen, agilen Teams, aber für die meisten Projekte stecken sie noch in den Kinderschuhen. Die Studie legt nahe, dass es für diese Werkzeuge, um die Softwareentwicklung wirklich zu transformieren, nicht nur darum geht, die Agenten intelligenter zu machen, sondern darum, wie menschliche Teams sich organisieren, um der Arbeit, die diese Agenten produzieren, zu vertrauen, sie zu überprüfen und zu verwalten. Die Zukunft dieser Partnerschaft hängt davon ab, das richtige Gleichgewicht zu finden zwischen dem freien Lauf der Agenten und einer menschlichen Hand, die fest am Steuer bleibt.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →