More than half of recent astronomy papers are written with language-model assistance
Eine hierarchische Bayes-Analyse von über 200.000 Astronomie-Papieren offenbart, dass mehr als die Hälfte der jüngsten astro-ph-Manuskripte linguistische Spuren einer Unterstützung durch Sprachmodelle aufweist, eine Zahl, die die weniger als 1 % der Arbeiten, die eine solche Nutzung explizit offenlegen, bei weitem übersteigt.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
In der stillen, datenreichen Welt der Astronomie verbringen Wissenschaftler ihre Tage damit, das Licht ferner Sterne und Galaxien in Geschichten über das Universum zu übersetzen. Jahrzehntelang war die Schriftsprache dieser Entdeckungen ein strenger, technischer Dialekt, der jeglicher Ausschmückung entbehrte und sich ganz auf Präzision konzentrierte. Doch Ende 2022 trat ein neues Werkzeug auf den Plan: fortschrittliche Computerprogramme, die in der Lage sind, flüssigen, menschenähnlichen Text zu verfassen. Diese Werkzeuge, bekannt als Sprachmodelle, wurden schnell populär, um Forschern beim Entwerfen von Papieren, beim Überprüfen der Grammatik und beim Organisieren komplexer Ideen zu helfen. Die Frage, die bald aufkam, war nicht, ob diese Werkzeuge verwendet wurden, sondern wie weit ihr Einfluss bereits reicht. Wenn ein Computer half, ein wissenschaftliches Papier zu schreiben, würde der Text dann anders aussehen? Würde er einen subtilen Fingerabdruck tragen, eine spezifische Auswahl an Wörtern, die ein menschlicher Schreiber selten wählen würde, ein Computer aber bevorzugt?
Ein Team von Forschern der Ohio State University und des Max-Planck-Instituts für Astronomie setzte sich zum Ziel, die Antwort zu finden, indem sie die tatsächlichen Wörter in der Fachliteratur untersuchten. Sie analysierten den Volltext von mehr als 200.000 Astronomie-Papieren, die zwischen 2015 und Mitte 2026 eingereicht wurden. Ihr Ziel war es zu zählen, wie viele dieser Dokumente Anzeichen von Computerunterstützung zeigten. Sie konzentrierten sich auf eine spezifische Liste von Wörtern, die in maschinengeneriertem Text häufig geworden waren, wie etwa „delve“ (vertiefen), „underscore“ (unterstreichen), „intricate“ (komplex/filigran) und „pivotal“ (entscheidend). Dies sind keine technischen Begriffe wie „Rotverschiebung“ oder „Supernova“; es sind stilistische Entscheidungen, Wörter, die einem Satz einen gewissen Rhythmus verleihen. Vor dem Aufstieg dieser Computerwerkzeuge verwendeten Astronomen diese Wörter nur sparsam. Die Forscher wollten wissen, ob das plötzliche Auftreten dieser Wörter in neueren Papieren bedeutete, dass die Arbeiten mit Hilfe geschrieben wurden.
Um ein klares Bild zu erhalten, zählte das Team nicht einfach nur die Wörter; sie bauten ein ausgeklügeltes statistisches Modell, um das Signal vom Rauschen zu trennen. Sie wussten, dass sich Sprache über die Zeit verändert und dass manche Wörter aus Gründen populär werden können, die nichts mit der Computernutzung zu tun haben. Um dies zu berücksichtigen, untersuchten sie, wie diese Wörter in Papieren verwendet wurden, die vor 2020 geschrieben wurden – einer Zeit, bevor die Werkzeuge weit verbreitet waren. Dies gab ihnen eine Basislinie dafür, wie oft ein menschlicher Astronom diese Wörter natürlich verwenden würde. Sie verglichen diese Basislinie dann mit den Papieren, die nach 2022 geschrieben wurden. Entscheidend war auch, dass sie sich die kleine Anzahl von Papieren ansah, in denen Autoren explizit die Verwendung eines Sprachmodells zugaben. Diese zugegebenen Papiere dienten als Kalibrierungspunkt, als bekannter Referenzwert, der dem Team half zu verstehen, wie ein „computergestütztes“ Papier in den Daten tatsächlich aussieht.
Die Ergebnisse waren bemerkenswert. Bis 2025 schätzten die Forscher, dass mehr als die Hälfte aller neuen Astronomie-Papiere eine Spur von Unterstützung durch Sprachmodelle trugen. Konkret berechneten sie, dass 54 Prozent der Papiere ein Vokabularsmuster zeigten, das konsistent mit Computerhilfe war, wobei die Fehlermarge selbst unter den konservativsten Annahmen einen Wert von über 36 Prozent sicherstellte. Diese Zahl ist rasant gestiegen; im Jahr 2024 lag die Zahl bei etwa 20 Prozent, und bis zur ersten Hälfte des Jahres 2026 war sie auf fast 87 Prozent geklettert. Dies deutet darauf darauf hin, dass die Nutzung dieser Werkzeuge von einem seltenen Experiment zu einem Standardteil des Schreibprozesses für die Mehrheit der Astronomen geworden ist.
Die Geschichte ist jedoch komplexer als eine einfache Zählung von Papieren. Die Forscher fanden heraus, dass der „Fingerabdruck“ des Computers immer schwerer zu erkennen wird. In den frühen Tagen des Jahres 2023 wiesen die Papiere, die diese Werkzeuge nutzten, einen sehr starken Überschuss an den spezifischen Marker-Wörtern auf – etwa 3,5-mal mehr, als ein rein menschlich geschriebenes Papier gehabt hätte. Bis 2026 war dieser Überschuss auf nur noch das 1,5-fache der Basislinie gesunken. Dies geschah, weil die Autoren begannen, sich anzupassen. Als die spezifischen Wörter wie „delve“ berühmt dafür wurden, Zeichen der Computernutzung zu sein, hörten die Autoren auf, sie so massiv zu verwenden, oder editierten sie heraus, wodurch die Hand des Computers weniger offensichtlich wurde. Die Werkzeuge werden zwar weiterhin genutzt, aber sie werden subtiler und fügen sich natürlicher in menschliche Schreibstile ein.
Die vielleicht aufschlussreichste Erkenntnis ist die Kluft zwischen dem, was geschieht, und dem, was gesagt wird. Während die Forscher schätzen, dass 5
25 Prozent der Papiere im Jahr 2025 unterstützt wurden, enthielten nur 0,81 Prozent dieser Papiere eine formale Erklärung, die die Nutzung eines Computers bestätigte. Mit anderen Worten: Für jedes einzelne Papier, in dem ein Autor den Einsatz des Werkzeugs gestand, gab es etwa 66 Papiere, die dieselben linguistischen Spuren aufwiesen, aber dazu schwiegen. Die Forscher überprüften ihre Detektionsmethoden sorgfältig und stellten fest, dass sie nicht viele Erklärungen übersehen hatten; das Schweigen scheint real zu sein. Die meisten Autoren, die sich zu Wort meldeten, gaben an, die Werkzeuge für Grammatik, Klarheit oder Sprachkorrektur genutzt zu haben – Aufgaben, die viele Fachzeitschriften bereits zulassen. Das Ausbleiben der Offenlegung scheint nicht auf den Versuch zurückzuführen sein, Fehlverhalten zu verbergen, sondern auf den Wunsch, ein Stigma zu vermeiden, da sich die wissenschaftliche Gemeinschaft noch nicht darüber einig ist, ob die Nutzung dieser Werkzeuge akzeptabel ist.
Die Studie kommt zu dem Schluss, dass sich die Landschaft des wissenschaftlichen Schreibens grundlegend verschoben hat. Die Werkzeuge sind kein Novum mehr; sie sind eine dominante Kraft in der Art und Weise, wie Astronomie-Papiere produziert werden. Die Forscher stellen fest, dass dieser Wandel nicht notwendigerweise ein Versagen der Integrität ist, sondern eine Änderung der Praxis, mit der die Gemeinschaft noch nicht Schritt gehalten hat. Da die linguistischen Spuren dieser Werkzeuge weiterhin verblassen und immer schwerer zu detektieren sind, schließt sich das Fenster, um ihren Einfluss zu messen. Die Autoren schlagen vor, dass der dringendste Schritt nach vorn nicht darin besteht, die Werkzeuge zu verbieten oder einem verblassenden Signal nachzujagen, sondern eine klare Norm der Offenlegung zu etablieren. Wenn Autoren einfach angaben, wann sie diese Hilfsmittel verwendeten, könnte das Feld voranschreiten, ohne die Verwirrung durch versteckte Unterstützung, und eine Praxis, die derzeit ignoriert wird, in eine offen verstandene Praxis verwandeln.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.