← Ultimi articoli
🔭 astrophysics

More than half of recent astronomy papers are written with language-model assistance

Un'analisi bayesiana gerarchica di oltre 200.000 articoli di astronomia rivela che più della metà dei manoscritti recenti di astro-ph mostra tracce linguistiche di assistenza da parte di modelli linguistici, una cifra che supera ampiamente l'inferiore all'1% dei lavori che dichiarano esplicitamente tale uso.

Autori originali: Serat M. Saad, Yuan-Sen Ting

Pubblicato 2026-09-11
📖 6 min di lettura🧠 Approfondimento

Autori originali: Serat M. Saad, Yuan-Sen Ting

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Nel silenzioso mondo dell'astronomia, denso di dati, gli scienziati trascorrono le loro giornate traducendo la luce di stelle e galassie lontane in storie sull'universo. Per decenni, il linguaggio scritto di queste scoperte è stato un dialetto tecnico e rigoroso, privo di fronzoli e focalizzato interamente sulla precisione. Ma alla fine del 2022, un nuovo strumento è entrato in scena: programmi informatici avanzati capaci di scrivere testi fluidi, simili a quelli umani. Questi strumenti, noti come modelli linguistici, sono diventati rapidamente popolari per aiutare i ricercatori a bozzare articoli, controllare la grammatica e organizzare idee complesse. La domanda che sorse presto non fu se questi strumenti venissero utilizzati, ma quanto fosse diventata diffusa la loro influenza. Se un computer avesse aiutato a scrivere un articolo scientifico, il testo sarebbe apparso diverso? Avrebbe portato un sottile marchio, un particolare set di parole che uno scrittore umano sceglierebbe raramente, ma che una macchina predilige?

Un team di ricercatori della Ohio State University e del Max Planck Institute for Astronomy si è posto l'obiettivo di trovare la risposta analizzando le parole effettive nella letteratura scientifica. Hanno analizzato il testo completo di oltre 200.000 articoli di astronomia pubblicati tra il 2015 e la metà del 2026. Il loro obiettivo era contare quanti di questi documenti mostrassero segni di assistenza informatica. Si sono concentrati su una lista specifica di parole che erano diventate comuni nel testo generato dalle macchine, come "delve" (approfondire), "underscore" (sottolineare), "intricate" (intricato) e "pivotal" (fondamentale). Queste non sono termini tecnici come "redshift" o "supernova"; sono scelte stilistiche, parole che aggiungono un certo ritmo a una frase. Prima dell'ascesa di questi strumenti informatici, gli astronomi usavano queste parole con parsimonia. I ricercatori volevano sapere se la comparsa improvvisa di queste parole negli articoli recenti significasse che gli articoli venivano scritti con un aiuto.

Per ottenere un quadro chiaro, il team non si è limitato a contare le parole; ha costruito un sofisticato modello statistico per separare il segnale dal rumore. Sapevano che il linguaggio cambia nel tempo e che alcune parole potrebbero diventare popolari per ragioni diverse dall'uso del computer. Per tenere conto di ciò, hanno esaminato come queste parole venissero usate negli articoli scritti prima del 2020, un periodo precedente alla diffusione di questi strumenti. Questo ha fornito loro una linea di base su quanto spesso un astronomo umano utilizzerebbe naturalmente queste parole. Hanno poi confrontato questa linea di base con gli articoli scritti dopo il 2022. Fondamentalmente, hanno anche esaminato il piccolo numero di articoli in cui gli autori avevano dichiarato esplicitamente l'uso di un modello linguistico. Questi articoli dichiarati hanno servito come punto di calibrazione, un riferimento noto per aiutare il team a capire come appare un articolo "assistito dal computer" nei dati.

I risultati sono stati sorprendenti. Entro il 2025, i ricercatori hanno stimato che più della metà di tutti i nuovi articoli di astronomia portasse una traccia di assistenza da parte di un modello linguistico. Nello specifico, hanno calcolato che il 54 percento degli articoli mostrava un modello di vocabolario coerente con l'aiuto del computer, con un margine di errore che manteneva la cifra comodamente sopra il 36 percento anche nelle ipotesi più conservative. Questo numero è aumentato rapidamente: nel 2024, la cifra era intorno al 20 percento, e verso la prima metà del 2026, era salita a quasi l'87 percento. Ciò suggerisce che l'uso di questi strumenti sia passato da un esperimento raro a una parte standard del processo di scrittura per la maggioranza degli astronomi.

Tuttavia, la storia è più complessa di un semplice conteggio di articoli. I ricercatori hanno scoperto che il "marchio" del computer sta diventando sempre più difficile da vedere. Nei primi giorni del 202zione, gli articoli che utilizzavano questi strumenti presentavano un eccesso molto marcato delle specifiche parole segnale — circa 3,5 volte superiore rispetto a un articolo scritto da un essere umano. Entro il 2026, questo eccesso era sceso a appena 1,5 volte la linea di base. Ciò è accaduto perché gli autori hanno iniziato ad adattarsi. Man mano che le parole specifiche come "delve" diventavano famose come segni di uso del computer, gli scrittori hanno smesso di usarle così intensamente, o le hanno editate, rendendo la mano del computer meno evidente. Gli strumenti vengono ancora utilizzati, ma stanno diventando più sottili, fondendosi più naturalmente con gli stili di scrittura umana.

Forse il dato più rivelatore è il divario tra ciò che accade e ciò che viene detto. Mentre i ricercatori stimano che il 54 percento degli articoli nel 2025 fosse assistito, solo lo 0,81 percento di quegli articoli conteneva una dichiarazione formale che attestava l'uso di un computer. In altre parole, per ogni singolo articolo in cui un autore ammetteva l'uso dello strumento, c'erano circa 66 articoli che mostravano le stesse tracce linguistiche ma non dicevano nulla al riguardo. I ricercatori hanno controllato attentamente i loro metodi di rilevamento e hanno scoperto che non stavano perdendo molte dichiarazioni; il silenzio sembra essere reale. La maggior parte degli autori che hanno parlato ha dichiarato di aver usato gli strumenti per la grammatica, la chiarezza o l'editing linguistico, compiti che molte riviste già permettono. La mancanza di trasparenza sembra non derivare da un tentativo di nascondere una condotta scorretta, ma dal desiderio di evitare uno stigma, poiché la comunità scientifica non ha ancora concordato se l'uso di questi strumenti sia accettabile.

Lo studio conclude che il panorama della scrittura scientifica è cambiato fondamentalmente. Gli strumenti non sono più una novità; sono una forza dominante nel modo in cui gli articoli di astronomia vengono prodotti. I ricercatori osservano che questo cambiamento non è necessariamente un fallimento dell'integrità, ma un cambiamento nelle pratiche a cui la comunità non si è ancora adeguata. Poiché le tracce linguistiche di questi strumenti continuano a svanire e a diventare più difficili da rilevare, la finestra per misurarne l'impatto si sta chiudendo. Gli autori suggeriscono che il passo più urgente non sia vietare gli strumenti o inseguire un segnale che svanisce, ma stabilire una norma chiara di trasparenza. Se gli autori dichiarassero semplicemente quando utilizzano questi ausili, il campo potrebbe procedere senza la confusione dell'assistenza nascosta, trasformando una pratica che attualmente viene ignorata in una che sia apertamente compresa.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →