More than half of recent astronomy papers are written with language-model assistance
Un análisis bayesiano jerárquico de más de 200.000 artículos de astronomía revela que más de la mitad de los manuscritos recientes de astro-ph muestran rastros lingüísticos de asistencia de modelos de lenguaje, una cifra que excede enormemente el menos del 1% de los artículos que divulgan explícitamente dicho uso.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
En el silencioso mundo de la astronomía, cargado de datos, los científicos pasan sus días traduciendo la luz de estrellas y galaxias lejanas en historias sobre el universo. Durante décadas, el lenguaje escrito de estos descubrimientos ha sido un dialecto técnico y estricto, despojado de adornos y enfocado enteramente en la precisión. Pero a finales de 2022, una nueva herramienta entró en escena: programas informáticos avanzados capaces de escribir textos fluidos y humanos. Estas herramientas, conocidas como modelos de lenguaje, se volvieron rápidamente populares para ayudar a los investigadores a redactar artículos, revisar la gramática y organizar ideas complejas. La pregunta que surgió poco después no fue si estas herramientas se estaban utilizando, sino qué tan extendida se había vuelto su influencia. Si una computadora ayudaba a escribir un artículo científico, ¿se vería diferente el texto? ¿Llevaría una huella digital sutil, un conjunto específico de palabras que un escritor humano rara vez elegiría pero que una máquina favorece?
Un equipo de investigadores de la Universidad Estatal de Ohio y del Instituto Max Planck de Astronomía se propuso encontrar la respuesta analizando las palabras reales en la literatura. Analizaron el texto completo de más de 200,000 artículos de astronomía presentados entre 2015 y mediados de 2026. Su objetivo era contar cuántos de estos documentos mostraban signos de asistencia informática. Se centraron en una lista específica de palabras que se habían vuelto comunes en el texto generado por computadora, tales como "delve" (profundizar), "underscore" (subrayar/destacar), "intricate" (intrincado) y "pivotal" (crucial/fundamental). Estos no son términos técnicos como "redshift" (desplazamiento al rojo) o "supernova"; son elecciones estilísticas, palabras que añaden cierto ritmo a una oración. Antes del auge de estas herramientas informáticas, los astrónomos usaban estas palabras con moderación. Los investigadores querían saber si la aparición repentina de estas palabras en artículos recientes significaba que los artículos estaban siendo escritos con ayuda.
Para obtener una imagen clara, el equipo no solo contó las palabras; construyeron un sofisticado modelo estadístico para separar la señal del ruido. Sabían que el lenguaje cambia con el tiempo, y que algunas palabras podrían volverse populares por razones ajenas al uso de computadoras. Para dar cuenta de esto, observaron cómo se usaban estas palabras en artículos escritos antes de 2020, una época anterior a que las herramientas estuvieran ampliamente disponibles. Esto les dio una base de referencia de con qué frecuencia un astrónomo humano usaría estas palabras de forma natural. Luego compararon esta base con los artículos escritos después de 2022. Crucialmente, también observaron el pequeño número de artículos donde los autores admitieron explícitamente el uso de un modelo de lenguaje. Estos artículos admitidos sirvieron como un punto de calibración, una referencia conocida para ayudar al equipo a entender cómo es realmente un artículo "asistido por computadora" en los datos.
Los resultados fueron sorprendentes. Para 2025, los investigadores estimaron que más de la mitad de todos los nuevos artículos de astronomía portaban un rastro de asistencia de modelos de lenguaje. Específicamente, calcularon que el 54 por ciento de los artículos mostraban un patrón de vocabulario consistente con la ayuda de una computadora, con un margen de error que mantenía la cifra cómodamente por encima del 36 por ciento incluso bajo los supuestos más conservadores. Este número ha estado aumentando rápidamente; en 2024, la cifra rondaba el 20 por ciento, y para la primera mitad de 2026, había ascendido a casi el 87 por ciento. Esto sugiere que el uso de estas herramientas ha pasado de ser un experimento raro a una parte estándar del proceso de escritura para la mayoría de los astrónomos.
Sin embargo, la historia es más compleja que un simple conteo de artículos. Los investigadores encontraron que la "huella digital" de la computadora se está volviendo más difícil de ver. En los primeros días de 2023, los artículos que utilizaban estas herramientas tenían un exceso muy marcado de las palabras marcadoras específicas —unas 3.5 veces más que un artículo escrito por un humano—. Para 2026, ese exceso había caído a solo 1.5 veces la base de referencia. Esto sucedió porque los autores comenzaron a adaptarse. A medida que las palabras específicas como "delve" se hicieron famosas como señales de uso de computadora, los escritores dejaron de usarlas tan intensamente, o las editaron, haciendo que la mano de la computadora fuera menos obvia. Las herramientas se siguen utilizando, pero se están volviendo más sutiles, mezclándose de forma más natural con los estilos de escritura humanos.
Quizás el hallazgo más revelador es la brecha entre lo que está sucediendo y lo que se dice. Mientras que los investigadores estiman que el 54 por ciento de los artículos en 2025 contaban con asistencia, solo el 0.81 por ciento de esos artículos contenían una declaración formal indicando que se utilizó una computadora. En otras palabras, por cada artículo en el que un autor admitió el uso de la herramienta, hubo unos 66 artículos que mostraron los mismos rastros lingüísticos pero no dijeron nada al respecto. Los investigadores verificaron cuidadosamente sus métodos de detección y descubrieron que no estaban pasando por alto muchas declaraciones; el silencio parece ser real. La mayoría de los autores que hablaron dijeron que usaron las herramientas para la gramática, la claridad o la edición del lenguaje, tareas que muchos diarios ya permiten. La falta de divulgación no parece derivar de un intento de ocultar una mala conducta, sino de un deseo de evitar un estigma, ya que la comunidad científica aún no se ha puesto de acuerdo sobre si el uso de estas herramientas es aceptable.
El estudio concluye que el panorama de la escritura científica ha cambiado fundamentalmente. Las herramientas ya no son una novedad; son una fuerza dominante en la producción de artículos de astronomía. Los investigadores señalan que este cambio no es necesariamente una falla de integridad, sino un cambio en la práctica con el que la comunidad aún no se ha puesto al día. A medida que los rastros lingüísticos de estas herramientas continúan desvaneciéndose y se vuelven más difíciles de detectar, la ventana para medir su impacto se está cerrando. Los autores sugieren que el paso más urgente no es prohibir las herramientas o perseguir una señal que se desvanece, sino establecer una norma clara de divulgación. Si los autores simplemente declararan cuándo usaron estos apoyos, el campo podría avanzar sin la confusión de la asistencia oculta, convirtiendo una práctica que actualmente es ignorada en una que sea comprendida abiertamente.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.