← Últimos artículos
💬 NLP

Em-ergence of the em-dash: a population-level rise in em-dash frequency in medRxiv preprints at the dawn of the large-language-model era

Este estudio preregistrado analiza más de 69.000 preimpresiones de medRxiv para revelar un aumento significativo y gradual a nivel poblacional en el uso de la raya tras la aparición de los modelos de lenguaje de gran tamaño, lo que sugiere un cambio estilístico distintivo en la escritura científica durante los inicios de la década de 2020.

Autores originales: Przemysław Czuma

Publicado 2026-06-30
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Przemysław Czuma

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que eres un detective tratando de averiguar si una enorme biblioteca de notas médicas ha sido tocada por una mano nueva e invisible. No estás buscando huellas dactilares o ADN; estás buscando un signo de puntuación específico y diminuto: la raya (—).

Aquí está la historia de lo que encontró el papel, contada de forma sencilla.

El Misterio: Un "Error" que no lo es

Durante años, los científicos han susurrado un rumor: "Los Modelos de Lenguaje Extensos" (como ChatGPT) aman usar rayas. Los humanos, por otro parte, suelen encontrarlas molestas o difíciles de escribir, por lo que las usan con moderación. Es como cómo un humano podría escribir una oración con una coma, pero un robot podría escribirla con un guion dramático para que suene más "profesional".

Pero hasta ahora, esto era solo un chisme. Nadie había contado realmente las rayas en miles de artículos científicos reales para ver si el rumor era cierto.

La Investigación: Contando Rayas en un Mar de Texto

El investigador, Przemysław Czuma, decidió jugar a ser detective a gran escala. No miró libros publicados (que a menudo son "limpiados" por editores y pierden su puntuación original), sino que miró medRxiv, un servidor donde los científicos publican sus borradores crudos y sin editar (preprints) antes de que sean publicados.

  • El Objetivo: Se centró en la sección de "Discusión" de estos artículos. Esta es la parte donde los científicos cuentan una historia, explican sus sentimientos sobre los resultados y tratan de persuadir al lector. Es la parte más "humana" de un artículo.
  • La Herramienta: Utilizó un programa informático para escanear más de 69,000 de estos borradores, buscando específicamente el carácter de la raya (—).
  • La Línea de Tiempo: Dividió los datos en dos eras:
    1. Antes de ChatGPT (antes de noviembre de 2022).
    2. Después de ChatGPT (después de noviembre de 2022).

Los Hallazgos: Un Fuego Lento, No un Destello

Los resultados fueron dramáticos, pero no ocurrieron de la noche a la mañana como si se encendiera un interruptor de luz.

  • Antes del auge de la IA: Solo alrededor del 4% de los artículos tenían incluso una sola raya en su sección de Discusión. Era raro.
  • Después del auge de la IA: Ese número saltó al 11.5%.
  • La Tendencia: No sucedió inmediatamente en 2023. El número se mantuvo bajo, luego comenzó a subir lentamente, y para 2025, se había disparado al 20%.

La Analogía: Imagina una fiesta tranquila donde casi nadie lleva sombreros rojos. Luego, una nueva tendencia de moda comienza. Al principio, solo unas pocas personas lo intentan. Después, lentamente, más personas se unen. Para el año siguiente, casi uno de cada cinco asistentes a la fiesta lleva un sombrero rojo. Eso es lo que pasó con la raya.

La Prueba: Descartando Otros Sospechosos

Un buen detective verifica si existen otras explicaciones. El investigador realizó varias pruebas de "detector de mentiras" para asegurarse de que el aumento de las rayas no fuera simplemente una tendencia aleatoria o un cambio en la forma en que el sitio web formatea el texto.

  1. La Prueba de la "Sección Aburrida": Revisó las secciones de "Agradecimientos" y "Disponibilidad de Datos" (las partes estándar y aburridas de un artículo). Si todo el sitio web hubiera cambiado su formato, estas secciones también tendrían más rayas. No fue así. El aumento ocurrió solo en las partes de narración de historias.
  2. La Prueba de la "Fecha Falsa": Miró el tiempo antes de que existiera ChatGPT y fingió que una fecha aleatoria era el "inicio". Nada cambió. Esto demostró que el aumento no era solo una deriva lenta y natural a través del tiempo.
  3. La Prueba de la "Elección de Palabras": También buscó palabras específicas que los modelos de IA aman usar (como "delve" [profundizar], "groundbreaking" [innovador] o "leverage" [aprovechar]). Estas palabras aumentaron exactamente al mismo tiempo que las rayas.

Lo Que Significa (y lo Que No)

El artículo es muy cuidadoso con lo que afirma.

  • SÍ muestra: Algo grande cambió en la forma en que se escriben los artículos científicos entre 2022 y 2025. El estilo de escritura cambió de una manera que coincide con el auge de las herramientas de IA. La raya es una señal a "nivel de población", como notar que la altura promedio de una multitud aumentó, no que cada persona individualmente creció más alta.
  • NO muestra: No puedes mirar un solo artículo con una raya y decir: "Esto fue escrito por un robot". Un humano podría simplemente amar las rayas. Tampoco puedes mirar un artículo sin una raya y decir: "Esto es 100% humano".
  • La Conclusión: El estudio confirma que la "huella dactilar" de la escritura de IA se está volviendo visible en la literatura científica. No sucedió instantáneamente; sucedió a medida que los científicos comenzaron a confiar y utilizar estas nuevas herramientas para pulir y escribir sus historias.

En resumen: la raya es el "humo" que sugiere que un fuego (el uso de la IA) ha comenzado en la cocina de la escritura científica, incluso si no podemos señalar exactamente qué estufa se usó para cada una de las ollas.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →