← Últimos artículos
💻 computer science

The Reciprocal Impact of Science and Software: A Cross-Corpus Analysis of How Research Shapes Software and Software Enables Research

Este estudio construye un grafo de gran escala transcorpus que vincula la literatura científica y los repositorios de software para revelar que, si bien la ciencia y el software coevolucionan a través de capas de influencia distintas y complementarias, los métodos de medición actuales siguen siendo escasos y sensibles a las elecciones metodológicas, lo que impide conclusiones definitivas sobre su impacto recíproco.

Autores originales: Audris Mockus

Publicado 2026-07-07
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Audris Mockus

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina el mundo del descubrimiento científico como una ciudad enorme y bulliciosa. Durante mucho tiempo, esta ciudad ha estado dividida en dos distritos separados que rara vez se comunican entre sí:

  1. El Distrito de la Biblioteca: Aquí es donde los científicos publican sus artículos. Se mide por cuántas personas piden prestados libros (citas) y qué tan famosos son los autores.
  2. El Distrito del Taller: Aquí es donde se construyen las herramientas, el código y el software reales. Se mide por cuántas personas le dan "estrella" (star) a un proyecto en GitHub o cuántas veces se ha bifurcado (fork) su código.

¿El problema? Estos dos distritos están usando mapas diferentes. Un científico puede construir una herramienta revolucionaria en el Taller, pero la Biblioteca no se entera de ello. Inversamente, un artículo famoso en la Biblioteca puede depender de una herramienta diminuta e invisible en el Taller que nadie menciona jamás.

Este artículo, de Audris Mockus, intenta construir un puente entre estos dos distritos para crear un mapa único y unificado de cómo funciona realmente la ciencia. El autor lo llama la "Cadena de Suministro de Ciencia-Software".

Aquí se explica lo que el estudio encontró, a través de analogías sencillas:

1. La calle de doble sentido

Los investigadores conectaron dos bases de datos gigantes: una que contiene casi todo el código de software público (World of Code) y otra que contiene artículos científicos (Semantic Scholar/OpenAlex). Observaron las conexiones en dos direcciones:

  • Dirección A (Ciencia \rightarrow Software): ¿Qué artículos científicos realmente moldean las herramientas que usan los científicos?

    • La sorpresa: No son los artículos más famosos con más citas. En cambio, las herramientas que se adoptan más son aquellas que ayudan a los científicos a empaquetar y organizar su trabajo (como "nf-core" o "Nextflow").
    • La analogía: Piensa en esto como un sitio de construcción. El arquitecto más famoso (el artículo altamente citado) puede diseñar un edificio hermoso, pero las herramientas que serán utilizadas por todas las cuadrillas de construcción son los andamios y las grúas (las herramientas de empaquetado). El artículo cuenta la fama del arquitecto, pero el software cuenta la utilidad de los andamios.
  • Dirección B (Software \rightarrow Ciencia): ¿Qué herramientas de software permiten realmente nuevos descubrimientos científicos?

    • La sorpresa: Las herramientas que habilitan la mayor parte de la ciencia suelen ser invisibles. Son la "infraestructura oculta" como PyTorch (para IA) o las herramientas de visualización de datos. Rara vez se mencionan en los títulos de los artículos, pero miles de otros proyectos dependen de ellas.
    • La analogía: Imagina una ciudad masiva donde todos conducen por carreteras. No ves las carreteras en las noticias sobre los coches; solo ves los coches. Pero si las carreteras desaparecieran, los coches se detendrían. Estas herramientas de software son las carreteras. Son esenciales, pero como están en todas partes, nadie se detiene a escribir un artículo diciendo: "Hoy usé una carretera".

2. La trampa de la calificación por "Estrellas"

En el mundo del software, la gente suele juzgar la importancia de una herramienta por cuántas "estrellas" (likes) recibe en GitHub. El estudio encontró que las estrellas son un pésimo predictor del uso real.

  • La analogía: Imagina un restaurante. Un lugar con 500 "likes" en una aplicación de redes sociales puede ser un sitio de moda al que la gente visita una vez para una foto. Pero un lugar con solo 10 likes puede ser la panadería local que suministra pan a 10,000 otros restaurantes cada mañana.
  • El hallazgo: El estudio encontró una conexión muy débil entre las "estrellas" y las "dependencias" (cuántos otros proyectos usan realmente el código). Una herramienta con 150 estrellas puede ser usada por 9,000 otros proyectos, mientras que una herramienta con 50,000 estrellas puede ser usada por muy pocos. La popularidad no es igual a la utilidad.

3. La brecha "Invisible"

Los investigadores intentaron contar con qué frecuencia los artículos mencionan el software. Encontraron una brecha masiva.

  • El problema: Cuando los científicos escriben artículos, a menudo mencionan el software en medio del texto (en la sección de "métodos") en lugar de en la lista de referencias formal. Las herramientas automatizadas suelen pasar por alto estas menciones.
  • El resultado: El vínculo entre un artículo y el software que utiliza es "disperso" y "ruidoso". Es como intentar mapear un árbol genealógico usando solo los nombres que la gente grita en una fiesta, en lugar de mirar los certificados de nacimiento reales. Debido a que los datos están tan incompletos, los investigadores no pudieron dar un único número perfecto de cuánto impacta el software en la ciencia. En su lugar, demostraron que diferentes formas de medir dan diferentes respuestas, y debemos tener cuidado de no confiar en un solo número.

4. Los nuevos trabajadores: Agentes de IA

El estudio también observó un nuevo fenómeno: los agentes de codificación de IA (robots que escriben código).

  • El hallazgo: Estos agentes de IA están empezando a aparecer en proyectos de software científico. No están reemplazando a los humanos todavía, pero se están uniendo a la fuerza laboral.
  • ¿Quién los usa? No se trata del tipo de ciencia (como biología frente a física). En cambio, los agentes de IA son utilizados por proyectos activos y de movimiento rápido. Si un proyecto es joven y sus desarrolladores están programando furiosamente, es más probable que utilicen ayudantes de IA. Es como una startup que se mueve rápido y utiliza nuevos dispositivos, en lugar de una fábrica establecida y lenta.

La gran conclusión

Este artículo argumenta que debemos dejar de ver la ciencia y el software como cosas separadas.

  • Visión antigua: La ciencia son los artículos; el software es solo una herramienta.
  • Nueva visión: La ciencia es una cadena de suministro. Los artículos y el software son bienes de igual importancia.

Para comprender verdaderamente el progreso científico, no podemos limitarnos a contar citas o "estrellas". Necesitamos ver las dependencias: la red invisible de código que sostiene todo. Así como una ciudad necesita conocer sus tuberías de agua y redes eléctricas, no solo sus edificios famosos, la comunidad científica necesita valorar el software del "héroe oculto" que hace posible el descubrimiento, aunque nadie escriba un artículo sobre él.

En resumen: Las herramientas más importantes en la ciencia son a menudo aquellas de las que nunca oyes hablar, y las herramientas más populares son a menudo las que realmente no necesitas. Para solucionar esto, necesitamos un mejor mapa que conecte la Biblioteca con el Taller.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →