← Últimos artículos
💬 NLP

Three Buddhist Vocabularies: Computational Stylometry of the English Pali Canon across Sutta, Vinaya, and Abhidhamma

Este artículo presenta un análisis estilométrico computacional del Canon Pali en inglés a través de los Pitakas Sutta, Vinaya y Abhidhamma, revelando perfiles léxicos distintos para cada corpus —tales como la mayor diversidad y densidad numeral del Abhidhamma, la herencia legal compartida de los Vinayas de la tradición Theravada y Mulasarvastivada, y variaciones de traducción significativas a lo largo del tiempo— al tiempo que confirma que todos los textos se adhieren a la ley de Zipf.

Autores originales: Joy Bose

Publicado 2026-06-25
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Joy Bose

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina el Canon Budista (el Tipitaka) como una biblioteca masiva que contiene tres alas distintas, cada una escrita por diferentes autores para propósitos diferentes. Durante mucho tiempo, los investigadores han estudiado el ala de los "Sutta" (las historias y sermones). Este artículo es como un nuevo bibliotecario que decide entrar en las otras dos alas, el Vinaya (el libro de reglas para los monjes) y el Abhidhamma (una enciclopedia técnica de la mente), y ejecutar un programa informático para ver cómo cambia el lenguaje mismo de una habitación a otra.

El investigador, Joy Bose, no leyó cada palabra para comprender la filosofía profunda. En su lugar, utilizó un "contador de palabras" y un "detector de patrones" para ver cómo se comporta el vocabulario. Esto es lo que encontró, explicado de forma sencilla:

1. Los tres "sabores" del lenguaje

Piensa en las tres secciones como tres tipos diferentes de fiestas:

  • El ala de los Sutta (Los cuentacuentos): Esta es la sala más grande. El lenguaje aquí es como una historia de fogata. Repite las mismas frases con frecuencia (como "el monje dijo" o "cuatro cosas"). La computadora encontró que las palabras aquí son muy repetitivas, creando un ritmo constante y rítmico.
  • El ala del Vinaya (El libro de reglas): Esta sala está llena de instrucciones legales. Es sorprendentemente similar a la de los Cuentacuentos en cuanto a su repetitividad. Tanto si lees la traducción moderna (Brahmali) como la antigua (Horner), el "ritmo del vocabulario" es casi idéntico. Es como si dos personas distintas estuvieran leyendo la misma guía telefónica; las palabras pueden cambiar ligeramente, pero la estructura es la misma.
  • El ala del Abhidhamma (La enciclopedia): Esta es la que resulta extraña. Es un manual técnico que enumera 52 tipos de sentimientos y 89 tipos de conciencia. Debido a que tiene que nombrar tantos elementos únicos y específicos, utiliza una variedad de palabras mucho más amplia. Es menos repetitiva y se siente más como un libro de texto científico moderno que como una historia.

2. La prueba de "Zipf": ¿Quién es la estrella del espectáculo?

Los investigadores utilizaron una famosa regla matemática llamada Ley de Zipf. Imagina un concierto de rock donde un cantante canta el 50% de las canciones, el segundo cantante el 25%, y el resto se reparten el tiempo restante. En la mayoría de los textos, unas pocas palabras comunes (como "el", "y", "eso") dominan los primeros puestos.

  • En las Historias y las Reglas: Las 10 palabras principales son principalmente conectores gramaticales (como "eso" o "ellos").
  • En la Enciclopedia: La computadora encontró algo extraño. La palabra "Conciencia" saltó al top 10, desplazando a las palabras gramaticales. Es como si, en una biblioteca de manuales técnicos, la palabra "Motor" apareciera con tanta frecuencia que ahoga a la palabra "El". Esto demuestra que la Enciclopedia está obsesionada con conceptos específicos, no solo con la narración de historias.

3. El "Solapamiento de Vocabulario" (¿Cuánto comparten?)

Los investigadores preguntaron: Si tomas un puñado de palabras del Libro de Reglas, ¿cuántas de ellas encontrarías también en el Libro de Historias?

  • El resultado: Aproximadamente la mitad de las palabras en el Libro de Reglas también están en el Libro de Historias. Comparten un lenguaje común porque forman parte de la misma tradición.
  • La prueba del "Viaje en el Tiempo": Los investigadores compararon el Libro de Reglas Theravada (utilizado en Sri Lanka/Tailandia) con el Libro de Reglas Mulasarvastivada (utilizado en el Tíbet) de hace 2.000 años. Aunque se separaron hace dos milenios, todavía comparten el 50% de su vocabulario. Es como descubrir que un diccionario estadounidense moderno y uno británico del siglo XIX todavía comparten la mitad de sus palabras, demostiendo que provienen de la misma familia.

4. El "Cambio de Traducción" (Cómo cambia el lenguaje con el tiempo)

Los investigadores tomaron exactamente el mismo texto del Libro de Reglas y compararon dos traducciones: una de 1938 y una de 2026.

  • La sorpresa: ¡Solo compartían el 24% de su vocabulario! Esa es una brecha enorme para el mismo texto.
  • La causa: No fue que el significado cambiara, sino que las palabras cambiaron.
    • Ejemplo 1: En 1938, un estado profundo de meditación se llamaba "musing" (que suena un poco como "soñar despierto"). En 2026, se llama "absorption" (que suena mucho más enfocado).
    • Ejemplo 2: Una falta grave se llamaba "defeat" (derrota) en 1938, pero "expulsion" (expulsión) en 2026.
    • Ejemplo 3: El traductor de 2026 fue más directo sobre la anatomía y los temas de género, mientras que el traductor de 1938 utilizó un lenguaje cortés y vago.

5. El conteo de "Números"

La Enciclopedia (Abhidhamma) está obsesionada con contar. Utiliza palabras numéricas (uno, dos, tres, cuatro) el 3,26% de las veces. El Libro de Historias las utiliza solo el 2,09% de las veces. Esto tiene sentido: si estás enumerando 89 tipos de conciencia, tienes que decir "uno", "dos", "tres" mucho más a menudo que si solo estás contando la historia de un monje caminando por el bosque.

Resumen

Este artículo es como una radiografía lingüística. No nos dice qué enseñó el Buda en detalle profundo, sino que nos muestra cómo se empaquetó la enseñanza.

  • Las Historias son rítmicas y repetitivas.
  • Las Reglas son procedimentales y compartidas a través del tiempo.
  • Las Enciclopedias son densas, técnicas y llenas de términos únicos.
  • Las Traducciones cambian drásticamente en 88 años, intercambiando palabras anticuadas por otras modernas y precisas.

El investigador concluye que, si bien podemos ver estos patrones claramente con computadoras, la pregunta más profunda sobre cómo evolucionaron estas ideas a lo largo del tiempo requiere un análisis humano más profundo a nivel de concepto, lo cual es el siguiente paso en su trabajo.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →