← Últimos artículos
💬 NLP

Differentiating Between Human-Written and AI-Generated Texts Using Automatically Extracted Linguistic Features

Este estudio demuestra que, aunque el texto generado por IA imita el lenguaje humano, existen diferencias lingüísticas significativas en aspectos fonológicos, morfológicos, sintácticos y léxicos que pueden detectarse mediante herramientas automatizadas, lo que subraya la necesidad de mejorar los métodos de entrenamiento de la IA y de integrar dichas herramientas para la evaluación del lenguaje.

Autores originales: Georgios P. Georgiou

Publicado 2026-02-18
📖 4 min de lectura☕ Lectura para el café

Autores originales: Georgios P. Georgiou

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

¡Claro que sí! Imagina que este estudio es como un detective lingüístico que ha puesto a dos escritores a competir en una carrera de redacción, pero con un giro muy interesante: uno es un humano real y el otro es una Inteligencia Artificial (IA) muy avanzada (ChatGPT).

Aquí te explico qué descubrieron, usando analogías sencillas:

🕵️‍♂️ La Misión: ¿Quién es el impostor?

El objetivo del estudio era sencillo: encontrar las "huellas dactilares" invisibles que delatan si un texto fue escrito por una persona o por un robot.

Para hacerlo, tomaron 5 ensayos escritos por profesores humanos (expertos en inglés) y pidieron a ChatGPT que escribiera 5 ensayos sobre los mismos temas, con la misma longitud y estilo. Luego, usaron una herramienta digital llamada "Open Brain AI" (imagina que es como un escáner de rayos X para el lenguaje) para analizar cada palabra, sonido y estructura.

🔍 ¿Qué encontraron? (Las diferencias clave)

Aunque la IA escribe muy bien y parece humana a simple vista, el escáner reveló que tiene "manías" muy específicas. Aquí las diferencias más curiosas:

1. La "Fonética" (Los sonidos de las palabras)

Imagina que las palabras son como bloques de construcción.

  • La IA tiende a usar más bloques que suenan "duros" y con aire (sonidos sordos como la 's', 't', 'k') y más letras que se tocan con la lengua en la parte de los dientes (alveolares). Es como si la IA hablara con un acento muy "mecánico" y preciso.
  • Los Humanos, en cambio, usan más sonidos nasales (como la 'm' o 'n') y tienen una "entonación" (acento primario) más natural y variada.
  • La analogía: Si la IA fuera un robot, suena como un robot que intenta imitar una canción, pero siempre mantiene el mismo ritmo. Los humanos, en cambio, tienen más "baches" y variaciones naturales en su voz.

2. La "Gramática" (Las piezas del rompecabezas)

  • La IA es un coleccionista de sustantivos: Le encanta usar nombres de cosas (sustantivos) y palabras de unión (conectores) para atar todo. Sus frases son como edificios muy estructurados, pero un poco rígidos.
  • Los Humanos son más "personales": Usan más pronombres (yo, tú, él) y verbos auxiliares. Esto hace que el texto se sienta más como una conversación entre personas, con más perspectiva y emoción.
  • La analogía: La IA escribe como un manual de instrucciones (todo muy ordenado y formal). Los humanos escriben como si estuvieran contando una historia a un amigo (más fluido y personal).

3. El "Vocabulario" (El menú de palabras)

  • La IA es un chef gourmet: Tiende a usar palabras "difíciles" y complejas, como si quisiera impresionar al lector con un menú de lujo. Su texto es denso y muy académico.
  • Los Humanos son más prácticos: Usan más "palabras de servicio" (artículos, preposiciones, conectores simples) que hacen que la lectura sea más fácil y accesible.
  • La analogía: La IA pone un plato de comida muy elaborado y pesado en la mesa. El humano pone un plato delicioso pero fácil de comer, pensando en lo que le gusta a su invitado.

📊 ¿Cómo lo detectaron?

Los investigadores usaron dos métodos:

  1. La báscula (Prueba estadística): Pesaron cada tipo de palabra para ver si había mucha diferencia. ¡Y sí! La IA usaba muchas más palabras "difíciles" y "conectores", mientras que los humanos usaban más "pronombres".
  2. El filtro inteligente (Modelo LASSO): Imagina un filtro que deja pasar solo las pistas más importantes. Este filtro dijo: "¡Oye! Si ves muchas palabras difíciles y pocos pronombres, ¡es casi seguro la IA!".

💡 ¿Por qué es importante esto?

  1. Para detectar mentiras: Ahora sabemos que, aunque la IA es muy buena, no es perfecta. Tiene "tics" lingüísticos que podemos usar para saber si un alumno copió un ensayo o si un artículo fue escrito por un robot.
  2. Para mejorar a la IA: Los ingenieros pueden usar estos datos para "entrenar" a la IA y que suene más humana, menos robótica y más natural.
  3. Para educadores y médicos: Herramientas como la que usaron en este estudio pueden ayudar a los profesores a corregir textos más rápido o a los médicos a analizar el lenguaje de sus pacientes de forma automática.

🏁 Conclusión Final

El estudio nos dice que la IA es un excelente imitador, pero no un perfecto clon. Es como un actor que sabe todas las líneas del guion y la gramática perfecta, pero le falta el "alma" y las pequeñas imperfecciones naturales que hacen que un texto humano se sienta vivo.

Gracias a este estudio, ahora tenemos un mapa de las "zonas de peligro" donde la IA suele delatarse, lo que nos ayuda a entender mejor cómo funciona la tecnología y cómo usarla de forma responsable.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →