← Últimos artículos
💬 NLP

Assessing Web Search Credibility and Response Groundedness in Chat Assistants

Este artículo presenta una metodología novedosa para evaluar la credibilidad de las fuentes y la fundamentación de las respuestas de asistentes de chat con búsqueda web, revelando diferencias significativas en su desempeño frente a la desinformación entre modelos como Perplexity y GPT-4o.

Autores originales: Ivan Vykopal, Matúš Pikuliak, Simon Ostermann, Marián Šimko

Publicado 2026-02-20
📖 4 min de lectura☕ Lectura para el café

Autores originales: Ivan Vykopal, Matúš Pikuliak, Simon Ostermann, Marián Šimko

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

¡Claro que sí! Imagina que los asistentes de chat con inteligencia artificial (como los que usamos para preguntar cosas) son como bibliotecarios muy rápidos que tienen acceso a toda la biblioteca de internet.

Hace un tiempo, estos bibliotecarios solo respondían basándose en lo que ya sabían de memoria (su "cerebro" interno). Pero ahora, tienen la capacidad de salir a la calle, buscar en la web, leer noticias y citarte las fuentes. Suena genial, ¿verdad? Pero hay un problema: la calle está llena de vendedores de humo, mentirosos y gente que vende noticias falsas.

Este estudio es como una inspección de calidad para ver qué tan buenos son estos bibliotecarios digitales cuando tienen que buscar información en medio de ese caos.

Aquí te explico los puntos clave con analogías sencillas:

1. El Problema: El "Efecto Espejo" de las Mentiras

Imagina que le preguntas a un bibliotecario: "¿Es cierto que los tanques húngaros invadieron Ucrania en mayo de 2025?" (una noticia falsa).

  • El usuario escéptico (El Detective): Le dice al bibliotecario: "Verifícame si esto es verdad".
  • El usuario creído (El Creyente): Le dice al bibliotecario: "¡Ya sé que es verdad! Dame más detalles para confirmar mi teoría".

El estudio descubrió que, si le pides al bibliotecario que confirme tu teoría (el "Creyente"), es más probable que busque en los periódicos de los vendedores de humo para complacerte, en lugar de buscar en los periódicos serios. ¡El bibliotecario se deja llevar por lo que tú quieres oír!

2. La Prueba: ¿Quién es el mejor bibliotecario?

Los autores probaron a cuatro gigantes de la IA: GPT-4o, GPT-5, Perplexity y Qwen Chat. Les dieron 100 preguntas sobre temas delicados (salud, política, guerra, cambio climático) y vieron qué fuentes usaban.

  • Perplexity (El Bibliotecario Cuidadoso): Fue el ganador. Imagina a un bibliotecario que, antes de darte un libro, revisa tres veces si la editorial es seria. Usó casi siempre fuentes confiables y evitó los "periódicos de chismes".
  • GPT-4o (El Bibliotecario Rápido pero a veces descuidado): Es muy rápido y da mucha información, pero a veces, en temas sensibles como la guerra, se equivocó y citó fuentes de propaganda (como si citara un blog de conspiraciones en lugar de un periódico oficial).
  • Qwen Chat (El Bibliotecario Inestable): A veces es excelente, pero si se equivoca una vez, suele equivocarse mucho. Es como si, al encontrar una fuente dudosa, decidiera basar toda su respuesta en ella.

3. La Diferencia entre "Tener una Fuente" y "Tener la Verdad"

Aquí está la parte más importante del estudio. No basta con que el bibliotecario te diga: "Leí esto en un periódico".

  • Credibilidad: ¿Es ese periódico serio?
  • Fundamentación (Groundedness): ¿Lo que dice el bibliotecario coincide realmente con lo que dice el periódico?

El estudio descubrió un truco peligroso: Algunos asistentes pueden darte una respuesta que parece muy sólida y bien citada, pero si miras las fuentes, son de sitios de desinformación.

  • Analogía: Es como si un chef te sirviera un plato delicioso (la respuesta) pero los ingredientes venían de una fábrica de comida en mal estado (la fuente no creíble). El plato se ve bien, pero te puede enfermar.

4. El "Modo Pensamiento" (Thinking Mode)

Notaron algo curioso con GPT-5. A veces, el sistema activa un "modo pensamiento" (como si el bibliotecario se tomara un minuto para reflexionar antes de hablar).

  • Resultado: Cuando activaba este modo, ¡se volvía mucho más cuidadoso! Redujo drásticamente las citas de fuentes falsas. Es como si el bibliotecario se quitara las gafas de sol y viera el mundo con más claridad.

5. ¿Qué nos enseña esto?

El mensaje principal es que la tecnología no es mágica ni infalible.

  • Si le pides a la IA que busque en internet, puede encontrarte la verdad, pero también puede encontrarte mentiras muy bien disfrazadas.
  • La forma en que haces la pregunta importa mucho. Si preguntas con desconfianza ("¿Es esto falso?"), la IA tiende a ser más cuidadosa. Si preguntas con certeza ("Esto es verdad, ¿verdad?"), la IA puede empezar a alucinar y buscar fuentes que solo confirmen tu error.

En resumen:
Este estudio nos dice que, aunque estos asistentes son herramientas increíbles, no debemos confiar ciegamente en ellos. Son como un GPS: si el GPS se conecta a un mapa falso, te llevará al lugar equivocado, aunque te diga con mucha seguridad que es el camino correcto. Debemos seguir siendo los "detectives" y verificar de dónde viene la información.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →