Less Back-and-Forth: A Comparative Study of Structured Prompting
Este documento demuestra que el uso de prompts mejorados con listas de verificación mejora significativamente la calidad de las respuestas de los modelos de lenguaje grandes en diversas tareas, al tiempo que reduce el esfuerzo del usuario y el consumo de tokens en comparación con los prompts crudos o los que incluyen preguntas de aclaración.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
Imagina que estás contratando a un asistente muy talentoso, pero ligeramente literal, para que te ayude con un gran proyecto. Quieres que redacte un resumen, planifique un viaje, explique una idea compleja o escriba algo de código.
Este artículo es esencialmente una prueba para ver cómo debes hablarle a este asistente para obtener el mejor resultado con la menor cantidad de idas y vueltas.
Los investigadores compararon tres formas diferentes de dar instrucciones (llamadas "prompts") a tres asistentes de IA diferentes (ChatGPT, Claude y Grok). Aquí está el desglose de su experimento y lo que descubrieron, utilizando analogías simples.
Las Tres Formas de Preguntar
El Prompt "Crudo" (El Susurro Vago):
- Qué es: Das una instrucción corta y básica, como "Planifica unas vacaciones" o "Resume esto".
- La Analogía: Esto es como acercarte a un chef y decirle: "Hazme la cena". No le has dicho qué te gusta, cuál es tu presupuesto o si tienes alergias. El chef tiene que adivinar. Podría preparar algo delicioso, o podría preparar algo que odies, obligándote a devolverlo a la cocina.
El Prompt "Lista de Verificación" (La Receta Detallada):
- Qué es: Reescribes tu solicitud usando una lista de verificación simple que añade tres cosas: Rol (quién es la IA), Contexto (para quién es y por qué) y Formato (cómo debe verse la respuesta).
- La Analogía: Esto es como darle al chef una tarjeta de receta específica: "Eres un chef de pastelería francesa. Soy vegetariano con un presupuesto de 50 dólares. Necesito un postre que parezca una flor y que quepa en un plato pequeño". El chef sabe exactamente qué hacer de inmediato.
El Prompt "Pregunta de Clarificación" (La Entrevista):
- Qué es: Le pides a la IA que se detenga y te haga a ti 1-3 preguntas antes de darte una respuesta.
- La Analogía: Esto es como si el chef dijera: "Espera, antes de cocinar, ¿puedes decirme tu presupuesto y tus restricciones dietéticas?". Tú respondes, y luego cocinan. Asegura que tengan la información correcta, pero requiere tiempo extra y turnos de conversación adicionales.
¿Qué Sucedió en la Prueba?
Los investigadores probaron estos tres métodos en cuatro tipos de tareas: resumir texto, planificar viajes, explicar conceptos y escribir código. Puntuaron los resultados basándose en qué tan correctas, claras y útiles eran las respuestas.
El Ganador: El Prompt de Lista de Verificación
- Calidad: El método de "Lista de Verificación" produjo las respuestas de mayor calidad. La IA entendió la tarea perfectamente y siguió todas las reglas.
- Esfuerzo: También fue el más rápido. Como las instrucciones eran tan claras, la IA lo hizo bien a la primera. No necesitaste tener una larga conversación ni devolverlo a la cocina.
- El Resultado: Fue el "punto dulce". Obtuviste una comida perfecta sin esperar a que el chef te hiciera preguntas ni sin recibir un plato malo que tuvieras que devolver.
El Subcampeón: La Pregunta de Clarificación
- Calidad: Estas respuestas fueron mejores que los prompts "crudos" vagos, pero no lograron superar al método de Lista de Verificación.
- Esfuerzo: Este método requirió el mayor esfuerzo. Como la IA tuvo que detenerse, hacer preguntas, esperar tu respuesta y luego responder, tomó casi el doble de "turnos" (conversaciones) para obtener un buen resultado.
- El Resultado: Fue útil, pero se sintió como una conversación más larga y agotadora.
El Perdedor: El Prompt Crudo
- Calidad: Estas fueron las respuestas más débiles. A menudo estaban incompletas, eran vagas o se perdían en el punto.
- Esfuerzo: Sorprendentemente, los datos mostraron que estos tomaron solo un turno, pero los investigadores notaron que en la vida real, probablemente tendrías que seguir pidiendo revisiones porque la primera respuesta solía ser mala.
- El Resultado: Obtuviste una respuesta rápida, pero probablemente no era lo que realmente querías.
La Gran Conclusión
El artículo concluye que invertir un poco de tiempo extra en escribir un prompt estructurado (usando una lista de verificación simple) te ahorra mucho tiempo después.
Piénsalo como hacer una maleta:
- Prompt Crudo: Lanzas la ropa al azar. Llegas a tu destino y te das cuenta de que olvidaste tus zapatos. Tienes que llamar a casa para arreglarlo (esfuerzo extra).
- Pregunta de Clarificación: Llamas a casa antes de hacer la maleta para preguntar: "¿Necesito zapatos?". Luego haces la maleta. Funciona, pero lleva tiempo tener la llamada.
- Prompt de Lista de Verificación: Usas una lista de empaque antes de empezar. Sabes exactamente qué llevar. Llegas y todo está perfecto de inmediato.
El estudio sugiere que para la mayoría de las personas y la mayoría de las tareas, simplemente organizar tu solicitud con una estructura clara (Rol, Contexto, Formato) es la forma más eficiente de obtener grandes resultados de la IA, evitando la necesidad de correcciones interminables de ida y vuelta.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.