How Many Interviews Are Enough in a Software Engineering Study? Preliminary Findings on Sample Size and Saturation
Este artículo analiza estudios de ingeniería de software empírica publicados entre 2016 y 2025 para revelar que los tamaños de las muestras de entrevistas suelen oscilar entre 13 y 24 participantes, mientras que las justificaciones de la adecuación y la saturación de la muestra se informan de manera inconsistente y a menudo dependen de un razonamiento implícito en lugar de una discusión metodológica explícita.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
Imagina que estás tratando de determinar el tamaño perfecto para un chat grupal para resolver un misterio. ¿Necesitas un pequeño escuadrón de tres expertos o un ejército masivo de cincuenta? Un equipo de investigadores de universidades de Canadá, Estados Unidos y Brasil decidió investigar exactamente esta pregunta, pero en lugar de investigadores de misterios, analizaron a ingenieros de software que utilizan entrevistas para estudiar cómo las personas construyen y trabajan con la tecnología.
No se limitaron a adivinar; emprendieron una búsqueda del tesoro digital a través de las conferencias y revistas más importantes de ingeniería de software desde 2016 hasta 2025. Filtraron miles de artículos, eliminando el ruido hasta encontrar 429 estudios que realmente utilizaron entrevistas. En total, estos estudios hablaron con 7,444 personas.
La zona "Goldilocks" de las entrevistas
Cuando los investigadores analizaron los datos, descubrieron que no existe un único "número mágico" de cuántas personas necesitas entrevistar. No es como hornear un pastel donde debes usar exactamente dos huevos. En cambio, el tamaño del grupo depende enteramente de la receta que estés cocinando.
Sin embargo, si tuvieras que elegir el tamaño más común, los investigadores encontraron que el "punto ideal" para la mayoría de los estudios de ingeniería de software está entre 13 y 24 entrevistados. Este fue el rango más frecuente, apareciendo en 152 de los artículos que estudiaron.
¡Pero el rango era salvaje!
- Algunos estudios eran diminutos, hablando con solo una persona (como una inmersión profunda en un solo hacker o un gerente específico).
- Otros eran masivos, entrevistando a más de 100 personas.
- El estudio promedio habló con alrededor de 17.35 personas.
Los investigadores sugieren que, si estás planeando un estudio y necesitas un punto de partida, apuntar a ese rango de 13 a 24 podría ser una apuesta segura, ya que es lo que la mayoría de los otros investigadores están haciendo. Pero son muy claros: esto no es una regla estricta. Si estás estudiando un grupo súper especializado (como expertos en seguridad sénior) que son difíciles de encontrar, un grupo pequeño de menos de 5 personas es perfectamente normal y aceptable.
El misterio de la "señal de alto"
En el mundo de las entrevistas, existe un concepto llamado saturación. Piensa en ello como llenar un cubo con agua. Sigues vertiendo (haciendo preguntas) hasta que el cubo está lleno y no cabe más agua nueva (nuevas ideas). Una vez que llegas a ese punto, te detienes.
Los investigadores descubrieron que muchos ingenieros de software son un poco vagos sobre cuándo alcanzaron ese momento del "cubo lleno".
- La buena noticia: La mayoría de los estudios explicaron por qué eligieron a las personas que eligieron (como "necesitábamos a alguien del equipo de seguridad" o "queríamos ver diferentes empresas").
- La pieza faltante: Muchos estudios no explicaron claramente cuándo decidieron dejar de entrevistar. A menudo simplemente se detenían sin decir: "Bien, escuchamos lo mismo tres veces seguidas, así que terminamos".
Los investigadores notaron que las discusiones claras sobre este "punto de parada" se encontraban principalmente en estudios que utilizaban un método específico llamado teoría fundamentada (grounded theory). En otros tipos de estudios, la decisión de detenerse era a menudo una suposición o se basaba en límites prácticos (como quedarse sin tiempo o dinero), en lugar de una regla metodológica estricta.
A lo que este artículo dice "no"
Es importante saber lo que este artículo no dice.
- No dice que los estudios pequeños (como aquellos con solo 5 a 12 personas) sean malos o "demasiado blandos". Los investigadores argumentan que si tienes una buena razón (como estudiar a un experto poco común), un grupo pequeño está totalmente bien.
- No dice que debas usar un número específico de personas para ser un científico "real". Argumentan explícitamente contra la idea de que exista un número universal que funcione para cada estudio.
- No afirma haber resuelto el problema de cómo elegir un tamaño de muestra para siempre. En cambio, sugieren que estos hallazgos son preliminares y emergentes. Son como un primer borrador de un mapa, que muestra el terreno general pero promete explorar más en el futuro.
La conclusión
El mensaje principal es que, en la ingeniería de software, el número "correcto" de entrevistas es algo flexible. Depende de con quién estés hablando, qué tan difíciles sean de encontrar y qué sea lo que intentas aprender.
Los investigadores sugieren que, en lugar de preocuparse por alcanzar un número mágico, los científicos deberían ser más honestos sobre por qué eligieron su tamaño de grupo y cómo supieron que habían terminado. Quieren que el campo se aleje de las reglas rígidas y se dirija hacia explicaciones claras, para que un estudio con 3 expertos sea juzgado por su profundidad, no solo por su conteo, y un estudio con 50 personas sea juzgado por su amplitud.
Por ahora, los datos sugieren que 13 a 24 es el camino más común, pero el viaje está abierto a muchas rutas diferentes.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.