La validez indica si un instrumento mide realmente lo que pretende medir; la confiabilidad, si arroja resultados consistentes al repetirse. La validez se evalúa con juicio de expertos y validez de contenido/constructo; la confiabilidad, con coeficientes como el alfa de Cronbach, considerado aceptable a partir de 0.70.
¿Qué es la validez de un instrumento de investigación?
La validez es el grado en que un instrumento —cuestionario, escala, guía de entrevista— mide realmente el constructo que dice medir y no otra cosa. Un cuestionario sobre satisfacción laboral que en realidad captura clima organizacional tiene un problema de validez, aunque sus preguntas estén bien redactadas. Hernández Sampieri distingue tres tipos principales de validez que conviene documentar en el capítulo metodológico. Antes de evaluar estas propiedades conviene tener claro qué tipos de instrumento de recolección de datos existen y cuál corresponde a tu diseño de investigación.
Validez de contenido
Verifica que los ítems cubran de manera representativa todas las dimensiones del constructo. Se obtiene sometiendo el instrumento a juicio de expertos: entre 3 y 5 especialistas del área revisan cada ítem y califican su pertinencia, claridad y relevancia antes de la aplicación.
Validez de constructo
Comprueba que el instrumento se relaciona de forma coherente con la teoría que lo sustenta. Se analiza mediante análisis factorial exploratorio o confirmatorio, que agrupa los ítems según las dimensiones teóricas esperadas por el marco conceptual.
Validez de criterio
Compara los resultados del instrumento con un criterio externo ya validado —por ejemplo, correlacionar una escala de ansiedad propia con el inventario de Beck—. Si ambas mediciones correlacionan alto, el instrumento gana validez de criterio. Esta validez se subdivide a su vez en concurrente, cuando ambos instrumentos se aplican al mismo tiempo, y predictiva, cuando el criterio externo se mide meses después para comprobar que tu instrumento anticipa un resultado futuro.
¿Qué es la confiabilidad de un instrumento?
La confiabilidad es el grado en que un instrumento produce resultados consistentes y coherentes cada vez que se aplica en condiciones similares. Un instrumento confiable no necesariamente es válido: puede medir algo de forma estable, pero no aquello que interesa a la investigación. Por eso ambas propiedades se evalúan por separado y se reportan juntas en el capítulo de metodología.
¿Qué diferencia hay entre validez y confiabilidad?
La validez responde “¿mide lo que dice medir?”; la confiabilidad responde “¿lo mide de forma estable?”. La siguiente tabla resume cómo se evalúa cada una.
| Propiedad | Pregunta que responde | Cómo se evalúa |
|---|---|---|
| Validez de contenido | ¿Los ítems cubren el constructo completo? | Juicio de expertos |
| Validez de constructo | ¿Se relaciona con la teoría esperada? | Análisis factorial |
| Validez de criterio | ¿Coincide con un criterio externo validado? | Correlación con instrumento validado |
| Confiabilidad (consistencia interna) | ¿Los ítems miden de forma coherente entre sí? | Alfa de Cronbach |
| Confiabilidad (test-retest) | ¿Da el mismo resultado en dos aplicaciones? | Correlación entre dos mediciones |
¿Cómo se valida un cuestionario por juicio de expertos?

El juicio de expertos consiste en enviar tu instrumento a especialistas del área temática y metodológica para que evalúen cada ítem antes de aplicarlo a tu muestra. El proceso típico sigue estos pasos:
- Selecciona entre 3 y 5 expertos con experiencia comprobable en el tema o en metodología de investigación.
- Diseña una matriz de evaluación con criterios de claridad, pertinencia y relevancia por ítem, en escala del 1 al 4.
- Calcula el índice de validez de contenido (IVC) a partir de las calificaciones; un valor superior a 0.80 se considera aceptable.
- Ajusta o elimina los ítems señalados con observaciones antes de correr la prueba piloto.
¿Qué es el alfa de Cronbach y qué valor es aceptable?

El alfa de Cronbach es el coeficiente más usado para medir la consistencia interna de una escala: indica qué tan correlacionados están los ítems entre sí. Por consenso general en ciencias sociales, un valor de 0.70 o superior se considera aceptable; por debajo de 0.60 el instrumento requiere revisión antes de aplicarse a la muestra definitiva.
| Valor de alfa | Interpretación |
|---|---|
| > 0.90 | Excelente (revisa posible redundancia entre ítems) |
| 0.80 – 0.89 | Muy buena |
| 0.70 – 0.79 | Aceptable |
| 0.60 – 0.69 | Cuestionable, conviene ajustar ítems |
| < 0.60 | Inaceptable |
SPSS, jamovi o incluso Excel con la fórmula de varianzas pueden calcular el alfa a partir de los datos que arroje tu prueba piloto. Un alfa excesivamente alto, por encima de 0.95, no siempre es buena noticia: suele indicar que varios ítems son redundantes entre sí y podrías acortar el instrumento sin perder consistencia.
¿Qué otros métodos existen para calcular la confiabilidad además del alfa de Cronbach?
Además de la consistencia interna, existen otras dos formas de estimar la confiabilidad cuando el diseño de tu estudio lo permite. El método test-retest aplica el mismo instrumento a la misma muestra en dos momentos distintos, separados por dos o tres semanas, y correlaciona ambos resultados: una correlación alta indica estabilidad temporal. El método de formas paralelas, menos común porque exige construir dos versiones equivalentes del instrumento, compara los resultados de ambas versiones aplicadas al mismo grupo. En instrumentos con ítems dicotómicos (sí/no, correcto/incorrecto) se usa además el coeficiente KR-20, una variante del alfa de Cronbach diseñada específicamente para ese tipo de respuesta.
¿Necesito una prueba piloto antes de aplicar mi instrumento?
Sí: aplicar tu instrumento a una muestra pequeña —entre 15 y 30 personas con características similares a tu población, pero fuera de tu muestra final— es la única forma de calcular la confiabilidad antes de salir a campo con la versión definitiva. La prueba piloto también revela preguntas ambiguas, tiempos de aplicación reales y problemas de formato que el juicio de expertos no siempre detecta. Si vas a construir tu propio cuestionario desde cero, conviene revisar antes cómo diseñar una encuesta para tesis paso a paso, porque el orden de las preguntas y el tipo de escala elegido afectan directamente el alfa de Cronbach que obtendrás.
¿Cómo se relaciona la validez del instrumento con tus variables e hipótesis?
Un instrumento solo puede validarse si primero tienes claro qué constructo mide, y ese constructo normalmente se deriva de tus variables de investigación y de la hipótesis que estás poniendo a prueba. Si tu hipótesis plantea una relación entre autoestima y rendimiento académico, tu instrumento de autoestima debe demostrar validez de constructo específicamente frente a esa definición teórica, no frente a una definición genérica del concepto.
Errores comunes al validar un instrumento
- Reportar solo el alfa de Cronbach y omitir la validez. Un instrumento puede ser confiable y no válido; los comités piden evidencia de ambas propiedades.
- Usar menos de tres expertos. El índice de validez de contenido pierde solidez estadística con menos evaluadores.
- Calcular el alfa con la muestra final en vez de la piloto. Si detectas un alfa bajo después de recolectar todos tus datos, ya no puedes ajustar el instrumento a tiempo.
- No justificar el tamaño de la prueba piloto. Para dimensionar correctamente tanto la piloto como tu muestra definitiva, conviene revisar cómo calcular el tamaño de muestra de tu tesis.
- Adaptar un instrumento de otro país sin volver a validarlo. Traducir una escala no basta: el alfa de Cronbach y la validez de constructo deben recalcularse con población mexicana antes de darla por válida.
Documentar estas evidencias con rigor es parte de construir una metodología de la investigación sólida; herramientas como Tesify pueden ayudarte a organizar y redactar este apartado del capítulo metodológico con la estructura que suelen pedir los comités de titulación.
Preguntas frecuentes
¿Qué diferencia hay entre validez y confiabilidad?
La validez indica si el instrumento mide el constructo que pretende medir; la confiabilidad indica si lo hace de forma consistente al repetir la medición. Un instrumento puede ser confiable sin ser válido, por eso ambas propiedades se documentan por separado en tu tesis.
¿Qué es el alfa de Cronbach y qué valor es aceptable?
Es el coeficiente que mide la consistencia interna de una escala a partir de la correlación entre sus ítems. Un valor de 0.70 o superior se considera aceptable en ciencias sociales; valores por debajo de 0.60 indican que el instrumento necesita revisión.
¿Cómo se valida un cuestionario por juicio de expertos?
Enviando el instrumento a 3-5 especialistas que califican claridad, pertinencia y relevancia de cada ítem en una matriz de evaluación. Con esas calificaciones se calcula el índice de validez de contenido, donde un valor superior a 0.80 se considera aceptable.
¿Qué es la validez de constructo?
Es la evidencia de que el instrumento se relaciona con la teoría que sustenta el constructo que mide. Se comprueba mediante análisis factorial, que agrupa estadísticamente los ítems según las dimensiones teóricas esperadas.
¿Necesito una prueba piloto?
Sí. Es la única forma de calcular la confiabilidad de tu instrumento y detectar preguntas ambiguas antes de aplicarlo a tu muestra definitiva. Se recomienda aplicarla a 15-30 personas con características similares a tu población objetivo.
