CONSISTENCIA, VALIDEZ Y ERROR DE MEDICIÓN
Desde el punto de vista psicométrico, una prueba tiene que poseer dos características para que se
pueda considerar como buen instrumento de medición:
Confiablidad
Validez
Un buen modo de tomar en consideración los conceptos de confiabilidad y validez es el examinar las
variables que influyen en los resultados de las pruebas.
Cualquier variable que produce resultados inexactos se podrá considerar que introduce un error.
Existen diversos tipos de errores pero dos de ellos son de particular importancia.
No Sistemáticos (al azar). En éstos existe falta de consistencia en los resultados de una prueba a
otra.
Sistemáticos (constantes). Son los que producen efectos no irrelevantes para los fines de la
medición, aun cuando sean efectos consistentes.
Consistencia
Puesto que la conducta humana tiende a fluctuar de vez en cuando y de situación en situación, debemos
de interesarnos por la consistencia de las calificaciones de las pruebas.
Además, cualquier prueba contiene sólo una muestra de todos los reactivos posibles y es aplicada en un
momento en particular. Así, el muestreo de reactivos, las circunstancias de aplicación de la prueba y las
características del sujeto pueden introducir errores en la medición.
LA ECUACIÓN BÁSICA
Los conceptos fundamentales de la teoría de la confiabilidad se pueden presentar mejor mediante la
idea de una “calificación verdadera o real”.
X=T+E
Dónde X es la calificación obtenida; T es la calificación real hipotética y E es el error de medición.
El error de medición representa la contribución de cualquier variable que produzca inconsistencias en
las mediciones. Puede ser positivo o negativo.
Si es positivo, la calificación real de la persona se sobreestimará.
Si es negativa, se subestimará su calificación real.
Debido a que la confiabilidad es una propiedad de la prueba utilizada, y no de la calificación obtenida
por un individuo, se necesita una ecuación análoga para un grupo de personas.
sX2=sT2+sE2
Dónde la varianza de las calificaciones observadas (sx2) es igual a la varianza de las calificaciones reales
(sT2) más la varianza del error (sE2).
DEFINICIÓN DE CONFIABILIDAD
En la ecuación anterior se muestra la relación de las calificaciones obtenidas, las reales y el error; pero
no se define la confiablidad. Ésta última se puede definir como la razón de la varianza real de un
conjunto de calificaciones de una prueba con la varianza total u obtenida.
rxx=sT2/sX2
En donde la confiabilidad de la prueba es igual a la varianza de las calificaciones reales y las
calificaciones obtenidas.
La confiabilidad se refiere a la consistencia dentro de un conjunto de mediciones y no a la calificación de
un individuo.
Puesto que es imposible medir directamente la calificación real y la varianza real, la fórmula para la
confiabilidad quedaría como:
rxx=(sX2- sE2)/ sX2
TIPOS DE CONFIABILIDAD
Con frecuencia, deseamos conocer la estabilidad de la ejecución a través del tiempo, o sea, la
consistencia entre las calificaciones obtenidas en una prueba y una reaplicación en una fecha
posterior. En estos casos, calculamos un coeficiente de estabilidad.
En ocasiones, nos interesa la correspondencia entre los resultados obtenidos en dos formas,
supuestamente equivalentes de la prueba. En este caso, nuestra estimación será un coeficiente
de equivalencia.
También se pueden combinar los dos procedimientos y determinar la consistencia de los
resultados entre dos formas de una prueba separadas por un intervalo de tiempo. Esto nos da
un coeficiente de equivalencia y estabilidad.
Otro grupo de estimaciones de confiabilidad se enfoca en la consistencia de la ejecución a través
de los reactivos que constituyen la prueba, es decir, la consistencia interna de la prueba. Es
decir, se trata de determinar si todos los reactivos de la prueba miden el mismo rasgo o la
misma característica. Conocidas también como índices de homogeneidad.
DEFINICIÓN DE ERROR
El error es cualquier efecto irrelevante para los fines o resultados sobre las faltas de consistencia en la
medición.
Esta definición indica que se puede considerar que una variable introduce error si:
No tiene que ver con las finalidades de la medición
Produce faltas de consistencia en las calificaciones de una situación a otra.
Si una variable irrelevante produce un cambio constante o sistemático en las calificaciones de una
prueba, sus efectos no se detectarán en un análisis de confiabilidad, debido a que no produce
inconsistencia en los resultados.
Las fuentes de error más comunes son:
Errores de la prueba.- Principalmente variaciones resultantes del muestreo de reactivos.
Condiciones de aplicación del instrumento de medición.- Situación física, instrucciones, factores
de distracción y errores en el registro del tiempo.
Cambios dentro del sujeto mismo
i. Efectos a largo plazo como la educación, maduración, cambios en el ambiente.
ii. Efectos a corto plazo como el ánimo, salud y atención.
Validez
Debido a que la determinación de la validez puede incluir diversas preguntas y varios procedimientos, la
validez, como la consistencia, es siempre específica de las situaciones.
Esto quiere decir que, en condiciones diferentes, al utilizar muestras distintas o métodos diferentes de
análisis, se obtendrán resultados diversos.
El decir que una prueba es más válida que otra solo tiene sentido en si la declaración implica que se ha
descubierto que es válida en una variedad más amplia de situaciones o para un mayor número de
finalidades.
La validez de una prueba se define por medio de:
La extensión con la que una prueba mide un rasgo subyacente hipotético
La relación entre las calificaciones de la prueba y alguna medida de criterio externo.
Recordando que:
sX2=sT2+sE2
Entonces podemos definir la validez como la proporción de la varianza relevante, esto implica que la
varianza real se puede dividir en dos componente:
La varianza relevante (sV2)
Otra varianza confiable e irrelevante (sI2)
sT2=sV2+sI2
Sustituyendo:
sX2= sV2+sI2+sE2
Lo que quiere decir que, la variabilidad en un conjunto de calificaciones se determina por medio de la
varianza válida, la atribuible a causas confiables pero irrelevantes (errores constantes) y la varianza de
error de medición.
Se puede ver que, al disminuir la varianza de error (prueba confiable), aumenta la proporción de
varianza potencialmente válida. No obstante, puesto que la varianza sistemática restante puede ser
relevante o no, la baja varianza de error no garantiza una elevada validez.
Dicho de otro modo: Una baja varianza de error (alta confiabilidad) es una condición necesaria pero no
suficiente para tener una alta validez.
TIPOS DE VALIDEZ
Siguiendo las Normas para Pruebas Educativas y Psicológicas, considerearemos que la validez se clasifica
en tres clases principales:
Validez relacionada con el criterio
Validez de contenido
Validez de construcción