Teoría y construcción de
pruebas psicológicas
Clase: Baremación
Patricio Mena Ch.
Proceso de construcción de un test
1. Definición del constructo
2. Construcción de un test provisional y selección
del tipo de escala
3. Aplicación a una muestra piloto
4. Análisis de los ítems
5. Estudio de la Fiabilidad de un test
6. Estudio de la validez de un test
7. Baremación
Interpretación de las puntuaciones
La puntuación directa de una persona en un test, depende de
las propiedades psicométricas de los ítems, por tanto, no es
directamente interpretable.
Para que la puntuación tenga sentido, la debemos interpretar
en base al:
-rendimiento de las restantes personas que componen el
grupo formativo, utilizando baremos o normas
Grupo formativo: la muestra de personas a las que se ha
aplicado el test para la obtención de los baremos (proceso
denominado baremación). Debe ser una muestra
representativa y con un tamaño suficiente
Baremos
Los baremos asignan a cada posible puntuación directa un valor
numérico que informa de su posición en relación con las puntuaciones
que obtienen las personas que integran el grupo normativo
El valor y sentido de los baremos dependerá de la
calidad, tamaño y adecuación del grupo normativo.
Existen distintos tipos de normas:
-Nacionales o regionales *La norma puede cambiar con
-Hombres o mujeres el paso con el tiempo, por lo
-Ocupaciones tanto conviene re-baremar
-Edades
En síntesis…
La puntuación directa de un test no es interpretable.
Para darle sentido a estas puntuaciones debemos referirlas
al rendimiento de los restantes sujetos que componen el
grupo normativo.
Existen diversos tipos de normas.
Se debe elegir una muestra representativa y de tamaño
suficiente de la población de referencia (normativa).
Tipos de baremos
Baremos comúnmente usados:
a) Baremos cronológicos
b) Baremos centiles (percentil)
c) Baremos típicos
a) Baremos cronológicos
Son utilizados con rasgos psicológicos que evolucionan con
la edad. Tiene sentido comprar la puntuación de un evaluado
con la que obtienen los de su misma edad y de edades
diferentes
Se lleva acabo mediante:
-Edad mental (EM)
-Cociente intelectual (CI)
Solo se usan estos baremos, cuando la media del test
aumenta con la edad. Porque si la media comienza a
estabilizarse o a decrecer, una puntuación se le podría
asignar a 2 o más edades. Por esta razón, son muy poco
utilizados
Ejemplo nº1
Supongamos que aplicamos un test de inteligencia a diferentes grupos de
edad (niños entre 5 y 14 años) y obtenemos las puntuaciones medias para
cada grupo de edad
Edad: 5 6 7 8 9 10 11 12 13 14 -Cociente intelectual: es el
Media:6 8 9 11 14 15 18 22 24 resultado de dividir la edad mental
27 entre la edad cronológica de la
-Edad mental: es la edad que persona y se multiplica por 100
𝐸𝑀
corresponde a su puntuación, en este 𝐶𝐼 = 100
𝐸𝐶
caso si un niño obtiene en el test una
puntuación directa de 14, se le asigna
un EM de 9 años Si un niño de 10 años obtiene una
puntuación directa de 18 pts.
Si su CI es igual a 100, indicará que su EM es igual a su EC, si el CI es mayor
a 100 indicará que posee una inteligencia mayor. Si su CI es menor a 100,
indicará que su inteligencia es inferior a la media del grupo
b) Baremos centiles
Asignan a cada puntuación del test su rango centil (o
rango percentil), el cual indica el porcentaje de personas del
grupo normativo que obtienen puntuaciones inferiores a dicha
puntuación.
«Rangos centiles: números enteros positivos comprendidos
entre el 1 y el 99»
Si la puntuación de un evaluado en un test de
autoritarismo es 120, poco podemos decir sobre eso su nivel de
autoritarismo, pero si su puntuación corresponde al percentil
95, podríamos concluir que el 95% de las personas tienen un
nivel de autoritarismo menor que el suyo o que sólo un 5% de
personas son tan autoritarias o más que el.
Ejemplo nº2
Aplicando la definición dada,
se deduce que el rango centil
de cada puntuación es el valor
de la columna puntaje
acumulado que corresponde a
la puntuación anterior. Por
ejemplo, para puntuación 16,
tendremos que obtener el
porcentaje acumulado de la
puntuación 15, que es 10%. Por
tanto, indica que el 10% de la
muestra obtuvo puntuaciones
menores a 16 (es decir, obtuvo
15 o menos puntos)
c) Baremos típicos
En estos baremos, es que las puntuaciones tipificadas
obtienen valor en su utilización. Se suele distinguir entre:
-Baremos típicos (puntaje Z)
-Baremos típicos normalizados (requiere de una
distribución normal)
-Baremos típicos derivados (Puntaje T y D)
-Baremos típicos
Una puntuación típica se obtiene aplicando la siguiente transformación
𝑥−𝑥
𝑧 𝑥=
𝑠𝑥
La puntuación típica obtenida puede ser positiva o negativa e
indica el número de desviaciones típicas que se aleja de la
media correspondiente. Conociendo la puntuación típica de
una persona en un test, podemos interpretar su puntuación a
partir de su cuantía y su signo. Las puntuaciones típicas
oscilan entre -3 y 3. Por ejemplo, si se obtiene una puntuación
típica -2.33, nos está indicando que la puntuación en el test X
se encuentra 2,33 desviaciones típicas por debajo de la media.
Inconvenientes de las puntuaciones típicas: asumen
valores no enteros y negativos, lo que puede
dificultar su interpretación.
-Baremos típicos derivados
Como los baremos típicos tiene dos inconvenientes que
dificultan su uso (valores no enteros y negativos). Con el
objeto de superar estas dificultades, se ha propuesto una
transformación lineal de las puntuaciones típicas, no
alterando las propiedades psicométricas de la escala original
y son más fáciles de interpretar.
Las principales escalas derivadas son las escalas T y D;
y se obtienen mediante la transformación que se muestra a
continuación