Saltar al contenido
Mensura

Cómo funciona el test

Mensura sigue las mismas bases teóricas de los tests de inteligencia modernos: el modelo de habilidades CHC, la Teoría de Respuesta al Ítem y la aplicación adaptativa. Esto es lo que ocurre detrás de cada pregunta, y también lo que el test no es.

Qué se mide

El modelo Cattell-Horn-Carroll (CHC) organiza la inteligencia en una capacidad general (g) y habilidades amplias. El test tiene siete tipos de pregunta, cada uno ligado a una de ellas:

Tipo de preguntaHabilidad (CHC)Paradigma de origen
MatricesGf, razonamiento inductivoMatrices progresivas (Raven)
Series numéricasGf/Gq, inducción cuantitativaSeries de números
Deducción lógicaGf, razonamiento secuencialSilogismos lineales
BalanzasGq, razonamiento cuantitativoProblemas de equilibrio
Rotación mentalGv, procesamiento visualShepard y Metzler
Memoria de trabajoGwmSpan visoespacial y dígitos (orden directo e inverso)
Analogías verbalesGc, conocimiento y razonamiento verbalAnalogías A : B :: C : ?

Cada test reparte las preguntas por igual entre los siete tipos, así que la puntuación final refleja un conjunto amplio de habilidades y no un solo tipo de tarea.

Por qué ningún test es igual al anterior

Las preguntas no vienen de un banco fijo. Cada una se arma en el momento con un generador (generación automática de ítems), a partir de reglas cuya dificultad es conocida. En una matriz, por ejemplo, la dificultad crece con el número de reglas que actúan a la vez y con el tipo de regla: las progresiones son más fáciles que las distribuciones de tres valores. Cada pregunta guarda una semilla aleatoria y una firma; el sistema nunca muestra la misma pregunta dos veces a la misma persona.

Las alternativas también siguen un método. En las matrices, las ocho opciones son combinaciones de tres atributos, cada uno con el valor correcto o un valor equivocado plausible. Así cada característica aparece en la mitad de las opciones, y el truco de "elegir la figura más parecida a las demás" no funciona.

Cómo se ajusta la dificultad

El test es adaptativo. Después de cada respuesta, el sistema reestima tu habilidad y elige la siguiente pregunta con la dificultad que más informa sobre ti en ese punto. Quien acierta recibe preguntas más difíciles; quien falla, más fáciles. Las tres primeras son un poco más fáciles, para calentar. Por eso casi todo el mundo acierta entre la mitad y dos tercios de las preguntas, y eso es lo esperado.

Cómo se calcula la puntuación

Cada tipo y nivel de pregunta tiene parámetros del modelo logístico de tres parámetros (3PL) de la Teoría de Respuesta al Ítem:

P(acierto | θ) = c + (1 − c) / (1 + e−1,7·a·(θ − b))

La habilidad se estima con el método EAP (esperanza a posteriori), que combina todas las respuestas con una distribución inicial normal. La puntuación usa la escala tradicional de CI:

puntuación = 100 + 15 · θ

El sistema también calcula el error estándar de la estimación y muestra el intervalo de confianza del 95%. Es más estrecho en los tests más largos.

Precisión

Simulamos miles de participantes virtuales con habilidad conocida respondiendo según el modelo. La diferencia típica entre la puntuación estimada y la verdadera fue:

PreguntasError típico (puntos)Intervalo del 95%
205,2±9
403,7±7
603,2±5
1002,3±4

En los extremos (por debajo de 70 o por encima de 130) la estimación tiende ligeramente hacia el centro, un efecto conocido del método EAP.

Calibración con datos reales

Al principio, los parámetros de cada pregunta vienen del modelo teórico de dificultad de cada generador. A medida que las personas responden, una rutina reestima esos parámetros con datos reales y el motor empieza a usarlos. Todavía no hay datos suficientes para ninguna recalibración.

Lo que este test no es

Usa el resultado como un retrato divertido e informativo de tus habilidades de razonamiento. Si necesitas una evaluación real, busca a un psicólogo colegiado.

Referencias