Articulo de referencia

Igualar

La equiparación de pruebas se refiere tradicionalmente al proceso estadístico de determinar puntuaciones comparables en diferentes versiones de un examen . [ 1 ] Se puede lograr...

La equiparación de pruebas se refiere tradicionalmente al proceso estadístico de determinar puntuaciones comparables en diferentes versiones de un examen . [ 1 ] Se puede lograr utilizando las puntuaciones observadas o utilizando la teoría de respuesta al ítem .

En la teoría de respuesta al ítem, la equiparación [ 2 ] es el proceso de colocar las puntuaciones de dos o más formas de prueba paralelas en una escala de puntuación común. El resultado es que las puntuaciones de dos formas de prueba diferentes se pueden comparar directamente o tratar como si provinieran de la misma forma de prueba. Cuando las pruebas no son paralelas, el proceso general se denomina vinculación. Es el proceso de equiparar las unidades y orígenes de dos escalas en las que se han estimado las habilidades de los estudiantes a partir de los resultados de diferentes pruebas. El proceso es análogo a equiparar grados Fahrenheit con grados Celsius mediante la conversión de medidas de una escala a otra. La determinación de puntuaciones comparables es un subproducto de la equiparación que resulta de equiparar las escalas obtenidas a partir de los resultados de las pruebas.

Objetivo

Supongamos que Dick y Jane realizan un examen para obtener la licencia en una profesión determinada. Dado que lo que está en juego (se obtiene la licencia para ejercer la profesión si se aprueba el examen) puede generar la tentación de hacer trampa, la organización que supervisa el examen crea dos versiones. Si sabemos que Dick obtuvo un 60 % en la versión A y Jane un 70 % en la versión B, ¿podemos saber con certeza quién tiene un mejor dominio del material? ¿Qué sucede si la versión A consta de preguntas muy difíciles, mientras que la versión B es relativamente fácil? Los análisis de equiparación se realizan para abordar precisamente este problema, de modo que las puntuaciones sean lo más justas posible.

La equiparación en la teoría de respuesta al ítem

Figura 1: Curvas características de la prueba que muestran la relación entre la puntuación total y la ubicación de la persona para dos pruebas diferentes en relación con una escala común. En este ejemplo, un total de 37 en la Evaluación 1 equivale a un total de 34,9 en la Evaluación 2, como se muestra en la línea vertical.

En la teoría de respuesta al ítem , las "ubicaciones" de las personas (medidas de alguna cualidad evaluadas mediante una prueba) se estiman en una escala de intervalo ; es decir, las ubicaciones se estiman en relación con una unidad y un origen. En la evaluación educativa, es común emplear pruebas para evaluar a diferentes grupos de estudiantes con el fin de establecer una escala común, igualando los orígenes y, cuando corresponda, también las unidades de las escalas obtenidas a partir de los datos de respuesta de las distintas pruebas. Este proceso se denomina igualación o equiparación de pruebas.

En la teoría de respuesta al ítem, existen dos tipos diferentes de equiparación: la equiparación horizontal y la vertical. [ 3 ] La equiparación vertical se refiere al proceso de equiparar pruebas administradas a grupos de estudiantes con diferentes habilidades, como estudiantes de diferentes grados (años de escolaridad). [ 4 ] La equiparación horizontal se refiere a la equiparación de pruebas administradas a grupos con habilidades similares; por ejemplo, dos pruebas administradas a estudiantes del mismo grado en dos años calendario consecutivos. Se utilizan diferentes pruebas para evitar los efectos de la práctica.

En términos de la teoría de respuesta al ítem, la equiparación es solo un caso particular del proceso más general de escalamiento , aplicable cuando se utiliza más de una prueba. Sin embargo, en la práctica, el escalamiento suele implementarse por separado para diferentes pruebas y luego se equiparan las escalas.

A menudo se distingue entre dos métodos de equiparación: la equiparación por persona común y la equiparación por ítem común . La equiparación por persona común implica la administración de dos pruebas a un grupo común de personas. La media y la desviación estándar de las posiciones en la escala del grupo en ambas pruebas se igualan mediante una transformación lineal. La equiparación por ítem común implica el uso de un conjunto de ítems comunes, denominados prueba de referencia, integrados en dos pruebas diferentes. Se iguala la posición media de los ítems comunes.

Igualación de puntuación observada

La igualación de medias simplemente ajusta la distribución de puntuaciones de modo que la media de una forma sea comparable a la media de la otra. Si bien la igualación de medias resulta atractiva por su simplicidad, carece de flexibilidad, concretamente, de la capacidad de considerar la posibilidad de que las desviaciones estándar de las formas difieran. [ 1 ]

La igualación lineal ajusta las puntuaciones de modo que las dos formas tengan una media y una desviación estándar comparables . Existen varios tipos de igualación lineal que difieren en los supuestos y las matemáticas utilizadas para estimar los parámetros. Los métodos de puntuación observada de Tucker y Levine estiman la relación entre las puntuaciones observadas en las dos formas, mientras que el método de puntuación verdadera de Levine estima la relación entre las puntuaciones verdaderas en las dos formas. [ 1 ]

La equiparación por percentiles determina la relación de equivalencia como aquella en la que una puntuación puede tener un percentil equivalente en cualquiera de las dos formas. Esta relación puede ser no lineal.

A diferencia de la teoría de respuesta al ítem, la equiparación de puntuaciones observadas es algo distinta del escalamiento. La equiparación es una transformación directa de puntuaciones brutas, ya que estima una puntuación bruta en el Formulario B equivalente a cada puntuación bruta del Formulario A base. Cualquier transformación de escalamiento utilizada se aplica posteriormente sobre la equiparación o junto con ella.

Véase también

Referencias

  1. 1 2 3 Kolen, MJ; Brennan, RL (1995). Test Equating . Nueva York: Spring. doi : 10.1007/978-1-4757-2412-7 . ISBN 978-0-387-94486-9.
  2. "Consejo Nacional de Medición en Educación" . Archivado del original el 22 de julio de 2017.
  3. Baker, F. (1983). "Comparación de métricas de habilidad obtenidas mediante dos procedimientos de teoría de rasgos latentes" . Medición psicológica aplicada . 7 : 97–110 . Archivado del original el 28 de enero de 2025.
  4. Baker, F. (1984). "Transformaciones de métricas de habilidad involucradas en la equiparación vertical bajo la teoría de respuesta al ítem" . Medición psicológica aplicada . 8 (3): 261– 271.
  • La equiparación y el SAT
  • Equiparación y exámenes AP
  • "IRTEQ: Aplicación de Windows que implementa el escalado y la equiparación IRT" . Archivado del original el 4 de julio de 2017.