Articulo de referencia

Software psicométrico

El software psicométrico se refiere a programas especializados utilizados para el análisis psicométrico de datos obtenidos de pruebas , cuestionarios, encuestas o inventarios qu...

El software psicométrico se refiere a programas especializados utilizados para el análisis psicométrico de datos obtenidos de pruebas , cuestionarios, encuestas o inventarios que miden variables psicoeducativas latentes . Si bien algunos análisis psicométricos pueden realizarse utilizando software estadístico general como SPSS , la mayoría requiere herramientas especializadas diseñadas específicamente para fines psicométricos. [ 1 ]

Fuentes de software libre

Numerosas herramientas psicométricas gratuitas han sido desarrolladas por investigadores y educadores. Algunos sitios web y recursos destacados que ofrecen este tipo de software son:

  • CASMA en la Universidad de Iowa, EE. UU .: Alberga el conjunto de programas informáticos GENOVA para la teoría de la generalizabilidad .
  • Software de Harold Doran, PACER : Proporciona aplicaciones web y de escritorio para el análisis psicométrico.
  • REMP en la Universidad de Massachusetts, EE. UU .: Proporciona software de teoría de respuesta al ítem, cuya última actualización data de 2008.
  • Software de Brad Hanson : Ofrece bibliotecas de C++ para la teoría de respuesta al ítem (TRI).
  • Software de John Uebersax : Incluye software de análisis de clases latentes .
  • Software de J. Patrick Meyer, jMetrik : Proporciona software de código abierto para análisis psicométrico.
  • Software de PMaps : Especializada en software de evaluación psicométrica.
  • Directorio de software del Instituto de Medición Objetiva : Enumera varios programas psicométricos.
  • Software de Matthew Courtney, Kevin Chang, Eric Mei, Kane Meissel, Luke Rowe y Laila Issayeva .

También existe una herramienta R Shiny para el análisis Rasch reproducible , el funcionamiento diferencial de los ítems, la equiparación y el examen de los efectos de grupo.

Además, cada vez se puede encontrar un mayor número de paquetes para R en la sección "Modelos y métodos psicométricos" de la plataforma CRAN Task View.

Teoría clásica de los tests

La teoría clásica de los tests (TCT) es un enfoque para el análisis psicométrico que implica menos supuestos que la teoría de respuesta al ítem y es más adecuada para tamaños de muestra más pequeños.

Autopsia

Autopsych es una aplicación web gratuita y de código abierto con múltiples funciones para realizar simulaciones de la Teoría Clásica de los Tests (TCT) y modelos de Rasch. Las funciones de la TCT incluyen:

  • Porcentaje de respuestas correctas
  • Puntuaciones observadas para cada categoría de ítem
  • Correlaciones ítem-total
  • Correlaciones ítem-descanso (con intervalos de confianza especificados por el usuario)
  • Correlaciones biseriales/poliseriales entre ítem y punto de reposo
  • alfa de Cronbach
  • Alfa si se elimina
  • Matriz de correlación de Pearson completa (matriz de ítems) con niveles de significación estadística.

Autopsych también realiza varias funciones basadas en Rasch, entre ellas:

  • Análisis básico de múltiples facetas de Rasch para el funcionamiento diferencial de los ítems (DIF).
  • Equiparación de ítems fijos para matrices de respuesta a ítems dicotómicas
  • ANOVA unidireccional
  • Análisis de fiabilidad entre evaluadores

CITAS

CITAS (Hoja de cálculo para análisis de ítems y pruebas clásicas) es un libro de Excel gratuito diseñado para proporcionar puntuación y análisis estadístico de pruebas de aula. Los usuarios pueden escribir o pegar las respuestas a los ítems (ABCD) y las claves en el libro de trabajo, y los resultados se generan automáticamente. A diferencia de otros programas, CITAS no requiere conocimientos previos ni experiencia en análisis psicométrico, lo que lo hace accesible para docentes y profesores.

jMetrik

jMetrik es un software gratuito y de código abierto para realizar análisis psicométricos exhaustivos, desarrollado por J. Patrick Meyer en la Universidad de Virginia . Incluye métodos para:

El análisis de ítems de jMetrik incluye estadísticas de proporción, biserial puntual y biserial para todas las opciones de respuesta. Calcula varios coeficientes de fiabilidad, como el alfa de Cronbach , el lambda de Guttman y el coeficiente de Feldt-Gilmer. El análisis DIF utiliza curvas características de ítem no paramétricas y el procedimiento de Mantel-Haenszel , informando sobre tamaños del efecto y clasificaciones DIF de ETS. Los métodos IRT incluyen los modelos de Rasch , crédito parcial y escala de calificación, con métodos de igualación como media/media, media/sigma, Haebara y procedimientos de Stocking-Lord.

jMetrik también incluye:

jMetrik es una aplicación Java pura que se ejecuta en versiones de 32 y 64 bits de los sistemas operativos Windows , Mac y Linux , y requiere Java 1.6 en el ordenador anfitrión.

Artículo

Iteman es un programa comercial para Windows diseñado específicamente para el análisis de pruebas clásicas. Genera informes técnicos en Microsoft Word con gráficos, descripciones y tablas integradas. Iteman calcula la proporción y el índice biserial de cada ítem, las proporciones de subgrupos altos y bajos, y gráficos detallados del rendimiento de cada ítem. También proporciona estadísticas descriptivas , incluyendo la media, la desviación estándar, la fiabilidad y el error estándar de medición, para cada dominio y para las pruebas en general. Iteman está disponible a través de Assessment Systems Corporation.

Lertap

Lertap5 (Programa de Análisis de Pruebas del Laboratorio de Investigación Educativa) es un paquete de software integral para el análisis de pruebas y encuestas, desarrollado para computadoras Windows y Macintosh con Microsoft Excel . Lertap5 incluye:

  • Estadísticas de pruebas, ítems y opciones
  • Análisis de la consistencia de la clasificación y de las pruebas de dominio
  • Procedimientos de detección de trampas
  • Gráficos extensos (por ejemplo, líneas de trazado para opciones de artículos, errores estándar de medición condicionales, gráficos de sedimentación , diagramas de caja , histogramas, diagramas de dispersión ).

Lertap5 admite tanto el análisis de ítems de la Teoría Clásica de los Tests (TCT) como el análisis de ítems de Rasch para ítems dicotómicos. Admite el análisis de funcionamiento diferencial de los ítems (DIF) mediante el método de Mantel-Haenszel, con resultados gráficos. Además, se integra con R y RStudio , generando archivos de datos y de control para diversos programas de Teoría de Respuesta al Ítem (TRI) como Xcalibre y Bilog MG, y preparando datos para SAS.

Lertap5 fue desarrollado por Larry Nelson en la Universidad de Curtin y está disponible en Lertap5.com.

GRIFO

TAP (Test Analysis Program) es un programa gratuito para Windows, escrito en Delphi Pascal, que realiza análisis de pruebas e ítems basados ​​en la teoría clásica de los tests. TAP proporciona informes sobre las puntuaciones totales de los examinados, estadísticas de los ítems (por ejemplo, dificultad, discriminación y biserial puntual), análisis de opciones y otra información útil. También ofrece informes individuales de las puntuaciones totales y las respuestas a los ítems de cada examinado.

ViSt-CITA

ViSta-CITA (Análisis Clásico de Ítems y Pruebas) es un módulo del Sistema de Estadística Visual (ViSta) que aplica métodos gráficos al análisis psicométrico. Fue desarrollado por Ruben Ledesma, J. Gabriel Molina, Pedro M. Valero-Mora y Forrest W. Young. ViSta no se ha actualizado desde 2014.

Psicoanalizar

Psych es un paquete de R que proporciona rutinas para psicología de la personalidad, psicometría y psicología experimental. Sus funciones admiten:

  • Construcción de escalas mediante análisis factorial, análisis de conglomerados y análisis de fiabilidad.
  • Estadísticas descriptivas básicas
  • Teoría de respuesta al ítem mediante análisis factorial de correlaciones tetracóricas y policóricas.
  • Simulación de estructuras de ítems y pruebas
  • Modelado de ecuaciones estructurales

Psych crea representaciones gráficas de diagramas de trayectoria, análisis factorial y modelos de ecuaciones estructurales mediante gráficos básicos. Para más información, consulte la página web personality-project.org/r.

Calibración de la teoría de respuesta al ítem

La teoría de respuesta al ítem (TRI) es un enfoque psicométrico que asume que la probabilidad de una respuesta determinada es una función directa de uno o varios rasgos subyacentes. Se han propuesto diversas funciones para modelar esta relación, y los diferentes paquetes de calibración lo reflejan. Se han desarrollado varios paquetes de software para análisis adicionales, como la equiparación ; estos se enumeran en la siguiente sección.

Autopsia

El programa de software de código abierto Autopsych se utiliza para realizar análisis Rasch unidimensionales. La aplicación puede manejar datos dicotómicos y politómicos mediante la aplicación del modelo de crédito parcial de Master. La aplicación adopta la estimación de máxima verosimilitud marginal y aprovecha un total de 31 paquetes R de código abierto (incluidos TAM, psych, knitr, etc.). Los usuarios cargan matrices de respuesta a ítems (archivos .csv), personalizan la configuración para el análisis Rasch y la aplicación genera automáticamente un PDF con narración integrada sobre la metodología y los resultados. Los archivos de Excel incluyen los resultados de todos los análisis realizados, incluidos los valores plausibles. Los usuarios también pueden realizar un análisis Rasch multifacético básico para examinar el DIF de los ítems, la equiparación de anclaje fijo para dos matrices dicotómicas, un análisis de varianza (ANOVA) de las estimaciones theta de EAP para examinar el efecto de los efectos de grupo y un análisis de fiabilidad entre evaluadores para examinar la consistencia del evaluador. Una exposición completa de la aplicación web se proporciona en la revista PLOS ONE SCIENCE. [ 2 ]

BILOG-MG

BILOG-MG es un programa informático para el análisis de datos dicotómicos (correctos/incorrectos) mediante la Teoría de Respuesta al Ítem (TRI), que incluye el ajuste y el funcionamiento diferencial de los ítems . Es un producto comercial y solo está disponible a través de Scientific Software International.

Diestro

Dexter, publicado por primera vez en febrero de 2017, es un paquete de R diseñado como un sistema robusto y bastante completo para gestionar y analizar datos de pruebas organizados en cuadernillos. El paquete incluye herramientas para importar y gestionar datos de pruebas, evaluar y mejorar la calidad de los datos a través de análisis básicos de pruebas e ítems, ajustar un modelo IRT y calcular varias estimaciones de habilidad. Se proporcionan muchos métodos psicométricos que no se encuentran en otros lugares, como el modelo de interacción de Haberman (2007) generalizado para ítems politómicos, generación eficiente de valores o puntuaciones plausibles, nuevos métodos para análisis DIF exploratorio y confirmatorio, soporte para el método 3DC de establecimiento de estándares y muchos más. El modelo IRT central es una generalización politómica del modelo Rasch marginal extendido. La estimación se realiza mediante técnicas CML o bayesianas. Hay dos paquetes complementarios: dextergui, publicado por primera vez en junio de 2018, y proporciona una interfaz gráfica sencilla para las funciones más utilizadas en dexter; y dexterMST, publicado por primera vez en julio de 2018, para la gestión y el análisis de datos de diseños de pruebas multietapa. Todos los paquetes están ampliamente documentados tanto para principiantes como para profesionales.

Facetas

Facets es un programa informático para el análisis de Rasch de tasas o datos mediados por jueces, como calificaciones de ensayos, competiciones de buceo, encuestas de satisfacción y datos sobre calidad de vida. Otras aplicaciones incluyen datos de orden de rango, ensayos binomiales y recuentos de Poisson.

FlexMIRT

El software FlexMIRT IRT es un paquete de software multinivel y multigrupo para el análisis de ítems, la calibración de ítems y la calificación de pruebas. El paquete de software flexMIRT IRT adapta una variedad de modelos de teoría de respuesta al ítem unidimensionales y multidimensionales (también conocidos como modelos de análisis factorial de ítems) a datos de un solo nivel y multinivel en cualquier número de grupos.

Irtoys

Irtoys es un paquete de R publicado por primera vez en 2007 que ofrece soporte para casi todo el contenido del libro, aunque se limita a un solo cuadernillo de ítems dicotómicos. Es útil para la enseñanza, proyectos pequeños, como herramienta multiusos para psicometristas y como base para otros proyectos. Los sencillos archivos de sintaxis que genera para ICL y BILOG-MG pueden estudiarse y modificarse para abordar problemas más complejos.

ICL

ICL (IRT Command Language) realiza calibraciones IRT, incluyendo los modelos logísticos de 1, 2 y 3 parámetros, así como el modelo de crédito parcial y el modelo de crédito parcial generalizado. También puede generar datos de respuesta. Como su nombre indica, se basa completamente en código de comandos, sin interfaz gráfica de usuario.

jMetrik

jMetrik es un software libre y de código abierto para realizar un análisis psicométrico completo. Fue desarrollado por J. Patrick Meyer en la Universidad de Virginia . Los métodos actuales incluyen análisis de ítems clásico, análisis de funcionamiento diferencial de ítems (DIF), teoría de respuesta al ítem, equiparación IRT y teoría de respuesta al ítem no paramétrica. El análisis de ítems incluye estadísticas de proporción, biserial puntual y biserial para todas las opciones de respuesta. Los coeficientes de fiabilidad incluyen alfa de Cronbach, lambda de Guttman, coeficiente de Feldt-Gilmer, coeficiente de Feldt-Brennan, índices de consistencia de decisión, error estándar de medición condicional y fiabilidad si se elimina el ítem. El análisis DIF se basa en curvas características de ítem no paramétricas y el procedimiento de Mantel-Haenszel . Los tamaños del efecto DIF y las clasificaciones ETS DIF se incluyen en la salida. Los métodos IRT incluyen los modelos de Rasch, crédito parcial y escala de calificación estimados mediante JMLE. jMetrik también proporciona los modelos 3PL, 4PL y crédito parcial generalizado estimados mediante MMLE. Los métodos de puntuación de personas incluyen MLE, MAP y EAP. Los métodos de equiparación de la IRT incluyen los procedimientos de media/media, media/sigma, Haebara y Stocking-Lord.

jMetrik también incluye estadísticas descriptivas básicas y una herramienta gráfica que produce gráficos de barras, gráficos circulares, histogramas, estimaciones de densidad de kernel y gráficos de líneas.

jMetrik es una aplicación Java pura que se ejecuta en versiones de 32 y 64 bits de los sistemas operativos Windows, Mac y Linux. jMetrik requiere Java 1.6 en el equipo anfitrión.

Lertap5

Lertap5 incluye soporte integrado para análisis de Rasch (Lertap5-Rasch) y también ofrece soporte para usuarios de Xcalibre, Bilog-MG, las rutinas IRT de SAS y "EIRT", el equivalente en Excel del paquete "RIRT". Lertap5 ejecuta una aplicación de Excel, al igual que EIRT.

MULTILOG

MULTILOG es una extensión de BILOG para datos con respuestas politómicas (múltiples). Es un software comercial y solo está disponible a través de Scientific Software International.

IMRT

BMIRT es una aplicación Java gratuita y multipropósito que realiza calibraciones de ítems y estimación de habilidades en un marco de modelo de teoría de respuesta al ítem (TRI) multidimensional y multigrupo. Puede ajustar modelos dicotómicos o politómicos, así como modelos mixtos. Admite modelos MIRT exploratorios y confirmatorios, tanto compensatorios como no compensatorios.

PARSCALE

PARSCALE es un programa diseñado específicamente para el análisis IRT politómico. Es un producto comercial y solo está disponible a través de Scientific Software International.

PARAM-3PL

PARAM-3PL es un programa gratuito para la calibración del modelo logístico IRT de 3 parámetros. Fue desarrollado por Lawrence Rudner en el Centro de Información de Recursos Educativos (ERIC). La última versión, la 0.93, se lanzó en agosto de 2012.

TestFact

Características de Testfact

  • Análisis factorial exploratorio de máxima verosimilitud marginal (MML) y análisis de ítems clásico de datos binarios
  • Calcula correlaciones tetracóricas, solución de factores principales, estadísticas descriptivas clásicas de los ítems, tablas fractales y gráficos.
  • Admite hasta 10 factores mediante cuadratura numérica: hasta 5 para cuadratura no adaptativa y hasta 10 para cuadratura adaptativa.
  • Admite hasta 15 factores mediante técnicas de integración de Monte Carlo.
  • Rotación Varimax (ortogonal) y PROMAX (oblicua) de las cargas factoriales
  • Maneja una forma importante de análisis factorial confirmatorio conocida como análisis "bifactorial": el patrón factorial consta de un factor principal más factores de grupo.
  • Simulación de respuestas a ítems en función de parámetros especificados por el usuario.
  • Corrección por adivinar y elementos no alcanzados
  • Permite imponer restricciones a las estimaciones de los parámetros de los ítems.
  • Manipula los elementos omitidos y no presentados.
  • La documentación de ayuda en línea, que incluye detalles sobre la sintaxis y ejemplos comentados, es muy completa.

WINMIRA 2001

WINMIRA 2001 es un programa para análisis con el modelo Rasch para respuestas ordinales dicotómicas y politómicas, con el análisis de clases latentes y con el modelo Rasch de distribución de mezcla para respuestas de ítems dicotómicas y politómicas. [ 3 ] [ 4 ] El software proporciona estimación de máxima verosimilitud condicional (CML) de parámetros de ítems, así como estimaciones MLE y WLE de parámetros de personas, y estadísticas de ajuste de personas e ítems, así como criterios de información (AIC, BIC, CAIC) para la selección del modelo. El software también realiza un procedimiento bootstrap paramétrico para la selección del número de componentes de la mezcla. Una versión gratuita para estudiantes está disponible en la página web de Matthias von Davier y una versión comercial está disponible.

Pasos de victoria

Winsteps es un programa diseñado para el análisis con el modelo de Rasch , un modelo de teoría de respuesta al ítem de un parámetro que difiere del modelo 1PL en que cada individuo de la muestra se parametriza para la estimación de ítems y es prescriptivo y referenciado a criterios, en lugar de descriptivo y referenciado a normas. [ 5 ] Está disponible comercialmente a través de Winsteps, Inc. También está disponible una versión anterior basada en DOS, BIGSTEPS.

Xcalibre

Xcalibre es un programa comercial que realiza la estimación de máxima verosimilitud marginal tanto para modelos dicotómicos (1PL-Rasch, 2PL, 3PL) como para los principales modelos politómicos de la Teoría de Respuesta al Ítem (TRI). Su interfaz es intuitiva; no requiere código de comandos. El resultado incluye hojas de cálculo y un informe detallado con narración, tablas y figuras integradas, que puede imprimirse y entregarse a expertos para su revisión. Solo está disponible a través de Assessment Systems Corporation.

IATA

IATA es un paquete de software para el análisis de datos de evaluación psicométrica y educativa. Su interfaz es intuitiva y todas las funcionalidades se ofrecen mediante asistentes que se basan en diferentes flujos de trabajo u objetivos de análisis, como pruebas piloto o equiparación. IATA lee y escribe archivos en formato CSV, Excel y SPSS, y genera gráficos exportables para todos los análisis estadísticos. Cada análisis incluye heurísticas que sugieren interpretaciones adecuadas de los resultados numéricos. IATA realiza análisis factorial (Rasch, 2PL y 3PL), escalamiento y calibración, análisis de funcionamiento diferencial de ítems (DIF), desarrollo básico de pruebas asistidas por ordenador, equiparación, establecimiento de estándares basado en la Teoría de Respuesta al Ítem (TRI), condicionamiento de puntuaciones y generación de valores plausibles. Está disponible gratuitamente en Polymetrika International.

mirt

Paquete R. Análisis de datos de respuesta discreta mediante modelos de análisis de ítems unidimensionales y multidimensionales bajo el paradigma de la Teoría de Respuesta al Ítem (TRI). Los modelos de análisis factorial de ítems exploratorios y confirmatorios se estiman con métodos de cuadratura (EM) o estocásticos (MHRM). Se dispone de modelos bifactoriales y de dos niveles confirmatorios para modelar conjuntos de ítems mediante algoritmos EM de reducción de dimensionalidad, mientras que se incluyen análisis de grupos múltiples y diseños de efectos mixtos para detectar el funcionamiento diferencial de ítems, paquetes y pruebas, y para modelar covariables de ítems y personas. Finalmente, se admiten modelos de clases latentes como DINA, DINO, clases latentes multidimensionales, modelos TRI de mezcla y modelos de respuesta con inflación de ceros, así como una amplia familia de modelos de despliegue probabilístico.

ltm

Paquete de R. Análisis de datos multivariados dicotómicos y politómicos mediante modelos de rasgos latentes basados ​​en la Teoría de Respuesta al Ítem. Incluye los modelos de Rasch, Logístico de Dos Parámetros, de Tres Parámetros de Birnbaum, de Respuesta Graduada y de Crédito Parcial Generalizado.

TAM

Paquete de R. El paquete incluye la estimación de máxima verosimilitud marginal y conjunta de modelos de respuesta a ítems unidimensionales y multidimensionales (Rasch, 2PL, Crédito Parcial Generalizado, Escala de Calificación, Multifacetas), estadísticas de ajuste, estimación del error estándar, así como imputación de valores plausibles y estimación de verosimilitud ponderada de la habilidad.

ACER ConQuest

ACER ConQuest es un programa informático para ajustar modelos de respuesta al ítem y de regresión latente, tanto unidimensionales como multidimensionales. Proporciona análisis de datos basados ​​en una gama completa y flexible de modelos de respuesta al ítem (MRI), lo que permite examinar las propiedades de las evaluaciones de desempeño, las evaluaciones tradicionales y las escalas de calificación. ACER ConQuest 4 también ofrece procedimientos de análisis más amplios para la comunidad de medición e investigación, basados ​​en los métodos psicométricos más actualizados de modelos de respuesta al ítem multifacéticos, modelos de respuesta al ítem multidimensionales, modelos de regresión latente y la obtención de valores plausibles.

Irtplay

Paquete R. Permite ajustar modelos unidimensionales de teoría de respuesta al ítem (TRI) a una mezcla de datos dicotómicos y politómicos, calibrar parámetros de ítems en línea, estimar las habilidades latentes de los examinados y analizar el ajuste del modelo TRI a los datos a nivel de ítem de diferentes maneras, además de proporcionar funciones útiles relacionadas con la TRI unidimensional.

MIRT

Programa general de código abierto para el análisis de respuestas a ítems, desarrollado en Educational Testing Service. [ 6 ] El programa puede manejar variables independientes, parámetros de habilidad multidimensionales, datos incompletos y muestreo complejo. Las variables de habilidad pueden ser politómicas o multivariadas normales, y los ítems pueden ser dicotómicos o politómicos.

Software adicional de teoría de respuesta al ítem

Debido a la complejidad de la Teoría de Respuesta al Ítem (TRI), existen pocos paquetes de software capaces de realizar la calibración. Sin embargo, existen numerosos programas para análisis auxiliares específicos de la TRI, como la equiparación y el escalado. A continuación, se presentan ejemplos de este tipo de software.

EnlaceMIRT

LinkMIRT es una aplicación Java gratuita que vincula dos conjuntos de parámetros de ítems en un marco de Teoría de Respuesta al Ítem (TRI) multidimensional (MIRT). El software puede implementar el método de Stocking y Lord, el método de media/media y el método de media/sigma. Admite la vinculación por persona-comentario y por diseño de grupos equivalentes aleatorios.

EL QUE MARCA EL PASO

PACER es una plataforma integral y moderna de análisis psicométrico diseñada para respaldar el ciclo de vida completo del desarrollo y la evaluación de pruebas. Proporciona herramientas para el análisis de ítems, la calibración de la Teoría de Respuesta al Ítem (que incluye 1PL, 2PL, 3PL, modelos politómicos, 1PL multigrupo y calibraciones bayesianas de ítems), el modelado de diagnóstico cognitivo, la equiparación de pruebas y el ensamblaje automatizado de pruebas mediante técnicas de optimización avanzadas. PACER se ha diseñado con un enfoque en la flexibilidad y la usabilidad, aceptando formatos de datos estándar (por ejemplo, matrices de respuesta, parámetros de ítems y matrices Q) y ofreciendo resultados a través de una interfaz intuitiva con visualizaciones claras e información práctica. Ya sea para investigación, pruebas operativas o análisis exploratorio, PACER permite a los profesionales transformar de manera eficiente los datos de respuesta brutos en resultados de medición rigurosos y fiables.

SimuMIRT

SimuMIRT es un programa que simula datos multidimensionales (habilidad del examinado y respuestas a los ítems) para una prueba de formato fijo (es decir, en papel y lápiz), a partir de un conjunto de parámetros especificados por el usuario. Admite el modelo de efecto del evaluador.

SimuMCAT

SimuMCAT es una aplicación Java gratuita que simula una prueba adaptativa computarizada multidimensional (MCAT). El usuario puede seleccionar entre cinco procedimientos diferentes de selección de ítems MCAT (Volumen, Información de Kullback-Leibler, Minimizar la varianza del error de la combinación lineal, Ángulo mínimo y Minimizar la varianza del error de la puntuación compuesta con el peso optimizado). [ 7 ] Son posibles dos enfoques de control de exposición: el enfoque tradicional de Sympson-Hetter y un enfoque de control de exposición máxima. También es posible implementar restricciones de contenido utilizando el método del Índice de Prioridad. Se implementan diferentes reglas de parada con pruebas de longitud fija y de longitud variable. El usuario especifica la verdadera habilidad del examinado, los bancos de ítems y los procedimientos de selección de ítems, y el programa genera los ítems seleccionados con las respuestas a los ítems y las estimaciones de habilidad. El usuario puede especificar métodos bayesianos y no bayesianos. La habilidad del examinado y los bancos de ítems también pueden crearse desde el programa mediante las distribuciones especificadas por el usuario.

IRTEQ

IRTEQ es una aplicación gratuita de Windows con interfaz gráfica de usuario (GUI) que implementa el escalado y la equiparación de la TRI, desarrollada por Kyung (Chris) T. Han. Implementa métodos de escalado/equiparación de la TRI ampliamente utilizados con el diseño de la "Prueba de Anclaje de Grupos No Equivalentes": Media/Media, Media/Sigma, Media/Sigma Robusta y métodos TCC. [ 8 ] [ 9 ] [ 10 ] [ 11 ] [ 12 ] Para los métodos TCC, IRTEQ ofrece al usuario la opción de elegir varias distribuciones de puntuación para su incorporación en la función de pérdida. IRTEQ admite varios modelos TRI unidimensionales populares: modelos logísticos para respuestas dicotómicas (con 1, 2 o 3 parámetros) y el Modelo de Crédito Parcial Generalizado (GPCM) (incluido el Modelo de Crédito Parcial (PCM), que es un caso especial de GPCM) y el Modelo de Respuesta Graduada (GRM) para respuestas politómicas. IRTEQ también puede equiparar las puntuaciones de una prueba a la escala de otra prueba utilizando la equiparación de puntuación verdadera de la IRT. [ 13 ]

Parcelas residuales-2

ResidPlots-2 es un programa gratuito para el análisis gráfico de residuos de la Teoría de Respuesta al Ítem (TRI). Fue desarrollado por Tie Liang, Kyung (Chris) T. Han y Ronald K. Hambleton en la Universidad de Massachusetts Amherst .

WinGen

WinGen es un programa gratuito para Windows que genera parámetros IRT y respuestas a ítems. Kyung (Chris) T. Han en la Universidad de Massachusetts Amherst . [ 14 ]

CALLE

ST realiza transformaciones de escala basadas en la teoría de respuesta al ítem (TRI) para pruebas con puntuación dicotómica.

POLISTO

POLYST realiza transformaciones de escala IRT para pruebas con puntuación dicotómica y politómica.

STUIRT

STUIRT realiza transformaciones de escalas IRT para pruebas de formato mixto (pruebas que incluyen algunos ítems de opción múltiple y algunos ítems politómicos).

Paquete R. Este paquete utiliza métodos de la teoría de respuesta al ítem para calcular constantes de enlace y realizar el enlace en cadena de pruebas unidimensionales o multidimensionales para múltiples grupos bajo un diseño de ítem común. Los métodos unidimensionales incluyen los métodos Media/Media, Media/Sigma, Haebara y Stocking-Lord para ítems dicotómicos (1PL, 2PL y 3PL) y/o politómicos (respuesta graduada, crédito parcial/crédito parcial generalizado, nominal y modelo de opción múltiple). Los métodos multidimensionales incluyen el método de mínimos cuadrados y extensiones de los métodos Haebara y Stocking-Lord utilizando parámetros de dilatación simples o múltiples para extensiones multidimensionales de todos los modelos de respuesta al ítem unidimensionales dicotómicos y politómicos. El paquete también incluye funciones para importar parámetros de ítems y/o habilidades de software IRT común, realizar la equiparación de puntuaciones verdaderas y observadas de IRT, y graficar curvas/superficies de respuesta al ítem, gráficos vectoriales y gráficos comparativos para examinar la deriva de los parámetros.

Coherencia en la decisión

Los métodos de consistencia en las decisiones son aplicables a pruebas con criterios de referencia, como los exámenes de certificación y las pruebas de dominio académico.

Artículo

Iteman proporciona un índice de consistencia en las decisiones, así como una estimación clásica del error estándar condicional de la medición en el punto de corte, que a menudo se solicita para la acreditación de un programa de pruebas.

jMetrik

jMetrik es un software libre y de código abierto para realizar análisis psicométricos exhaustivos. Encontrará información detallada más arriba. jMetrik incluye las estimaciones de consistencia de decisiones de Huynh si se proporcionan puntuaciones de corte en el análisis de ítems.

Lertap

Lertap calcula diversas estadísticas relacionadas con la consistencia de las decisiones y clasificaciones, incluyendo el coeficiente de Livingston, el índice de fiabilidad de Brennan-Kane, kappa y una estimación de p(0), que representa la proporción de clasificaciones correctas, obtenida mediante la adaptación de Peng-Subkoviac del método de Huynh. Encontrará información más detallada sobre Lertap en la sección «Teoría clásica de las pruebas», más arriba.

Otros análisis

La mayoría del software psicométrico está diseñado para analizar datos de respuesta y evaluar el rendimiento de los ítems y las pruebas; la mayor parte del software mencionado anteriormente se centra en esto. Algunos programas están destinados a otros análisis psicométricos.

TAMIZAR A

SIFT está diseñado para el análisis forense de datos, concretamente para encontrar pruebas de trampas u otros comportamientos que comprometan la validez e integridad de la prueba. Es un programa para Windows con una interfaz de usuario intuitiva y salida en Microsoft Excel .

Detección de copias

Copy Detect es un paquete de R diseñado para el análisis forense de datos, concretamente, para encontrar pruebas de trampas u otros comportamientos que amenacen la validez e integridad de la prueba.

Ensamblador de prueba

TestAssembler es un programa para Windows que realiza el ensamblaje automatizado de pruebas.

ATA

ATA es un paquete de R para el ensamblaje automatizado de pruebas.

Software de análisis estadístico general

El software diseñado para análisis estadísticos generales a menudo puede utilizarse para ciertos tipos de análisis psicométricos. Además, suele estar disponible el código para análisis psicométricos más avanzados.

R

R es un entorno de programación diseñado para el cálculo estadístico y la producción de gráficos. La funcionalidad básica de R se puede ampliar mediante la instalación de paquetes aportados por la comunidad, y en el sitio web de CRAN se mantiene una lista de paquetes relacionados con la psicometría . [ 15 ]

SAS

SAS es un paquete comercial para el análisis estadístico y la manipulación de datos. Además, se basa en comandos.

SPSS

SPSS , originalmente llamado Paquete Estadístico para las Ciencias Sociales, es un programa comercial de análisis estadístico general donde los datos se presentan en formato de hoja de cálculo y los análisis comunes se realizan mediante menús.

S-Plus

S-Plus es un paquete de análisis comercial basado en el lenguaje de programación S.

Stata

Stata es un paquete comercial. La implementación de la TRI en Stata incluye modelos logísticos de 1, 2 y 3 parámetros, modelos de respuesta graduada, modelos de crédito parcial y crédito parcial generalizado, modelos de escala de calificación y un modelo de respuesta nominal para respuestas categóricas no ordenadas. Se maneja mediante un panel de control que permite al usuario especificar el modelo, examinar el ajuste numérica y gráficamente e investigar el funcionamiento diferencial de los ítems desde una única interfaz. [ 16 ]

Véase también

Referencias

  1. Graziotin, Daniel; Lenberg, Per; Feldt, Robert; Wagner, Stefan (2021). "Psicometría en la ingeniería de software conductual: una introducción metodológica con directrices". ACM Transactions on Software Engineering and Methodology . 31 (1) 7: 1– 36. arXiv : 2005.09959 . doi : 10.1145/3469888 .
  2. Courtney, MGR; Chang, KCT; Mei, B.; Meissel, K.; Rowe, LI; Issayeva, LB (2021). "autopsych: Una herramienta R Shiny para el análisis Rasch reproducible, funcionamiento diferencial de ítems, equiparación y examen de efectos de grupo" . PLOS One . doi : 10.1371/journal.pone.0257682 . hdl : 2292/57424 . PMC 8505029 . 
  3. Rost, J. (1990). Modelos de Rasch en clases latentes: una integración de dos enfoques para el análisis de ítems. Applied Psychological Measurement, 14, 271-282.
  4. von Davier, M., & Rost, J. (1995). Modelos Rasch mixtos politómicos. En GH Fischer & IW Molenaar (Eds.), Modelos Rasch, fundamentos, desarrollos recientes y aplicaciones (pp. 371-382). Nueva York: Springer.
  5. Modelo dicotómico de Rasch frente a modelo logístico de un parámetroTransacciones de medición de Rasch, 2005, 19:3 pág. 1032
  6. «MIRT» . GitHub . 23 de abril de 2021.
  7. Yao, Lihua (2012-05-17). "Métodos multidimensionales de selección de ítems CAT para puntuaciones de dominio y puntuaciones compuestas: teoría y aplicaciones". Psychometrika . 77 (3): 495– 523. doi : 10.1007/s11336-012-9265-5 . ISSN 0033-3123 . PMID 27519778 . S2CID 14868583 .   
  8. Loyd & Hoover, 1980
  9. Marco, 1977
  10. Linn, Levine, Hastings y Wardrop, 1981
  11. Haebara, T. (1980). Igualación de escalas de habilidad logística mediante un método de mínimos cuadrados ponderados. Japanese Psychological Research, 22 , 144-149.
  12. Stocking, ML y Lord, FM (1983). Desarrollo de una métrica común en la teoría de respuesta al ítem. Medición psicológica aplicada, 7 , 201-210.
  13. Lord, FM (1980). Aplicaciones de la teoría de respuesta al ítem a problemas prácticos de evaluación . Mahwah, NJ: Lawrence Erlbaum Associates, Inc.
  14. Han, KT (2007). WinGen: software para Windows que genera parámetros IRT y respuestas a ítems. Applied Psychological Measurement, 31 , 457-459.
  15. Vista de tareas de CRAN: Modelos y métodos psicométricos
  16. Manual IRT de Stata en línea