En estadística , la identificabilidad es una propiedad que un modelo debe satisfacer para que sea posible realizar inferencias precisas. Un modelo es identificable si, teóricamente, es posible conocer los valores reales de sus parámetros subyacentes tras obtener un número infinito de observaciones. Matemáticamente, esto equivale a decir que diferentes valores de los parámetros deben generar diferentes distribuciones de probabilidad de las variables observables. Generalmente, el modelo solo es identificable bajo ciertas restricciones técnicas, en cuyo caso el conjunto de estos requisitos se denomina condiciones de identificación .
Un modelo que no es identificable se denomina no identificable o inidentificable : dos o más parametrizaciones son observacionalmente equivalentes . En algunos casos, aunque un modelo no sea identificable, aún es posible conocer los valores verdaderos de un subconjunto determinado de sus parámetros. En este caso, decimos que el modelo es parcialmente identificable . En otros casos, puede ser posible conocer la ubicación del parámetro verdadero hasta una región finita del espacio de parámetros, en cuyo caso el modelo es identificable por conjuntos .
Aparte de la exploración estrictamente teórica de las propiedades del modelo, la identificabilidad puede abordarse en un ámbito más amplio cuando un modelo se prueba con conjuntos de datos experimentales, utilizando el análisis de identificabilidad . [ 1 ]
Definición
Dejarser un modelo estadístico con espacio de parámetrosDecimos quees identificable si el mapeo es uno a uno : [ 2 ]
Esta definición significa que los valores distintos de θ deben corresponder a distribuciones de probabilidad distintas: si θ 1 ≠ θ 2 , entonces también P θ 1 ≠ P θ 2 . [ 3 ] Si las distribuciones se definen en términos de las funciones de densidad de probabilidad (pdf), entonces dos pdf deben considerarse distintas solo si difieren en un conjunto de medida no nula (por ejemplo, dos funciones ƒ 1 ( x ) = 1 0 ≤ x < 1 y ƒ 2 ( x ) = 1 0 ≤ x ≤ 1 difieren solo en un único punto x = 1 — un conjunto de medida cero — y por lo tanto no pueden considerarse como pdf distintas).
Identificabilidad del modelo en el sentido de invertibilidad del mapa.es equivalente a poder aprender el verdadero parámetro del modelo si el modelo puede observarse indefinidamente. De hecho, si { X t } ⊆ S es la secuencia de observaciones del modelo, entonces por la ley fuerte de los grandes números ,
para cada conjunto medible A ⊆ S (aquí 1 {...} es la función indicadora ). Por lo tanto, con un número infinito de observaciones podremos encontrar la verdadera distribución de probabilidad P 0 en el modelo, y dado que la condición de identificabilidad anterior requiere que el mapa Si es invertible, también podremos encontrar el verdadero valor del parámetro que generó la distribución dada P 0 .
Ejemplos
Ejemplo 1
Dejarser la familia normal de ubicación-escala :
Entonces
Esta expresión es igual a cero para casi todo x solo cuando todos sus coeficientes son iguales a cero, lo cual solo es posible cuando | σ 1 | = | σ 2 | y μ 1 = μ 2 . Dado que en el parámetro de escala σ está restringido a ser mayor que cero, concluimos que el modelo es identificable: ƒ θ 1 = ƒ θ 2 ⇔ θ 1 = θ 2 .
Ejemplo 2
Dejarser el modelo de regresión lineal estándar :
(donde ′ denota la transpuesta de la matriz ). Entonces, el parámetro β es identificable si y solo si la matrizes invertible. Por lo tanto, esta es la condición de identificación en el modelo.
Ejemplo 3
Suponeres el modelo lineal clásico de errores en las variables :
donde ( ε , η , x* ) son variables aleatorias independientes normales conjuntas con valor esperado cero y varianzas desconocidas, y solo se observan las variables ( x , y ). Entonces este modelo no es identificable, [ 4 ] solo lo es el producto βσ² ∗ (donde σ² ∗ es la varianza del regresor latente x* ). Este es también un ejemplo de un modelo identificable por conjuntos : aunque el valor exacto de β no se puede aprender, podemos garantizar que debe estar en algún lugar del intervalo ( β yx , 1÷ β xy ), donde β yx es el coeficiente en la regresión MCO de y sobre x , y β xy es el coeficiente en la regresión MCO de x sobre y . [ 5 ]
Si abandonamos el supuesto de normalidad y exigimos que x* no se distribuya normalmente, manteniendo solo la condición de independencia ε ⊥ η ⊥ x* , entonces el modelo se vuelve identificable. [ 4 ]
Véase también
Referencias
Citas
- ↑ Raue, A.; Kreutz, C.; Maiwald, T.; Bachmann, J.; Schilling, M.; Klingmuller, U.; Timmer, J. (2009-08-01). "Análisis de identificabilidad estructural y práctica de modelos dinámicos parcialmente observados mediante la explotación de la verosimilitud del perfil" . Bioinformatics . 25 (15): 1923– 1929. doi : 10.1093/bioinformatics/btp358 . PMID 19505944 .
- ↑ Lehmann y Casella 1998 , Cap. 1, Definición 5.2
- ↑ van der Vaart 1998 , pág. 62
- 1 2 Reiersøl 1950
- ↑ Casella y Berger 2002 , pág. 583
Fuentes
- Casella, George ; Berger, Roger L. (2002), Inferencia estadística (2.ª ed.), Thomson Learning, ISBN 0-534-24312-6, LCCN 2001025794
- Hsiao, Cheng (1983), Identificación , Manual de Econometría, Vol. 1, Cap. 4, North-Holland Publishing Company
- Lehmann, EL ; Casella, G. (1998), Teoría de la estimación puntual (2.ª ed.), Springer, ISBN 0-387-98502-6
- Reiersøl, Olav (1950), "Identificabilidad de una relación lineal entre variables sujetas a error", Econometrica , 18 (4): 375–389 , doi : 10.2307/1907835 , JSTOR 1907835
- van der Vaart, AW (1998), Estadística asintótica , Cambridge University Press , ISBN 978-0-521-49603-2
Lecturas adicionales
- Walter, É.; Pronzato, L. (1997), Identificación de modelos paramétricos a partir de datos experimentales , Springer
Econometría
- Lewbel, Arthur (1 de diciembre de 2019). "El zoológico de la identificación: significados de la identificación en econometría" . Journal of Economic Literature . 57 (4). American Economic Association: 835–903 . doi : 10.1257/jel.20181361 . ISSN 0022-0515 . S2CID 125792293 .
- Matzkin, Rosa L. (2013). "Identificación no paramétrica en modelos económicos estructurales". Annual Review of Economics . 5 (1): 457– 486. doi : 10.1146/annurev-economics-082912-110231 .
- Rothenberg, Thomas J. (1971). "Identificación en modelos paramétricos". Econometrica . 39 (3): 577– 591. doi : 10.2307/1913267 . ISSN 0012-9682 . JSTOR 1913267 .
- Teoría de la estimación