En estadística , econometría , epidemiología y disciplinas afines, el método cuasiexperimental de variables instrumentales ( VI ) se utiliza para estimar relaciones causales cuando los experimentos controlados no son factibles o cuando un tratamiento no se administra con éxito a todas las unidades en un experimento aleatorio. [ 1 ] Intuitivamente, las VI se utilizan cuando una variable explicativa (también conocida como independiente o predictora) de interés está correlacionada con el término de error (endógeno), en cuyo caso los mínimos cuadrados ordinarios y el ANOVA dan resultados sesgados . Cuando se utiliza, un instrumento válido cambia la variable explicativa (la variable correlacionada con la variable endógena) pero no tiene un efecto independiente sobre la variable dependiente y no está correlacionado con el término de error, lo que permite a un investigador o analista descubrir el verdadero efecto causal de la variable explicativa sobre la variable dependiente.
Los métodos de variables instrumentales permiten una estimación consistente cuando las variables explicativas (covariables) están correlacionadas con los términos de error en un modelo de regresión . Dicha correlación puede ocurrir cuando:
- Los cambios en la variable dependiente modifican el valor de al menos una de las covariables (causalidad "inversa").
- Existen variables omitidas que afectan tanto a las variables dependientes como a las explicativas, o
- Las covariables están sujetas a errores de medición .
Las variables explicativas que presentan uno o más de estos problemas en el contexto de una regresión se denominan a veces endógenas . En esta situación, el método de mínimos cuadrados ordinarios produce estimaciones sesgadas e inconsistentes. [ 2 ] Sin embargo, si se dispone de un instrumento , aún se pueden obtener estimaciones consistentes. Un instrumento es una variable que no forma parte de la ecuación explicativa, pero que está correlacionada con las variables explicativas endógenas, condicionada al valor de otras covariables.
En los modelos lineales, existen dos requisitos principales para el uso de variables instrumentales:
- El instrumento debe estar correlacionado con las variables explicativas endógenas, condicionado a las demás covariables. Si esta correlación es fuerte, se dice que el instrumento tiene una primera etapa fuerte . Una correlación débil puede dar lugar a inferencias engañosas sobre las estimaciones de los parámetros y provocar que los errores estándar en la segunda etapa sean mayores que las estimaciones de mínimos cuadrados ordinarios. [ 3 ] [ 4 ]
- El instrumento no puede estar correlacionado con el término de error en la ecuación explicativa, condicionado a las demás covariables. En otras palabras, el instrumento no puede sufrir el mismo problema que la variable predictora original. Si se cumple esta condición, se dice que el instrumento satisface la restricción de exclusión .
Ejemplo
De manera informal, al intentar estimar el efecto causal de alguna variable X ("covariable" o "variable explicativa") sobre otra Y ("variable dependiente"), un instrumento es una tercera variable Z que afecta a Y solo a través de su efecto sobre X.
Por ejemplo, supongamos que un investigador desea estimar el efecto causal del tabaquismo ( X ) sobre la salud general ( Y ). [ 5 ] La correlación entre el tabaquismo y la salud no implica que fumar cause mala salud, ya que otras variables, como la depresión, pueden afectar tanto a la salud como al tabaquismo, o porque la salud puede afectar al tabaquismo. No es posible realizar experimentos controlados sobre el estado de tabaquismo en la población general. El investigador puede intentar estimar el efecto causal del tabaquismo sobre la salud a partir de datos observacionales utilizando la tasa impositiva sobre los productos de tabaco ( Z ) como instrumento para el tabaquismo. La tasa impositiva sobre los productos de tabaco es una opción razonable como instrumento porque el investigador supone que solo puede correlacionarse con la salud a través de su efecto sobre el tabaquismo. Si el investigador encuentra entonces una correlación entre los impuestos al tabaco y el estado de salud, esto puede considerarse evidencia de que fumar causa cambios en la salud.
Historia
El primer uso de una variable instrumental se produjo en un libro de 1928 de Philip G. Wright , conocido principalmente por su excelente descripción de la producción, el transporte y la venta de aceites vegetales y animales a principios del siglo XX en Estados Unidos. [ 6 ] [ 7 ] En 1945, Olav Reiersøl aplicó el mismo enfoque en el contexto de modelos de errores en las variables en su tesis doctoral, dando nombre al método. [ 8 ]
Wright intentó determinar la oferta y la demanda de mantequilla utilizando datos de panel sobre precios y cantidades vendidas en Estados Unidos. La idea era que un análisis de regresión podría generar una curva de demanda o de oferta, ya que estas se forman a partir de la relación entre los precios y las cantidades demandadas u ofrecidas. El problema radicaba en que los datos observacionales no conformaban una curva de demanda o de oferta propiamente dicha, sino más bien una nube de observaciones puntuales que adoptaban diferentes formas según las condiciones del mercado. Resultaba difícil extraer conclusiones a partir de los datos.
El problema radicaba en que el precio afectaba tanto a la oferta como a la demanda, por lo que no se podía construir directamente a partir de los datos de observación una función que describiera solo una de ellas. Wright concluyó correctamente que necesitaba una variable que se correlacionara con la demanda o con la oferta, pero no con ambas; es decir, una variable instrumental.
Tras mucha deliberación, Wright decidió utilizar la precipitación regional como variable instrumental: concluyó que la lluvia afectaba la producción de pasto y, por lo tanto, la producción de leche y, en última instancia, la oferta de mantequilla, pero no la demanda. De esta manera, pudo construir una ecuación de regresión con solo la variable instrumental de precio y oferta. [ 9 ]
Judea Pearl proporcionó definiciones formales de variables instrumentales, utilizando contrafactuales y criterios gráficos, en 2000. [ 10 ] Angrist y Krueger (2001) presentan un estudio de la historia y los usos de las técnicas de variables instrumentales. [ 11 ] Heckman (2008) analiza las nociones de causalidad en econometría y su relación con las variables instrumentales y otros métodos. [ 12 ]
Teoría
Aunque las ideas detrás de las variables instrumentales se extienden a una amplia clase de modelos, un contexto muy común para las variables instrumentales es la regresión lineal . Tradicionalmente, [ 13 ] una variable instrumental se define como una variableque está correlacionada con la variable independiente y no correlacionado con el "término de error"en la ecuación lineal
es un vector.es una matriz, generalmente con una columna de unos y quizás con columnas adicionales para otras covariables. Considere cómo un instrumento permitepara ser recuperado. Recuerde que MCO resuelve parade tal manera que(cuando minimizamos la suma de los errores al cuadrado,, la condición de primer orden es exactamente). Si se cree que el modelo verdadero tienedebido a cualquiera de las razones enumeradas anteriormente; por ejemplo, si hay una variable omitida que afecta a ambosypor separado—entonces este procedimiento MCO no producirá el impacto causal deen. OLS simplemente elegirá el parámetro que haga que los errores resultantes parezcan no correlacionados con.
Consideremos, para simplificar, el caso de una sola variable. Supongamos que estamos considerando una regresión con una variable y una constante (quizás no sean necesarias otras covariables, o quizás hayamos eliminado cualquier otra covariable relevante):
En este caso, el coeficiente del regresor de interés viene dado por. Sustituyendo porda
dóndees cuál sería el vector de coeficientes estimado si En este caso, se puede demostrar quees un estimador insesgado de. SiEn el modelo subyacente que creemos, entonces MCO da una estimación inconsistente que no refleja el efecto causal subyacente de interés. IV ayuda a solucionar este problema identificando los parámetrosno se basa en sino está correlacionado con, pero en función de si otra variableno está correlacionado con. Si la teoría sugiere queestá relacionado con(la primera etapa) pero no correlacionada con(la restricción de exclusión), entonces IV puede identificar el parámetro causal de interés donde OLS falla. Debido a que existen múltiples formas específicas de usar y derivar estimadores IV incluso en el caso lineal (IV, 2SLS, GMM), reservamos una discusión más detallada para la sección de Estimación a continuación.
Definición gráfica
Las técnicas de variables instrumentales se han desarrollado dentro de una clase mucho más amplia de modelos no lineales. Pearl (2000; p. 248) dio definiciones generales de variables instrumentales, utilizando formalismos contrafactuales y gráficos. [ 10 ] La definición gráfica requiere que Z satisfaga las siguientes condiciones:
dónderepresenta la separación d yrepresenta el gráfico en el que todas las flechas que entran en X están cortadas.
La definición contrafactual requiere que Z satisfaga
donde Y x representa el valor que Y alcanzaría si X fuera x yrepresenta la independencia.
Si hay covariables adicionales W, entonces las definiciones anteriores se modifican de manera que Z califica como un instrumento si los criterios dados se cumplen condicionalmente en W.
La esencia de la definición de Pearl es:
- Las ecuaciones de interés son "estructurales", no de "regresión".
- El término de error U representa todos los factores exógenos que afectan a Y cuando X se mantiene constante.
- El instrumento Z debe ser independiente de U.
- El instrumento Z no debe afectar a Y cuando X se mantiene constante (restricción de exclusión).
- El instrumento Z no debe ser independiente de X.
Estas condiciones no dependen de la forma funcional específica de las ecuaciones y, por lo tanto, son aplicables a ecuaciones no lineales, donde U puede ser no aditiva (véase Análisis no paramétrico). También son aplicables a un sistema de ecuaciones múltiples, en el que X (y otros factores) afectan a Y a través de varias variables intermedias. Una variable instrumental no tiene por qué ser una causa de X ; también se puede utilizar una variable sustituta de dicha causa, si satisface las condiciones 1 a 5. [ 10 ] La restricción de exclusión (condición 4) es redundante; se deduce de las condiciones 2 y 3.
Selección de instrumentos adecuados
Dado que U no es observable, el requisito de que Z sea independiente de U no puede inferirse de los datos y debe determinarse a partir de la estructura del modelo, es decir, del proceso de generación de datos. Los grafos causales son una representación de esta estructura, y la definición gráfica dada anteriormente puede utilizarse para determinar rápidamente si una variable Z califica como variable instrumental dado un conjunto de covariables W. Para ver cómo, considere el siguiente ejemplo.
Supongamos que queremos estimar el efecto de un programa de tutorías universitarias sobre el promedio de calificaciones ( GPA ). La relación entre la asistencia al programa de tutorías y el GPA puede verse afectada por diversos factores. Los estudiantes que participan en el programa pueden preocuparse más por sus calificaciones o estar teniendo dificultades con sus estudios. Esta confusión se ilustra en las Figuras 1 a 3 de la derecha mediante el arco bidireccional entre el Programa de Tutorías y el GPA. Si los estudiantes son asignados a las residencias universitarias al azar, la proximidad de la residencia al programa de tutorías es una variable instrumental idónea.
Figura 1: La proximidad califica como variable instrumental dado el horario de la biblioteca.
Figura 2:, que se utiliza para determinar si la Proximidad es una variable instrumental.
Figura 3: La proximidad no califica como variable instrumental dado el horario de la biblioteca.
Figura 4: La proximidad califica como variable instrumental, siempre y cuando no incluyamos el horario de la biblioteca como covariable.
Sin embargo, ¿qué sucede si el programa de tutoría se encuentra en la biblioteca de la universidad? En ese caso, la Proximidad también puede hacer que los estudiantes pasen más tiempo en la biblioteca, lo que a su vez mejora su promedio de calificaciones (véase la Figura 1). Utilizando el gráfico causal representado en la Figura 2, vemos que la Proximidad no califica como una variable instrumental porque está conectada al promedio de calificaciones a través de la ruta ProximidadHorario de la biblioteca Promedio de calificaciones enSin embargo, si controlamos las horas de la biblioteca agregándolas como una covariable, entonces la proximidad se convierte en una variable instrumental, ya que la proximidad está separada del promedio de calificaciones dado que las horas de la biblioteca están separadas..
Ahora, supongamos que observamos que la "habilidad natural" de un estudiante afecta su número de horas en la biblioteca, así como su promedio de calificaciones (GPA), como se muestra en la Figura 3. Usando el grafo causal, vemos que Horas en la biblioteca es un colisionador y condicionar sobre él abre el camino ProximidadHorario de la bibliotecaGPA. Por lo tanto, la Proximidad no puede utilizarse como variable instrumental.
Finalmente, supongamos que el horario de la biblioteca no afecta realmente al promedio de calificaciones porque los estudiantes que no estudian en la biblioteca simplemente estudian en otro lugar, como se muestra en la Figura 4. En este caso, controlar el horario de la biblioteca aún abre una relación espuria entre la proximidad y el promedio de calificaciones. Sin embargo, si no controlamos el horario de la biblioteca y lo eliminamos como covariable, entonces la proximidad puede volver a utilizarse como variable instrumental.
Estimación
Ahora revisaremos y ampliaremos la mecánica de IV con mayor detalle. Supongamos que los datos se generan mediante un proceso de la forma
dónde
- i indexa las observaciones,
- es el i -ésimo valor de la variable dependiente,
- es un vector de los valores i -ésimos de la(s) variable(s) independiente(s) y una constante,
- es el i -ésimo valor de un término de error no observado que representa todas las causas deotro que, y
- es un vector de parámetros no observado.
El vector de parámetroses el efecto causal ende un cambio de una unidad en cada elemento de, sosteniendo todas las demás causas deconstante. El objetivo econométrico es estimar. Para simplificar, supongamos que las extracciones de e no están correlacionadas y que se extraen de distribuciones con la misma varianza (es decir, que los errores no están correlacionados serialmente y son homocedásticos ).
Supongamos también que se propone un modelo de regresión de forma nominalmente similar. Dada una muestra aleatoria de T observaciones de este proceso, el estimador de mínimos cuadrados ordinarios es
donde X , y y e denotan vectores columna de longitud T. Esta ecuación es similar a la ecuación que involucraen la introducción (esta es la versión matricial de esa ecuación). Cuando X y e no están correlacionados , bajo ciertas condiciones de regularidad el segundo término tiene un valor esperado condicionado a X de cero y converge a cero en el límite, por lo que el estimador es insesgado y consistente. Sin embargo, cuando X y las otras variables causales no medidas colapsadas en el término e están correlacionadas, el estimador MCO es generalmente sesgado e inconsistente para β . En este caso, es válido usar las estimaciones para predecir valores de y dados valores de X , pero la estimación no recupera el efecto causal de X sobre y .
Para recuperar el parámetro subyacenteIntroducimos un conjunto de variables Z que está altamente correlacionado con cada componente endógeno de X pero (en nuestro modelo subyacente) no está correlacionado con e . Para simplificar, se podría considerar que X es una matriz T × 2 compuesta por una columna de constantes y una variable endógena, y Z es una matriz T × 2 que consta de una columna de constantes y una variable instrumental. Sin embargo, esta técnica se generaliza a que X sea una matriz de una constante y, digamos, 5 variables endógenas, con Z siendo una matriz compuesta por una constante y 5 instrumentos. En la discusión que sigue, asumiremos que X es una matriz T × K y dejaremos este valor K sin especificar. Un estimador en el que X y Z son ambas matrices T × K se denomina simplemente identificado .
Supongamos que la relación entre cada componente endógeno x i y los instrumentos viene dada por
La especificación de variables instrumentales más común utiliza el siguiente estimador:
Esta especificación se aproxima al parámetro verdadero a medida que la muestra se hace grande, siempre y cuandoen el modelo verdadero:
MientrasEn el proceso subyacente que genera los datos, el uso apropiado del estimador IV identificará este parámetro. Esto funciona porque IV resuelve para el parámetro único que satisfacey, por lo tanto, se centra en el verdadero parámetro subyacente a medida que aumenta el tamaño de la muestra.
Ahora una extensión: supongamos que hay más instrumentos que covariables en la ecuación de interés, de modo que Z es una matriz T × M con M > K. Esto se suele denominar caso sobreidentificado . En este caso, se puede utilizar el método generalizado de momentos (GMM). El estimador GMM IV es
dóndese refiere a la matriz de proyección.
Esta expresión se reduce a la primera cuando el número de instrumentos es igual al número de covariables en la ecuación de interés. Por lo tanto, la variable instrumental sobreidentificada es una generalización de la variable instrumental simplemente identificada.
Desarrollando elexpresión:
En el caso recién identificado, tenemos tantos instrumentos como covariables, de modo que la dimensión de X es la misma que la de Z. Por lo tanto, yson todas matrices cuadradas de la misma dimensión. Podemos expandir la inversa, utilizando el hecho de que, para cualesquiera matrices invertibles n x n A y B , ( AB ) ⁻¹ = B⁻¹A⁻¹ ( ver Matriz invertible#Propiedades ) :
Referencia: véase Davidson y Mackinnon (1993) [ 14 ] : 218
Existe un estimador subidentificado equivalente para el caso en que m < k . Dado que los parámetros son las soluciones de un conjunto de ecuaciones lineales, un modelo subidentificado que utiliza el conjunto de ecuacionesNo tiene una solución única.
Interpretación como mínimos cuadrados en dos etapas
Un método computacional que se puede utilizar para calcular las estimaciones de variables instrumentales es el de mínimos cuadrados en dos etapas (2SLS o TSLS). En la primera etapa, cada variable explicativa que es una covariable endógena en la ecuación de interés se regresa sobre todas las variables exógenas del modelo, incluyendo tanto las covariables exógenas en la ecuación de interés como los instrumentos excluidos. Los valores predichos de estas regresiones se obtienen de la siguiente manera:
Etapa 1: Regresar cada columna de X sobre Z , ():
y guardar los valores previstos:
En la segunda etapa, la regresión de interés se estima como de costumbre, excepto que en esta etapa cada covariable endógena se reemplaza con los valores predichos de la primera etapa:
Etapa 2: Realizar una regresión de Y sobre los valores predichos de la primera etapa:
lo cual da
Este método solo es válido en modelos lineales. Para covariables endógenas categóricas, podría ser tentador usar una primera etapa diferente a la de mínimos cuadrados ordinarios, como un modelo probit para la primera etapa seguido de MCO para la segunda. Esto se conoce comúnmente en la literatura econométrica como la regresión prohibida , [ 15 ] porque las estimaciones de parámetros de variables instrumentales de la segunda etapa son consistentes solo en casos especiales. [ 16 ]
El estimador MCO habitual es:. Reemplazandoy observando quees una matriz simétrica e idempotente , de modo que
El estimador resultante dees numéricamente idéntico a la expresión mostrada arriba. Se debe realizar una pequeña corrección a la suma de los residuos al cuadrado en el modelo ajustado de segunda etapa para que la matriz de covarianza deSe calcula correctamente.
Análisis no paramétrico
Cuando se desconoce la forma de las ecuaciones estructurales, se utiliza una variable instrumental.aún se puede definir mediante las ecuaciones:
dóndeyson dos funciones arbitrarias yes independiente deSin embargo, a diferencia de los modelos lineales, las mediciones deyno permiten la identificación del efecto causal promedio deen, denotado ACE
Balke y Pearl [1997] derivaron límites ajustados para ACE y demostraron que estos pueden proporcionar información valiosa sobre el signo y el tamaño de ACE. [ 17 ]
En el análisis lineal, no hay ninguna prueba para refutar la suposición.es fundamental en relación con el parEste no es el caso cuandoes discreto. Pearl (2000) ha demostrado que, para todoy, la siguiente restricción, denominada "Desigualdad Instrumental", debe cumplirse siempre quesatisface las dos ecuaciones anteriores: [ 10 ]
Interpretación bajo heterogeneidad del efecto del tratamiento
La exposición anterior supone que el efecto causal de interés no varía entre las observaciones, es decir, quees una constante. Generalmente, distintos sujetos responderán de maneras diferentes a los cambios en el "tratamiento" x . Cuando se reconoce esta posibilidad, el efecto promedio en la población de un cambio en x sobre y puede diferir del efecto en una subpoblación determinada. Por ejemplo, el efecto promedio de un programa de capacitación laboral puede diferir sustancialmente entre el grupo de personas que realmente reciben la capacitación y el grupo que decide no recibirla. Por estas razones, los métodos de variables instrumentales implican supuestos implícitos sobre la respuesta conductual, o más generalmente, supuestos sobre la correlación entre la respuesta al tratamiento y la propensión a recibirlo. [ 18 ]
El estimador IV estándar puede recuperar los efectos promedio locales del tratamiento (LATE) en lugar de los efectos promedio del tratamiento (ATE). [ 1 ] Imbens y Angrist (1994) demuestran que la estimación IV lineal puede interpretarse bajo condiciones débiles como un promedio ponderado de los efectos promedio locales del tratamiento, donde las ponderaciones dependen de la elasticidad del regresor endógeno a los cambios en las variables instrumentales. En términos generales, esto significa que el efecto de una variable solo se revela para las subpoblaciones afectadas por los cambios observados en los instrumentos, y que las subpoblaciones que responden más a los cambios en los instrumentos tendrán los mayores efectos en la magnitud de la estimación IV.
Por ejemplo, si una investigadora utiliza la presencia de una universidad pública como variable instrumental para la educación universitaria en una regresión de ingresos, identifica el efecto de la universidad en los ingresos de la subpoblación que obtendría un título universitario si existe una universidad, pero que no lo obtendría si no existe. Este enfoque empírico, sin supuestos adicionales, no le dice a la investigadora nada sobre el efecto de la universidad entre las personas que siempre o nunca obtendrían un título universitario independientemente de si existe una universidad local.
Problema de instrumentos débiles
Como señalan Bound , Jaeger y Baker (1995), el problema radica en la selección de instrumentos "débiles", es decir, instrumentos que predicen mal el predictor endógeno de la pregunta en la ecuación de la primera etapa. [ 19 ] En este caso, la predicción del predictor de la pregunta por parte del instrumento será deficiente y los valores predichos tendrán muy poca variación. Por consiguiente, es improbable que tengan mucho éxito al predecir el resultado final cuando se utilizan para reemplazar el predictor de la pregunta en la ecuación de la segunda etapa.
En el contexto del ejemplo sobre tabaquismo y salud analizado anteriormente, los impuestos al tabaco son instrumentos débiles para influir en el hábito de fumar si la condición de fumador no se ve afectada significativamente por los cambios en los impuestos. Si los impuestos más altos no inducen a las personas a dejar de fumar (o a no empezar a fumar), entonces la variación en las tasas impositivas no nos dice nada sobre el efecto del tabaquismo en la salud. Si los impuestos afectan la salud a través de canales distintos a su efecto en el tabaquismo, entonces los instrumentos son inválidos y el enfoque de variables instrumentales puede generar resultados engañosos. Por ejemplo, en lugares y épocas con poblaciones relativamente preocupadas por la salud, es posible que se implementen impuestos altos al tabaco y, aun manteniendo constantes las tasas de tabaquismo, se observe una correlación entre la salud y los impuestos al tabaco, incluso si fumar no tuviera ningún efecto en la salud. En este caso, sería erróneo inferir un efecto causal del tabaquismo en la salud a partir de la correlación observada entre los impuestos al tabaco y la salud.
Pruebas para instrumentos defectuosos
La fuerza de los instrumentos se puede evaluar directamente porque tanto las covariables endógenas como los instrumentos son observables. [ 20 ] Una regla general común para modelos con un regresor endógeno es: el estadístico F contra la hipótesis nula de que los instrumentos excluidos son irrelevantes en la regresión de primera etapa debe ser mayor que 10.
Inferencia estadística y prueba de hipótesis
Cuando las covariables son exógenas, las propiedades de muestra pequeña del estimador MCO se pueden derivar de manera directa calculando los momentos del estimador condicionados a X. Cuando algunas de las covariables son endógenas, de modo que se implementa la estimación por variables instrumentales, no se pueden obtener expresiones simples para los momentos del estimador. Generalmente, los estimadores de variables instrumentales solo tienen propiedades asintóticas deseables, no propiedades de muestra finita, y la inferencia se basa en aproximaciones asintóticas a la distribución muestral del estimador. Incluso cuando los instrumentos no están correlacionados con el error en la ecuación de interés y cuando los instrumentos no son débiles, las propiedades de muestra finita del estimador de variables instrumentales pueden ser deficientes. Por ejemplo, los modelos exactamente identificados producen estimadores de muestra finita sin momentos, por lo que se puede decir que el estimador no es ni sesgado ni insesgado, el tamaño nominal de los estadísticos de prueba puede estar sustancialmente distorsionado y las estimaciones pueden estar comúnmente lejos del valor verdadero del parámetro. [ 21 ]
Probar la restricción de exclusión
La suposición de que los instrumentos no están correlacionados con el término de error en la ecuación de interés no es contrastable en modelos exactamente identificados. Si el modelo está sobreidentificado, existe información disponible que puede utilizarse para contrastar esta suposición. La prueba más común de estas restricciones de sobreidentificación , denominada prueba de Sargan-Hansen , se basa en la observación de que los residuos deberían no estar correlacionados con el conjunto de variables exógenas si los instrumentos son verdaderamente exógenos. [ 22 ] El estadístico de la prueba de Sargan-Hansen se puede calcular como(el número de observaciones multiplicado por el coeficiente de determinación ) de la regresión MCO de los residuos sobre el conjunto de variables exógenas. Este estadístico será asintóticamente chi-cuadrado con m − k grados de libertad bajo la hipótesis nula de que el término de error no está correlacionado con los instrumentos.
Véase también
- Función de control (econometría) : métodos estadísticos para corregir problemas de endogeneidad.
- Instrumentos óptimos : técnica para mejorar la eficiencia de los estimadores en modelos de momentos condicionales.
Referencias
- 1 2 Imbens, G.; Angrist, J. (1994). "Identificación y estimación de los efectos promedio locales del tratamiento" . Econometrica . 62 (2): 467– 476. doi : 10.2307/2951620 . JSTOR 2951620. S2CID 153123153 .
- ↑ Bullock, JG; Green, DP; Ha, SE (2010). "Sí, pero ¿cuál es el mecanismo? (No esperes una respuesta fácil)". Journal of Personality and Social Psychology . 98 (4): 550– 558. CiteSeerX 10.1.1.169.5465 . doi : 10.1037/a0018933 . PMID 20307128. S2CID 7913867 .
- ↑ https://www.stata.com/meeting/5nasug/wiv.pdf
- ↑ Nichols, Austin (23 de julio de 2006). "Instrumentos débiles: una visión general y nuevas técnicas" .
{{cite journal}}: Para citar una revista se requiere|journal=( ayuda ) - ↑ Leigh, JP; Schembri, M. (2004). "Técnica de variables instrumentales: el precio del cigarrillo proporcionó una mejor estimación de los efectos del tabaquismo en el SF-12". Journal of Clinical Epidemiology . 57 (3): 284– 293. doi : 10.1016/j.jclinepi.2003.08.006 . PMID 15066689 .
- ↑ Epstein, Roy J. (1989). "La caída de MCO en la estimación estructural". Oxford Economic Papers . 41 (1): 94– 107. doi : 10.1093/oxfordjournals.oep.a041930 . JSTOR 2663184 .
- ↑ Stock, James H.; Trebbi, Francesco (2003). "Retrospectivas: ¿Quién inventó la regresión con variables instrumentales?" . Journal of Economic Perspectives . 17 (3): 177– 194. doi : 10.1257/089533003769204416 .
- ^ Reiersøl, Olav (1945). Análisis de Confluencia mediante Conjuntos Instrumentales de Variables . Arkiv para Matemáticas, Astronomi y Fysik. vol. 32A. Upsala: Almquist & Wiksells. OCLC 793451601 .
- ↑ Wooldridge, J.: Introducción a la econometría . South-Western, Scarborough, Canadá, 2009.
- 1 2 3 4 Pearl, J. (2000). Causalidad: Modelos, razonamiento e inferencia . Nueva York: Cambridge University Press . ISBN 978-0-521-89560-6.
- ↑ Angrist, J.; Krueger, A. (2001). "Variables instrumentales y la búsqueda de identificación: de la oferta y la demanda a los experimentos naturales" . Journal of Economic Perspectives . 15 (4): 69– 85. doi : 10.1257/jep.15.4.69 . hdl : 1721.1/63775 .
- ↑ Heckman, J. (2008). "Causalidad econométrica". International Statistical Review . 76 (1): 1– 27. doi : 10.1111/j.1751-5823.2007.00024.x .
- ↑ Bowden, RJ; Turkington, DA (1984). Variables instrumentales . Cambridge, Inglaterra: Cambridge University Press.
- ↑ Davidson, Russell; Mackinnon, James (1993). Estimación e inferencia en econometría . Nueva York: Oxford University Press. ISBN 978-0-19-506011-9.
- ↑ Wooldridge, J. (2010). Análisis econométrico de datos de sección transversal y de panel. Análisis econométrico de datos de sección transversal y de panel. MIT Press.
- ↑ Lergenmuller, Simon (2017). Sustitución de predictores en dos etapas para datos de tiempo hasta el evento (Tesis). hdl : 10852/57801 .
- ↑ Balke, A.; Pearl, J. (1997). "Límites de los efectos del tratamiento a partir de estudios con cumplimiento imperfecto". Journal of the American Statistical Association . 92 (439): 1172– 1176. CiteSeerX 10.1.1.26.3952 . doi : 10.1080/01621459.1997.10474074 . S2CID 18365761 .
- ↑ Heckman, J. (1997). "Variables instrumentales: Un estudio de supuestos conductuales implícitos utilizados en la realización de evaluaciones de programas". Journal of Human Resources . 32 (3): 441– 462. doi : 10.2307/146178 . JSTOR 146178 .
- ↑ Bound, J.; Jaeger, DA; Baker, RM (1995). "Problemas con la estimación de variables instrumentales cuando la correlación entre los instrumentos y la variable explicativa endógena es débil". Journal of the American Statistical Association . 90 (430): 443. doi : 10.1080/01621459.1995.10476536 .
- ↑ Stock, J.; Wright, J.; Yogo, M. (2002). "Una revisión de instrumentos débiles e identificación débil en el método generalizado de momentos". Journal of the American Statistical Association . 20 (4): 518– 529. CiteSeerX 10.1.1.319.2477 . doi : 10.1198/073500102288618658 . S2CID 14793271 .
- ↑ Nelson, CR; Startz, R. (1990). "Algunos resultados adicionales sobre las propiedades exactas de muestras pequeñas del estimador de variables instrumentales" . Econometrica . 58 (4): 967– 976. doi : 10.2307/2938359 . JSTOR 2938359. S2CID 119872226 .
- ↑ Hayashi, Fumio (2000). "Prueba de restricciones sobreidentificativas" . Econometría . Princeton: Princeton University Press. pp. 217–221 . ISBN 978-0-691-01018-2.
Lecturas adicionales
- Greene, William H. (2008). Análisis econométrico (Sexta ed.). Upper Saddle River: Pearson Prentice-Hall. pp. 314–353 . ISBN 978-0-13-600383-0.
- Gujarati, Damodar N .; Porter, Dawn C. (2009). Econometría básica (Quinta ed.). Nueva York: McGraw-Hill Irwin. pp. 711–736 . ISBN 978-0-07-337577-9.
- Keane, Michael P.; Neal, Timothy (2024). " Una guía práctica para instrumentos débiles ". Annual Review of Economics . 16 : 185–212.
- Sargan, Denis (1988). Lecciones de teoría econométrica avanzada . Oxford: Basil Blackwell. pp. 42–67 . ISBN 978-0-631-14956-9.
- Wooldridge, Jeffrey M. (2013). Introducción a la econometría: un enfoque moderno (Quinta edición internacional). Mason, OH: South-Western. pp. 490–528 . ISBN 978-1-111-53439-4.
Bibliografía
- Wooldridge, J. (1997): Métodos de cuasi-verosimilitud para datos de conteo, Manual de econometría aplicada, Volumen 2, ed. MH Pesaran y P. Schmidt, Oxford, Blackwell, pp. 352–406
- Terza, JV (1998): "Estimación de modelos de conteo con cambio endógeno: selección de muestra y efectos de tratamiento endógenos." Journal of Econometrics (84), pp. 129–154
- Wooldridge, J. (2002): "Análisis econométrico de datos de sección transversal y de panel", MIT Press , Cambridge, Massachusetts.
Enlaces externos
- Capítulo del libro de texto de Daniel McFadden
- Clase de econometría (tema: variable instrumental) en YouTube impartida por Mark Thoma .
- Clase de econometría (tema: mínimos cuadrados en dos etapas) en YouTube por Mark Thoma
- Análisis de regresión
- Métodos de ecuaciones simultáneas (econometría)