Dadas variables aleatorias, que se definen en el mismo [ 1 ] espacio de probabilidad , la distribución de probabilidad multivariada o conjunta paraes una distribución de probabilidad que da la probabilidad de que cada uno deSe encuentra dentro de cualquier rango o conjunto discreto de valores especificado para esa variable. En el caso de solo dos variables aleatorias, esto se denomina distribución bivariada , pero el concepto se generaliza a cualquier número de variables aleatorias.
La distribución de probabilidad conjunta puede expresarse mediante una función de distribución acumulativa conjunta y, en el caso de variables continuas , mediante una función de densidad de probabilidad conjunta o una función de masa de probabilidad conjunta (en el caso de variables discretas ). Estas, a su vez, permiten hallar otros dos tipos de distribuciones: la distribución marginal, que proporciona las probabilidades de cada variable sin referencia a rangos específicos de valores para las demás variables, y la distribución de probabilidad condicional, que proporciona las probabilidades de cualquier subconjunto de variables condicionadas a valores particulares de las variables restantes.
Ejemplos
Extrae de una urna
Cada una de las dos urnas contiene el doble de bolas rojas que de bolas azules, y ninguna otra, y se selecciona una bola al azar de cada urna, siendo las dos extracciones independientes entre sí.ySean variables aleatorias discretas asociadas con los resultados de la extracción de la primera y la segunda urna, respectivamente. La probabilidad de extraer una bola roja de cualquiera de las urnas es 2 / 3 , y la probabilidad de extraer una bola azul es 1 / 3 . La distribución de probabilidad conjunta se presenta en la siguiente tabla:
Cada una de las cuatro celdas internas muestra la probabilidad de una combinación específica de resultados de las dos extracciones; estas probabilidades constituyen la distribución conjunta. En cualquier celda, la probabilidad de que ocurra una combinación específica es (dado que las extracciones son independientes) el producto de la probabilidad del resultado especificado para A y la probabilidad del resultado especificado para B. La suma de las probabilidades en estas cuatro celdas es igual a 1, como en todas las distribuciones de probabilidad.
Además, la última fila y la última columna dan la distribución de probabilidad marginal para A y la distribución de probabilidad marginal para B respectivamente. Por ejemplo, para A la primera de estas celdas da la suma de las probabilidades de que A sea rojo, independientemente de qué posibilidad para B en la columna anterior a la celda ocurra, como 2 / 3 . Por lo tanto, la distribución de probabilidad marginal paradalas probabilidades incondicionales de, en un margen de la tabla.
lanzamientos de moneda
Consideremos el lanzamiento de dos monedas justas ; seaySean variables aleatorias discretas asociadas con los resultados del primer y segundo lanzamiento de moneda, respectivamente. Cada lanzamiento de moneda es un ensayo de Bernoulli y tiene una distribución de Bernoulli . Si una moneda muestra "cara", la variable aleatoria asociada toma el valor 1, y toma el valor 0 en caso contrario. La probabilidad de cada uno de estos resultados es 1/2 , por lo que las funciones de densidad marginales ( incondicionales) son :
La función de masa de probabilidad conjunta deydefine probabilidades para cada par de resultados. Todos los resultados posibles son Dado que cada resultado es igualmente probable, la función de masa de probabilidad conjunta se convierte en:
Dado que los lanzamientos de moneda son independientes, la función de probabilidad conjunta es el producto de las distribuciones marginales:
Lanzar un dado
Consideremos el lanzamiento de un dado justo y dejemos quesi el número es par (es decir, 2, 4 o 6) yde lo contrario. Además, deje quesi el número es primo (es decir, 2, 3 o 5) yde lo contrario.
Luego, la distribución conjunta dey, expresada como una función de masa de probabilidad, es
Estas probabilidades necesariamente suman 1, ya que la probabilidad de alguna combinación deyocurre 1.
Distribución de probabilidad marginal
Si en un experimento aleatorio se define más de una variable aleatoria, es importante distinguir entre la distribución de probabilidad conjunta de X e Y y la distribución de probabilidad de cada variable individualmente. La distribución de probabilidad individual de una variable aleatoria se denomina distribución de probabilidad marginal. En general, la distribución de probabilidad marginal de X puede determinarse a partir de la distribución de probabilidad conjunta de X y las demás variables aleatorias.
Si la función de densidad de probabilidad conjunta de las variables aleatorias X e Y esLa función de densidad de probabilidad marginal de X e Y, que define la distribución marginal , viene dada por:
donde la primera integral se realiza sobre todos los puntos en el rango de (X,Y) para los cuales X=x y la segunda integral se realiza sobre todos los puntos en el rango de (X,Y) para los cuales Y=y. [ 2 ]
Función de distribución acumulativa conjunta
Para un par de variables aleatorias, la función de distribución acumulativa conjunta (CDF)está dado por [ 3 ] : 89
( Ec. 1 )
donde el lado derecho representa la probabilidad de que la variable aleatoriatoma un valor menor o igual ay esotoma un valor menor o igual a.
Paravariables aleatorias, el CDF conjuntoes dado por
( Ecuación 2 )
Interpretando lavariables aleatorias como un vector aleatorioproduce una notación más corta:
función de densidad conjunta o función de masa
Caso discreto
La función de probabilidad conjunta de dos variables aleatorias discretases:
( Ecuación 3 )
o escritas en términos de distribuciones condicionales dóndees la probabilidad dedado que.
La generalización del caso anterior de dos variables es la distribución de probabilidad conjunta devariables aleatorias discretasque es:
( Ecuación 4 )
o equivalentemente
Esta identidad se conoce como la regla de la cadena de probabilidad .
Dado que se trata de probabilidades, en el caso de dos variables
lo cual se generaliza paravariables aleatorias discretasa
caso continuo
La función de densidad de probabilidad conjuntapara dos variables aleatorias continuas se define como la derivada de la función de distribución acumulativa conjunta (véase la ecuación 1 ):
( Ec. 5 )
Esto es igual a:
dóndeyson las distribuciones condicionales dedadoy dedadorespectivamente yyson las distribuciones marginales parayrespectivamente.
La definición se extiende naturalmente a más de dos variables aleatorias:
( Ecuación 6 )
Nuevamente, dado que se trata de distribuciones de probabilidad, uno tiene respectivamente
Caso mixto
La "densidad conjunta mixta" se puede definir cuando una o más variables aleatorias son continuas y las demás variables aleatorias son discretas. Con una variable de cada tipo. Un ejemplo de una situación en la que se puede desear encontrar la distribución acumulativa de una variable aleatoria continua y otra variable aleatoria discreta surge cuando se desea utilizar una regresión logística para predecir la probabilidad de un resultado binario Y condicionado al valor de una variable de distribución continua.Se debe utilizar la densidad conjunta "mixta" al encontrar la distribución acumulativa de este resultado binario porque las variables de entradaInicialmente se definieron de tal manera que no se les podía asignar colectivamente ni una función de densidad de probabilidad ni una función de masa de probabilidad. Formalmente,es la función de densidad de probabilidad decon respecto a la medida del producto en los respectivos soportes deyCualquiera de estas dos descomposiciones puede utilizarse para recuperar la función de distribución acumulativa conjunta: La definición se generaliza a una mezcla de un número arbitrario de variables aleatorias discretas y continuas.
Propiedades adicionales
Distribución conjunta para variables independientes
En general, dos variables aleatoriasyson independientes si y solo si la función de distribución acumulativa conjunta satisface
Dos variables aleatorias discretasyson independientes si y solo si la función de masa de probabilidad conjunta satisface a pesar dey.
While the number of independent random events grows, the related joint probability value decreases rapidly to zero, according to a negative exponential law.
Similarly, two absolutely continuous random variables are independent if and only if for all and . This means that acquiring any information about the value of one or more of the random variables leads to a conditional distribution of any other variable that is identical to its unconditional (marginal) distribution; thus no variable provides any information about any other variable.
Joint distribution for conditionally dependent variables
If a subset of the variables is conditionally dependent given another subset of these variables, then the probability mass function of the joint distribution is . is equal to . Therefore, it can be efficiently represented by the lower-dimensional probability distributions and . Such conditional independence relations can be represented with a Bayesian network or copula functions.
Covariance
When two or more random variables are defined on a probability space, it is useful to describe how they vary together; that is, it is useful to measure the relationship between the variables. A common measure of the relationship between two random variables is the covariance. Covariance is a measure of linear relationship between the random variables. If the relationship between the random variables is nonlinear, the covariance might not be sensitive to the relationship, which means, it does not relate the correlation between two variables.
The covariance between the random variables and is[2]
Correlation
There is another measure of the relationship between two random variables that is often easier to interpret than the covariance.
The correlation just scales the covariance by the product of the standard deviation of each variable. Consequently, the correlation is a dimensionless quantity that can be used to compare the linear relationships between pairs of variables in different units. If the points in the joint probability distribution of X and Y that receive positive probability tend to fall along a line of positive (or negative) slope, ρXY is near +1 (or −1). If ρXY equals +1 or −1, it can be shown that the points in the joint probability distribution that receive positive probability fall exactly along a straight line. Two random variables with nonzero correlation are said to be correlated. Similar to covariance, the correlation is a measure of the linear relationship between random variables.
The correlation coefficient between the random variables and is
Important named distributions
Entre las distribuciones conjuntas que aparecen con frecuencia en estadística se incluyen la distribución normal multivariada , la distribución estable multivariada , la distribución multinomial , la distribución multinomial negativa , la distribución hipergeométrica multivariada y la distribución elíptica .
Véase también
Referencias
- ↑ Feller, William (1968). Introducción a la teoría de la probabilidad y sus aplicaciones . Vol. 1 (3.ª ed.). págs. 217–218 . ISBN 978-0471257080.
- 1 2 Montgomery, Douglas C.; Runger, George C. (19 de noviembre de 2013). Estadística aplicada y probabilidad para ingenieros (Sexta ed.). Hoboken, NJ: Wiley . ISBN 978-1-118-53971-2OCLC 861273897
- ↑ Park, Kun Il (2018). Fundamentos de probabilidad y procesos estocásticos con aplicaciones a las comunicaciones . Springer. ISBN 978-3-319-68074-3.
Enlaces externos
- "Distribución conjunta" , Enciclopedia de Matemáticas , EMS Press , 2001 [1994]
- "Distribución multidimensional" , Enciclopedia de Matemáticas , EMS Press , 2001 [1994]
- Introducción moderna a la probabilidad y la estadística : comprender el porqué y el cómo . Dekking, Michel, 1946-. Londres: Springer. 2005. ISBN 978-1-85233-896-1OCLC 262680588 .
- "Función de densidad continua conjunta" . PlanetMath .
- Mathworld: Función de distribución conjunta
- Teoría de las distribuciones de probabilidad
- Tipos de distribuciones de probabilidad