You are on page 1of 4

La distribución muestral

Es lo que resulta de considerar todas las muestras posibles que pueden ser
tomadas de una población. Su estudio permite calcular la probabilidad que se
tiene, dada una sola muestra, de acercarse al parámetro de la población.
Mediante la distribución muestral se puede estimar el error para un tamaño de
muestra dado.
Media
La media aritmética o simplemente media de un conjunto de mediciones es la
medida de tendencia central más usada y conocida. Esta medida se simboliza
como x (x con raya) cuando representa la media muestral y como  (letra
griega minúscula) para representar la media poblacional.
Ejemplo
Media muestral: Sea X1.....Xn, una m.a.s. con media μ o con E(x)= μ y con
varianza muestral n XV 2 ][ σ = , entonces la media muestra se distribuye
como una normal de parámetros: ),( n NX σ → μ .
La Varianza.
La varianza es el desvío estándar elevado al cuadrado y se simboliza con “S2”
cuando es muestral, o “ 2 cuando es poblacional. Este es una medida que se
usa en muchas pruebas de Hipótesis estadísticas, por ejemplo “el Análisis de
Varianza, ANDEVA” que se basa en la descomposición y relación de las
varianzas de las causas de variación de los datos.
Ejemplo
Varianza muestral: Sea X1.....Xn, una m.a.s. independientes e idénticamente
distribuidas, definimos el estadístico muestral para la varianza como la
cuasivarianza muestral ( 2 111 2 1 1 xx n s n −∑ − = = ) , entonces se verifica
que: ( ) 2 2 1 2 1 → − − n sn χ σ.
Estimación
Este término indica que a partir de lo observado en una muestra (un resumen
estadístico con las medidas que conocemos de Descriptiva) se extrapola o
generaliza dicho resultado muestral a la población total, de modo que lo
estimado es el valor generalizado a la población. Consiste en la búsqueda del
valor de los parámetros poblacionales objeto de estudio. Puede ser puntual o
por intervalo de confianza: - Puntual: cuando buscamos un valor concreto.
Inferencia, estimación y contraste de hipótesis 48 - Intervalo de confianza:
cuando determinamos un intervalo, dentro del cual se supone que va a estar el
valor del parámetro que se busca con una cierta probabilidad.
Estimación puntual
Un estimador de un parámetro poblacional es una función de los datos
muéstrales. En pocas palabras, es una fórmula que depende de los valores
obtenidos de una muestra, para realizar estimaciones. Lo que se pretende
obtener es el valor exacto de un parámetro. Por ejemplo, si se pretende estimar
la talla media de un determinado grupo de individuos, puede extraerse una
muestra y ofrecer como estimación puntual la talla media de los individuos de
la muestra. Inferencia, estimación y contraste de hipótesis 50 La media de la
muestra puede ser un estimador de la media de la población, la cuasivarianza
muestral es un buen estimador de la varianza poblacional y el total muestral es
un buen estimador del total poblacional. Por tanto, una definición más
matemática de un estimador y las propiedades que debe de cumplir un
estimador para ser bueno. Sea X1......Xn, una m.a.s. de tamaño n, decimos que
es un estimador θ* de un parámetro θ si el estadístico que se emplea para
conocer dicho parámetro desconocido es este.
Métodos para obtener estimadores
El demostrar que un cierto estimador cumple estas propiedades puede ser
complicado en determinadas ocasiones. Existen varios métodos que nos van a
permitir obtener los estimadores puntuales. Los más importantes son: •
MÉTODO DE LOS MOMENTOS: se basa en que los momentos
poblacionales y se estiman mediante los momentos muéstrales. Suelen dar
estimadores consistentes. • MÉTODO DE MÍNIMOS CUADRADOS:
consiste en obtener un estimador que hace mínima una determinada función. •
MÉTODO DE MÁXIMA VEROSIMILITUD: consiste en tomar como
parámetro poblacional el valor de la muestra que sea más probable, es decir,
que tenga mayor probabilidad. Se suelen obtener estimadores consistentes y
eficientes. Es el más utilizado. Apuntes de Estadística II 51 La probabilidad de
que la media muestral sea igual a la media poblacional es cero, P[ ] μ == 0x ,
es decir, que será bastante complicado obtener un estimador puntual, por ello
se utiliza más el Intervalo de Confianza y el Contraste de Hipótesis.
Formas de Estimación de un parámetro
Existen dos formas de estimar parámetros: la estimación puntual y la
estimación por intervalo de confianza. En la primera se busca, con base en los
datos muéstrales, un único valor estimado para el parámetro. Para la segunda,
se determina un intervalo dentro del cual se encuentra el valor del parámetro,
con una probabilidad determinada. Si el objetivo del tratamiento estadístico
inferencial, es efectuar generalizaciones acerca de la estructura, composición o
comportamiento de las poblaciones no observadas, a partir de una parte de la
población, será necesario que la parcela de población examinada sea
representativa del total. Por ello, la selección de la muestra requiere unos
requisitos que lo garanticen, debe ser representativa y aleatoria.
Propiedades de la estimación:
• Variabilidad del parámetro: Si no se conoce, puede obtenerse una
aproximación en los datos o en un estudio piloto. También hay métodos para
calcular el tamaño de la muestra que prescinde de este aspecto. Habitualmente
se usa como medida de esta variabilidad la desviación típica poblacional y se
denota σ.
• Error de la estimación: Es una medida de su precisión que se corresponde
con la amplitud del intervalo de confianza. Cuanta más precisión se desee en
la estimación de un parámetro, más estrecho deberá ser el intervalo de
confianza y, por tanto, menor el error, y más sujetos deberán incluirse en la
muestra estudiada. Llamaremos a esta precisión E, según la fórmula E = θ2 -
θ1.
• Nivel de confianza: Es la probabilidad de que el verdadero valor del
parámetro estimado en la población se sitúe en el intervalo de confianza
obtenido. El nivel de confianza se denota por (1-α), aunque habitualmente
suele expresarse con un porcentaje ((1-α) ·100%). Es habitual tomar como
nivel de confianza un 95% o un 99%, que se corresponden con valores α de
0,05 y 0,01, respectivamente.
• Valor α: También llamado nivel de significación. Es la probabilidad (en
tanto por uno) de fallar en nuestra estimación, esto es, la diferencia entre la
certeza (1) y el nivel de confianza (1-α). Por ejemplo, en una estimación con
un nivel de confianza del 95%, el valor α es (100-95)/100 = 0,05.
• Valor crítico: Se representa por Zα/2. Es el valor de la abscisa en una
determinada distribución que deja a su derecha un área igual a α/2, siendo 1-α
el nivel de confianza. Normalmente los valores críticos están tabulados o
pueden calcularse en función de la distribución de la población. Por ejemplo,
para una distribución normal, de media 0 y desviación típica 1, el valor crítico
para α = 0,05 se calcularía del siguiente modo: se busca en la tabla de la
distribución ese valor (o el más aproximado), bajo la columna "Área"; se
observa que se corresponde con -0,64. Entonces Zα/2 = 0,64. Si la media o
desviación típica de la distribución normal no coinciden con las de la tabla, se
puede realizar el cambio de variable t=(X-μ)/σ para su cálculo.
Inferencia, estimación y contraste de hipótesis
Con estas definiciones, si tras la extracción de una muestra se dice que "3 es
una estimación de la media con un margen de error de 0,6 y un nivel de
confianza del 99%", podemos interpretar que el verdadero valor de la media se
encuentra entre 2,7 y 3,3, con una probabilidad del 99%. Los valores 2,7 y 3,3
se obtienen restando y sumando, respectivamente, la mitad del error, para
obtener el intervalo de confianza según las definiciones dadas. Para un tamaño
fijo de la muestra, los conceptos de error y nivel de confianza van
relacionados. Si admitimos un error mayor, esto es, aumentamos el tamaño del
intervalo de confianza, tenemos también una mayor probabilidad de éxito en
nuestra estimación, es decir, un mayor nivel de confianza. Por tanto, un
aspecto que debe de tenerse en cuenta es el tamaño muestral, ya que para
disminuir el error que se comente habrá que aumentar el tamaño muestral.
Esto se resolverá, para un intervalo de confianza cualquiera, despejando el
tamaño de la muestra en cualquiera de las fórmulas de los intervalos de
confianza que veremos a continuación, a partir del error máximo permitido.
Los intervalos de confianza pueden ser unilaterales o bilaterales:
• UNILATERAL: P[ ] < α = 1 zX −α ó P[ > α ] = 1 zX −α

• BILATERAL: 𝑃[𝑧𝑎 < 𝑋 < 𝑧𝑎 ]


2 2