Estatística
Estatística
TA
U
IN
M
Toledo, 2025
Versão: 0.5
Sumário
1 Introdução 5
2 Estatı́stica Descritiva 8
2.1 Conceitos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2 Medidas de Tendência Central . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.1 Média . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.2 Mediana . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.3 Moda . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 9
2.3 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 10
2.4 Medidas de Dispersão . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
2.4.1 Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
2.4.2 Desvio padrão . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 12
2.4.3 Coeficiente de Variação . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
2.4.4 Quartis . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
2.4.5 Boxplot . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 15
2.5 Assimetria e Curtose . . . . . . . . TA . . . . . . . . . . . . . . . . . . . . . . . . . 19
2.6 Tabelas e Gráficos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 22
2.7 Tabela de Distribuição de Frequência . . . . . . . . . . . . . . . . . . . . . . . . . 23
2.8 Representações Gráficas . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 39
U
2.9 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 71
3 Amostragem 74
IN
3.1 Conceitos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 74
3.2 Tamanho da Amostra . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 74
3.3 Amostragem Casual Simples . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79
M
4 Probabilidade 87
4.1 Espaço Amostral . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 87
4.2 Classe dos Eventos Aleatórios . . . . . . . . . . . . . . . . . . . . . . . . . . . . 91
4.3 Operações com Eventos Aleatórios . . . . . . . . . . . . . . . . . . . . . . . . . . 91
4.4 Propriedades das Operações . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 92
4.5 Partição de um Espaço Amostral . . . . . . . . . . . . . . . . . . . . . . . . . . . 94
4.6 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 95
Estatı́stica 3
5 Probabilidade 97
5.1 Função de Probabilidade . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 97
5.2 Eventos Equiprováveis . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 98
5.3 Probabilidade Condicional . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 99
5.4 Eventos Independentes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 100
5.5 Teorema de Bayes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 100
5.6 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 102
1 Introdução
O material a seguir são notas de aulas de Estatı́stica para alunos do curso de graduação. Os
livros textos utilizados para a elaboração dessas notas são [2] e [1]. As análises foram realizadas
com o software .
A Estatı́stica é um processo para estudo de problemas associados a fenômenos aleatórios. Para
o estudo destes problems são realizados experimentos aleatórios para obter leituras sobre uma
variável de interesse. Por meio da Estatı́stica é possı́vel realizar a análise e interpretação dos dados
populacionais ou amostrais obtidos e também inferir caracterı́sticas de populações. É aplicável em
ramos do conhecimento que se utilizam de dados experimentais. Do ponto de vista histórico o
crescimento e o desenvolvimento da estatı́stica moderna está associado a três fenômenos isolados:
a necessidade do governo de coletar dados sobre os cidadãos; o desenvolvimento da teoria da pro-
babilidade e o advento da informática.
Nas civilizações antigas como Egı́pcias, Grega e Romana, dados primários eram coletados
com propósito de taxações e finalidades militares. Já na Idade Média, igrejas registravam dados e
informações sobre nascimentos, mortes e casamentos. Os dados atualmente são necessários para
diversas atividades antrópicas sendo relacionadas a questões como saúde, economia, agricultura,
educação e outras. TA
A Estatı́stica pode ser dividida em duas partes: Estatı́stica Descritiva e a Estatı́stica Inferencial.
A Estatı́stica Descritiva está associada a organização, sumarização e descrição de um conjunto de
dados coletados. Esta análise fornece as primeira informações para o pesquisador sobre o pro-
U
blema em estudo e permite tornar mais fácil a leitura dos dados, já que fornece informações sobre
a qualidade de seus dados e, em alguns, casos indicando tendências. Geralmente a função descri-
IN
tiva da estatı́stica não tem um fim em si própria, exceto o caso do censo. Já a Estatı́stica Inferencial
é uma etapa da estatı́stica que trata da coleta, redução, análise, modelagem e interpretação dos
dados. O objetivo da estatı́stica inferencial, também chamada de indutiva, é o de tirar conclusões
M
com base nos resultados observados em amostras extraı́das dessas populações. O próprio termo
indutiva decorre da existência de um processo de indução, isto é, um processo de raciocı́nio e que
partindo-se do conhecimento de uma parte, procura-se tirar conclusões sobre a realidade no todo.
A Estatı́stica Descritiva e Inferencial são utilizadas no contexto da Pesquisa Estatı́stica que é
um conjunto de atividades orientadas para a busca de um determinado conhecimento. Uma pes-
quisa para ser qualificada como cientı́fica deve ser feita de modo sistematizada, utilizando para
isto métodos próprios e técnicas especı́ficas. A pesquisa cientı́fica se distingue de outras modali-
dades quaisquer de pesquisa pelo método, pela técnica, por estar voltada para a realidade empı́rica
e pela forma de comunicar o conhecimento. A pesquisa tem o objetivo de descobrir respostas para
questões, mediante aplicações de métodos cientı́ficos e tentar conhecer e explicar fenômenos que
ocorrem no mundo existente.
Há diversos tipos de pesquisa associadas a certos objetivos como a Pesquisa de Reconheci-
mento ou “Survery”, que pode ser utilizada em estudos de opinião, mercado e diagnóstico; Pes-
quisa Bibliográfica em que se procura material já elaborado; pesquisa documental nas quais se
coletam de informações a partir de documentos quantitativos tais como arquivos públicos e pri-
vados, imprensa, revistas, etc; Pesquisa Experimental empregada em experiências realizadas em
laboratórios, fábricas, parcelas de terras. Em uma pesquisa experimental é comum a utilização de
delineamentos experimentais e também o Controle de Qualidade. Cada etapa indicada possui suas
caracterı́stica, sendo necessário estudo aprofundado.
Estatı́stica 6
Planejamento
Definição do Tema Instrumento de Coleta
Início Determinar os Objetivos
População
Coleta de Dados
Para que?
Em estatı́stica os termos a seguir são utilizados com frequência. Serão apresentadas alguns
conceitos e definições comumente empregados em estatı́stica: População é o conjunto de interesse
TA
final para a pesquisa, em geral, é o conjunto do qual a amostra é retirada; Amostra é qualquer sub-
conjunto da população de interesse, desses subconjuntos os dados observacionais ou experimentais
são obtidos; Unidade experimental ou de Análise é o objeto ou indivı́duo que será estudado na
população dos quais se obtêm os dados; Dados é o valor ou resposta que toma a variável em cada
U
unidade experimental, sendo o resultado de uma observação.
Variável é uma caracterı́stica observável, susceptı́vel de adotar distintos valores ou ser ex-
IN
presso em várias categorias, por exemplo, Idades, Gênero, Série, Horas de estudo, Horas de treino,
etc. As variáveis podem ser classificas como Qualitativas, podendo ser Nominais ou Ordinais ou
Quantitativas podendo ser Discretas ou Contı́nuas, conforme a Figura 1.2.
M
Qualitativas Quantitativas
Uma vez que os dados das variáveis de interesse estão disponı́veis, é possı́vel realizar a etapa
de Tratamento dos Dados em que um conjunto de técnicas usadas para descrever os dados obser-
vados. Nessa etapa é comum a aplicação de Estatı́sticas que são funções dos dados observados
Estatı́stica 7
(amostra) de uma variável e são usados para fins descritivos ou analı́ticos. Uma estatı́stica como
uma função dos dados da amostra é também chamada de medida resumo dos dados. Uma es-
tatı́stica pode ser calculada com a amostra.
Em estatı́stica Inferência pode ser entendido como um onjunto de métodos que permitem in-
ferir o comportamento de uma população a partir do conhecimento da amostra. Neste contexto é
aplicado o Cálculo de Probabilidade que está associado a teoria matemática que deduz a partir
de um modelo as propriedades de um fenômeno aleatório. Nesses modelos é comum a busca por
estimar Parâmetros que são caracterı́sticas importantes da população, comumente são desconhe-
cidas. Um parâmetro pode ser estimado com a amostra. A Informação é o resultado dos dados
processados (ou organizados) alinhado com os objetivos de uma certa pesquisa.
TA
U
IN
M
Estatı́stica 8
2 Estatı́stica Descritiva
2.1 Conceitos
2.2 Medidas de Tendência Central
2.2.1 Média
A média é uma das medidas de tendência central (ou medidas de posição) que são muito uti-
lizadas em estatı́stica descritiva. As principais vantagens dessa medida são: faz uso de todos os
dados para seu cálculo, pode ser determinada com precisão matemática e pode ser determinada
somente o valor total e o número de elementos forem conhecidos. As desvantagens são: não pode
ser empregada para dados qualitativos, e é influenciada por valores extremos, podendo, em alguns
casos, não representar a série. Notação: média populacional é denotada por µ e média amostral
por x.
Definição 2.2.1. A média x é definida por:
n
x1 + x2 + · · · + xn X xi
x= =
n n
TA i=1
Exemplo 2.2.1. Calcular a média dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
U
1.
105 + 221 + 181 + 186 + 121 + 181 + 180 + 143 1318
IN
x= = = 164, 75
8 8
2.
M
x = 164, 75
Exemplo 2.2.2. No Software
## [1] 164.75
2.2.2 Mediana
A mediana é uma das medidas de tendência central (ou medidas de posição). Corresponde ao
valor que está no meio quando os dados estão em ordem crescente ou decrescente. As principais
vantagens da mediana são: a mediana não é influenciada por valores extremos e pode ser obtida
para variáveis qualitativas ordinais ou para as quantitativas. As desvantagens da mediana são: a
mediana exige uma ordenação de categorias, da mais baixa a mais alta; não pode ser obtida para
variáveis qualitativas nominais e não inclui todos os valores da distribuição. Notação: a mediana
será denotada por xe ou por Md .
Estatı́stica 9
Definição 2.2.2. No cálculo da mediana deve ser considerado se o tamanho da amostra n é impar
ou par.
xi = x n2 e xi+1 = x n2 +1
Exemplo 2.2.3. Calcular a mediana dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
2. Logo, a mediana x
e
180 + 181
U
x
e= = 180, 5
2
IN
## [1] 180.5
2.2.3 Moda
A moda é uma das medidas de tendência central (ou medidas de posição). Corresponde ao
valor mais frequente nos dados. As principais vantagens da moda são: a moda é uma medida que
requer apenas o conhecimento da frequência absoluta; pode ser utilizada para qualquer tipo de
variáveis, tanto qualitativas, quanto quantitativas; é de uso prático. Como desvantagens se tem que
a moda não inclui todos os valores da distribuição e mostra-se ineficiente quando a distribuição é
amplamente dispersa.
Exemplo 2.2.5. Determinar a moda dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
Estatı́stica 10
1. Como 181 ocorre 2 vezes no conjunto, segue que a moda é unimodal sendo
M0 = 181
Observação. Se o conjunto de dados possui dois valores com a mesma frequência se diz que é
bimodal, no caso de três ou mais valores com a mesma frequência se diz que é trimodal e no caso
de mais de três valores com a mesma frequência se diz que é multimodal. Se nenhum valor se
repetir no conjunto de dados se diz que o conjunto é amodal
## [,1]
## 181 2 TA
2.3 Exercı́cios
U
1. Calcular a média dos dados da tabela abaixo:
IN
4 40 24 23
M
37 44 25 39
38 25 33 49
30 2 17 24
13 18 50 11
38 43 44 13
41 12 29 50
23 10 49 25
35 38 20 30
n−1
Definição 2.4.2. A variância populacional σ 2 é definida como:
PN
(xi − x)2
σ 2 = i=1
N
e pode também ser obtida por:
PN 2 1
Pn 2
2 i=1 xi − N ( i=1 xi )
σ =
N
Exemplo 2.4.1. Determinar a variância dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
Pn 2
P8
2 i=1 (xi − x) (xi − 164, 75)2
1. s = = i=1
n−1 8−1
= (105 − 164, 75) + (221 − 164, 75)2 + (181 − 164, 75)2 + (186 − 164, 75)2
2
+(121 − 164, 75)2 + (181 − 164, 75)2 + (180 − 164, 75)2 + (143 − 164, 75)2
7
= 1476, 21
Estatı́stica 12
2. ∴ s2 = 1476, 21
## [1] 1476.214
Quanto maior a variância e desvio padrão, maiores são os indı́cios de heterogeneidade entre os
elementos do conjunto.
M
Exemplo 2.4.3. Determinar o desvio padrão dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
1. Como s2 = 1476, 21
√
2. s = 1476, 21 = 38, 42
## [1] 38.42153
Estatı́stica 13
Solução
## [1] 23.32111
Em um conjunto de dados quanto maior o desvio padrão, maior será o coeficiente de variação
e os indı́cios de heterogeneidade entre os elementos do conjunto. Pimentel-Gomes (1985) propos
a seguinte classificação para a intrepreteção do CV: CV < 10% baixo; 10% ≤ CV < 20% médio;
20% ≤ CV < 30 alto e CV ≥ 30% muito alto. A figura (2.1) a seguir ilustra um grupo homogênio
e um heterogênio.
2.4.4 Quartis
Os quartis são medidas usadas no âmbito da dispersão e dividem um conjunto de dados orde-
nados em quatro partes iguais, por meio de três quartis. A Figura a seguir ilustra essa divisão para
um conjunto de dados.
Estatı́stica 14
Homogeneidade Heterogeneidade
1 2 3
4 5
3 4 6 8 11 14 16 17 20 21 23 24
IN
25% dos valores 25% dos valores 25% dos valores 25% dos valores
M
Q1 Q2 Q3
(Mediana)
Figura 2.2: Ilustração da divisão em quartis
Quando um conjunto ordenado de dados é dividido em quatro partes iguais, os pontos de di-
visão são chamados de quartis. Os quartis também são denominados de medidas separatrizes. O
primeiro quartil ou quartil inferior, Q1 , é um valor que tem aproximadamente, um quarto ou 25%
das observações abaixo dele e aproximadamente três- quartos ou 75% das observações acima dele.
O segundo quartil Q2 , tem, aproximadamente, metade 50% das observações abaixo de seu valor.
O segundo quartil é exatamente igual à mediana. O terceiro quartil ou quartil superior, Q3 , tem
aproximadamente três-quartos ou 75% das observações abaixo de seu valor. Como no caso da
mediana os quartis podem não ser únicos.
A posição do primeiro quartil com os dados ordenados pode ser obtida como (n + 1)/4. O valor
de Q1 é obtido por interpolação, média dos valores.
De forma análoga, a posição do terceiro quartil com os dados ordenados pode ser obtida como
3(n + 1)/4. O valor de Q3 é obtido por interpolação, média dos valores.
Estatı́stica 15
Exemplo 2.4.7. Calcular os quartis Q1 , Q2 e Q3 para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21,
23, 24.
Solução
TA
1. Q1 = x n4 + 0, 75 · x n4 +1 − x n4 = x 12 + 0, 75 · x 12 +1 − x 12
4 4 4
= x3 + 0, 75 · (x4 − x3 ) = 6 + 0, 75 · (8 − 6) = 7, 5
2. Como n = 12 é par,
U
xn + xn x 12 + x 12
+1 +1
x 6 + x7 14 + 16 30
Q2 = 2 2 = 2 2
IN
= = = = 15
2 2 2 2 2
3. Q3 = x 3n + 0, 25 · x 3n +1 − x 3n = x 3·12 + 0, 25 · x 3·12 +1 − x 3·12
M
4 4 4 4 4 4
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
x_qua <- quantile(x)
x_qua
2.4.5 Boxplot
O boxplot (gráfico de caixa) é utilizado para verificar a dispersão dos dados, desvio de simetria
e identificar observações longe do “núcleo” dos dados (essas observações são denominadas “outli-
ers”). Para a sua construção são utilizados os quartis. A partir dos quartis determina-se a amplitude
interquartı́lica (Q3 −Q1 ) que é utilizada para determinar o Limite Inferior (LI) e o Limite Superior
(LS) do boxplot.
Estatı́stica 16
Definição 2.4.7. Os Limite Inferior (LI) e o Limite Superior (LS) são definidos por:
LI = Q1 − 1, 5 · (Q3 − Q1 )
LS = Q3 + 1, 5 · (Q3 − Q1 )
valores abaixo de LI ou acima de LS são “outliers”
Exemplo 2.4.9. Calcular os limites LI e LS para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23,
24.
Solução
TA
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
x_LI <- quantile(x)[2] - 1.5*(quantile(x)[4] - quantile(x)[2])
x_LI <- [Link](x_LI)
x_LI
U
## [1] -11.625
IN
x_LS
## [1] 39.375
Exemplo 2.4.11. Construir o gráfico boxplot para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23,
24.
Solução
20
15
10
TA
5
U
IN
Momento de ordem k:
1 P k
(1) mk = xi é o k−ésimo momento populacional, e
N
1P k
(2) mk = xi é o k−ésimo momento amostral.
n
Observação. O momento de ordem 1 (k = 1) corresponde a média.
Definição 2.5.1. O coeficiente de assimetria pode ser estimado por meio das seguintes expressões:
X − M0
As1 =
σ
3 · (X − Md )
As2 =
σ
em que
M
1 P
(1) m3 = (xi − µ)3 é o terceiro momento central (ou momento centrado na média)
N
para os dados de uma população, e
1P
(2) m2 = (xi − x)2 é o segundo momento central para os dados de uma amostra.
n
• Coeficiente de Momento de Assimetria
′
n × m3
As2 =
(n − 1) × (n − 2) × σ 3
′ Pn
em que m3 = i=1 (xi − x)3 .
Com base no coeficiente calculado, por qualquer uma das expressões acima, podemos fazer a
seguinte interpretação:
• Se As = 0, a distribuição é simétrica.
Estatı́stica 20
Exemplo 2.5.1. Considere o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24. Calcule e interprete
o coeficiente de assimetria de Pearson.
Solução
Q1 + Q3 − 2 · Md 7, 5 + 20, 25 − 2 · 15 −2, 25
1. As = = As = = = −0, 177
Q3 − Q1 20, 25 − 7, 5 12, 7
2. Como As = −0, 177 < 0, segue que a distribuição é assimétrica negativa (à esquerda).
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
library(moments)
x_as <- skewness(x)
x_as
## [1] -0.140808
TA
A medida de curtose mede o grau de achatamento da distribuição em relação a curva normal.
Definição 2.5.2. Os percentis dividem os dados em centésimas partes, sendo que cada parte com
M
1% dos dados. Um conjunto de dados pode ser dividido 100 partes iguais por meio de 99 percentis.
Os percentis são denotados por: P1 , P2 , . . . , P99 .
A posição do percentil Pi , com os dados ordenados de forma crescente, pode ser obtido como:
i × (n + 1)
Posto do Pi =
100
em que i = 1, 2, . . . 100 e n é o tamanho do conjunto de dados. O valor do percentil pode ser:
• Determinado como o valor que ocupada a posição (Posto do Pi ) arredondado para o interiro
mais próximo.
• Se a posição (posto) for entre dois valores, o percentil poderá ser determinado por interpolação
entre esses dois valores, com o uso, por exemplo, da média aritmética.
′ ′
em que m2 = (xi − x)2 e m4 = (xi − x)4 .
P P
M
Solução
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
library(moments)
x_k <- kurtosis(x)
x_k
## [1] 1.625981
Exemplo 2.6.2. Em uma tabela não há linhas verticais laterais, ponto final em cada linha e linhas
horizontais no corpo da tabela separando as linhas.
Estatı́stica 23
• Frequência absoluta acumulada (Fa ): é a soma das frequências dos dados anteriores.
U
• Frequência relativa (fr ): é a razão entre o valor de cada frequência e o número total de dados
IN
• Frequência relativa acumulada (Fr ): é a soma das frequências relativas dos dados anteriores.
M
• Frequência percentual (fp ): é a frequência relativa multiplicada por 100, ou seja, fp = fai /n·
100.
• Frequência percentual acumulada (Fp ): é a soma das frequência percentuais dos dados ante-
riores.
1. Considerando n
2. Fórmula de Sturges:
k = 1 + 3, 33 · log(n)
Quando os intervalos são utilizados para a construção de uma tabela de distribuição de frequência,
geralmente é importante determinar:
• Amplitude total ou range (At ): é a diferença entre o maior e o menor valor observado no
conjunto de dados.
• Amplitude dos intervalos ou classes (Ac ): é a divisão da amplitude total (At ) pelo número
de intervalos (k), ou seja,
At
Ac =
TA k
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
Estatı́stica 25
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa
(fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percen-
tual acumulada (Fp )
Exemplo 2.7.1. Considere os valores 5, 9, 18, 5, 9, 18, 5, 9, 18, 5, 9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9. Construir a tabela de distribuição de frequências.
Solução
TA
1. Incluindo os valores na tabela
U
Tabela 2.8: Tabela de distribuição de frequência.
Valor fa Fa fr Fr fp Fp
IN
1
2
M
5
9
13
18
22
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
2. Frquência absoluta
Estatı́stica 26
Valor fa Fa fr Fr fp Fp
1 2
2 3
5 4
9 7
13 3
18 5
22 3
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
3. Frquência absoluta acumulada
TA
Tabela 2.10: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN
1 2 2
2 3 5
M
5 4 9
9 7 16
13 3 19
18 5 24
22 3 27
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
4. Frquência relativa
Estatı́stica 27
Valor fa Fa fr Fr fp Fp
1 2 2 0,07
2 3 5 0,11
5 4 9 0,15
9 7 16 0,26
13 3 19 0,11
18 5 24 0,19
22 3 27 0,11
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
5. Frquência relativa acumulada
TA
Tabela 2.12: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN
1 2 2 0,07 0,07
2 3 5 0,11 0,19
M
5 4 9 0,15 0,33
9 7 16 0,26 0,59
13 3 19 0,11 0,70
18 5 24 0,19 0,89
22 3 27 0,11 1
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
6. Frquência percentual
Estatı́stica 28
Valor fa Fa fr Fr fp Fp
1 2 2 0,07 0,07 7,41
2 3 5 0,11 0,19 11,11
5 4 9 0,15 0,33 14,81
9 7 16 0,26 0,59 25,93
13 3 19 0,11 0,70 11,11
18 5 24 0,19 0,89 18,52
22 3 27 0,11 1 11,11
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
7. Frquência percentual acumulada
TA
Tabela 2.14: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN
A tabela de distribuição de frequências pode ser utilizada para determinar os quartis. Para isso,
basta que os valores sejam ordenados de forma crescente, considerando suas frequências absolutas.
Com os dados ordenados a determinação dos quartis é realizada conforme a subseção 2.4.4. De
forma análoga, é possı́vel também determinar os percentis com a definição 2.5.2.
Solução
k = 1 + 3, 33 · log(n)
Ac = = = 3, 92
k 5
6. Ponto médio
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
10. Frequência relativa acumulada
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
11. Frequência percentual
A tabela de distribuição de frequências para dados agrupados pode ser utilizada para determinar
os quartis. Nesse caso pode ser utilizada a definição a seguir.
Definição 2.7.1. Uma definição para a determinação dos quartis Q1 , Q2 e Q3 com o uso da tabela
de distribuição de frequência para dados agrupados é dada por:
P
r fa − Fac(i−1)
Q = Lci + × Ac
fac(i)
em que:
Estatı́stica 33
P
• r fa para determinar o valor da posição (posto) do quartil a razão r será:
• Ac amplitude de classe.
Com os quartis determinados é possı́vel construir o gráfico boxplot conforme a subseção 2.4.5.
De forma análoga, com o uso da tabela de distribuição de frequências para dados agrupados pode
ser determinados os percentis com a definição a seguir.
TA
Definição 2.7.2. Uma definição para a determinação dos percentis P1 , P2 , . . . , P100 com o uso da
tabela de distribuição de frequência para dados agrupados é dada por:
P
r fa − Fac(i−1)
U
P = Lci + × Ac
fac(i)
IN
em que:
P
• r fa para determinar o valor da posição (posto) do percentil a razão r será:
M
#Frequência Absoluta
## [1] 2 5 9 16 19 24 27
#Frequência Relativa
options(digits=3)
fr_1 <- fa_1/(length(d))
fr_2 <- fa_2/(length(d))
fr_3 <- fa_3/(length(d))
fr_4 <- fa_4/(length(d))
fr_5 <- fa_5/(length(d))
fr_6 <- fa_6/(length(d))
fr_7 <- fa_7/(length(d))
c(fr_1, fr_2, fr_3, fr_4, fr_5, fr_6, fr_7)
Estatı́stica 35
#Frequência Percentual
fp_1 <- fa_1/(length(d))*100
fp_2 <- fa_2/(length(d))*100
fp_3 <- fa_3/(length(d))*100
fp_4 <- fa_4/(length(d))*100
TA
fp_5 <- fa_5/(length(d))*100
fp_6 <- fa_6/(length(d))*100
U
fp_7 <- fa_7/(length(d))*100
c(fp_1, fp_2, fp_3, fp_4, fp_5, fp_6, fp_7)
IN
tabela
## fa Fa fr Fr fp Fp
## 1 2 2 0.0741 0.0741 7.41 7.41
## 2 3 5 0.1111 0.1852 11.11 18.52
## 3 4 9 0.1481 0.3333 14.81 33.33
## 4 4 16 0.2593 0.5926 25.93 59.26
## 5 7 19 0.1111 0.5926 11.11 70.37
## 6 3 24 0.1852 0.8889 18.52 88.89
## 7 3 27 0.1111 1.0000 11.11 100.00
d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
TA
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
U
d_ordenado <- sort(d)
IN
## [1] 19.6
k <- round(sqrt(length(d)))
k
## [1] 5
#Frequência Absoluta
C1_fa <- length(d[d >= C1_inf & d < C1_sup])
C2_fa <- length(d[d >= C2_inf & d < C2_sup])
C3_fa <- length(d[d >= C3_inf & d < C3_sup])
C4_fa <- length(d[d >= C4_inf & d < C4_sup])
C5_fa <- length(d[d >= C5_inf & d < C5_sup])
c(C1_fa, C2_fa, C3_fa, C4_fa, C5_fa)
## [1] 1 10 12 5 2
## [1] 1 11 23 28 30
#Frequência Relativa
options(digits=3)
C1_fr <- C1_fa/(length(d))
C2_fr <- C2_fa/(length(d))
C3_fr <- C3_fa/(length(d))
C4_fr <- C4_fa/(length(d))
C5_fr <- C5_fa/(length(d))
c(C1_fr, C2_fr, C3_fr, C4_fr, C5_fr)
tabela
Alguns desses dados são: Histograma; Polı́gono de frequência absoluta; Polı́gono de frequência
acumulada; Dispersão; Dotplot; Séries temporais; Barras; Pizza (ou Setores); Pictograma entre
outros.
Histograma
8
6
4
2
TA
0
0 5 10 15 20 25
IN
Exemplo 2.8.2. No Software . Gráfico histograma com a função hist, exemplo de edição dos
M
eixos.
Histograma
7
6
5
4
3
2
TA
1
0
1 4 7 10 13 16 19 22
IN
7
6
5
4
TA
3
U
2
IN
5 10 15 20
M
Histograma
7
6
5
TA
4
U
3
IN
2
M
1
0
1 4 7 10 13 16 19 22
Exemplo 2.8.5. No Software . Gráfico de histograma com polı́gono de frequência, exemplo com
a função [Link] do pacote arm.
TA
6
U
5
IN
4
Count
M
3 2
1
0
1 5 9 13 18 22
par(mar = c(3,2,1,1))
Histograma
8
6
4
TA
U
2
IN
0
0 5 10 15 20 25
F. Acumulada
25
20
15
10
5
TA
0
0 5 10 15 20 25
IN
TA
U
15
IN
10
M
5
5 10 15 20
25
2015
Count
10
TA
5
U
0
1 5 9 13 18 22
IN
Exemplo 2.8.9. No Software . Gráfico histograma com a função hist sem e com ajuste de classes
M
d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))
Histograma
15
10
5
TA
0
5 10 15 20 25 30
IN
M
Histograma − Ajuste
12
10
8
6
4
2
TA
0
d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))
info_hist <- hist(d, main = "Histograma")
lines(info_hist$mids, info_hist$counts, type="b")
Estatı́stica 52
Histograma
15
10
5
TA
0
5 10 15 20 25 30
IN
M
12
10
8
6
4
2
TA
0
d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))
Histograma
15
10
5
TA
0
5 10 15 20 25 30
IN
M
F. Acumulada
30
25
20
15
10
5
TA
0
5 10 15 20 25 30
IN
M
F. Acumulada − Ajuste
30
27
24
21
18
15
12
9
6
TA
3
0
Exemplo 2.8.12. No Software . Gráfico de barras verticais para os dados de produção mensal.
d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")
Grafico de Barras
60
50
40
Produção
30
20
10
TA
0
Jan Fev Mar Abr Mai Jun Jul Ago Set Out Nov Dez
U
Mês
IN
d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")
Grafico de Barras
Dez
Nov
Out
Set
Ago
Jul
TA
Mês
Jun
U
Mai
IN
Abr
M
Mar
Fev
Jan
0 10 20 30 40 50 60
Produção
Exemplo 2.8.14. No Software . Gráfico de barras verticais para os dados de produção mensal,
considerando 4 regiões.
Estatı́stica 59
d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
barplot(d_matriz,[Link]=meses, xlab="Mês",
ylab="Produção",col=cores,main="Grafico de Barras",
border="black")
#Legenda
legend("topleft", regioes, cex = 1.3, fill = cores)
TA
Grafico de Barras
U
200
A
B
IN
C
D
150
M
Produção
100
50
0
Jan Fev Mar Abr Mai Jun Jul Ago Set Out Nov Dez
Mês
Estatı́stica 60
Exemplo 2.8.15. No Software . Gráfico de barras verticais para os dados de produção mensal,
considerando 4 regiões.
d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
barplot(d_matriz,[Link]=meses, xlab="Produção",
ylab="Mês",col=cores,main="Grafico de Barras",
border="black", horiz=TRUE)
#Legenda
TA
legend("topright", regioes, cex = 1.3, fill = cores)
U
IN
M
Estatı́stica 61
Grafico de Barras
A
Dez
B
C
Nov
D
Out
Set
Ago
Jul
TA
Mês
Jun
U
Mai
IN
Abr
M
Mar
Fev
Jan
Produção
Exemplo 2.8.16. No Software . Gráfico de pizza (ou setores) para os dados de produção mensal.
Estatı́stica 62
d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")
par(mar = c(0,0,2,0))
# Grafico de Pizza (ou Setores) - Rótulo
pie(d, labels = meses, main="Gráfico de Setores",
col=rainbow(12))
Gráfico de Setores
Mai
Jun
Abr
Mar
TA
Fev
Jan
U
Jul
IN
Dez
M
Nov
Out
Ago
Set
Gráfico de Setores
10.1%
16.4%
2.45%
6.29%
3.5%
2.8%
19.2%
7.34%
TA 3.85%
5.24%
U
13.3%
9.44%
IN
M
Gráfico de Setores 3D
Jun Mai
Abr
Mar
Fev
Jul Jan
Dez
Nov
Ago Out
TA Set
U
IN
M
Gráfico de Setores 3D
16.4% 10.1%
2.45%
6.29%
3.5%
19.2% 2.8%
7.34%
3.85%
13.3% 5.24%
TA 9.44%
U
IN
Gráfico dotplot
TA
0 5 10 15 20 25
U
IN
M
d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")
dotchart(t(d_matriz)[,1:2], main="Gráfico dotplot",
cex=0.8, xlim=c(0,65))
Estatı́stica 67
Gráfico dotplot
A
12
11
10
9
8
7
6
5
4
3
2
1
B
12
11
10
9
8
7
6
5
4
3
TA
2
1
U
0 10 20 30 40 50 60
IN
d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")
plot(d_matriz[1,], type="b", col="blue",
xlim=c(0,13), ylim=c(0,60), xlab="Meses", ylab="Valores")
Estatı́stica 68
60
50
40
Valores
30
20
10
TA
0
0 2 4 6 8 10 12
U
Meses
IN
d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")
60
A
50
B
C
D
40
Valores
30
20
10
TA
0
0 2 4 6 8 10 12
U
Meses
IN
library(MASS)
data(ChickWeight)
x1 <- ChickWeight[1:12, 2]
y1 <- ChickWeight[1:12, 1]
200
150
Peso
100
TA
50
0 5 10 15 20
U
Tempo
IN
library(MASS)
data(ChickWeight)
x1 <- ChickWeight[1:12, 2]
y1 <- ChickWeight[1:12, 1]
x2 <- ChickWeight[13:24, 2]
y2 <- ChickWeight[13:24, 1]
200
Unidade 1
150
Unidade 2
Peso
100
TA
50
U
0 5 10 15 20
IN
Tempo
M
2.9 Exercı́cios
1. Considera os dados da tabela abaixo:
3. Calcular os quartis Q1 , Q2 e Q3 .
4. Construir o gráfico de boxplot.
26 49 36 14
24 6 49 22
46 10 16 25
28 31 26 14
18 14 29 42
5 8 13 16
19 9 13 9
M
12 33 29 42
27 30 31 4
37 2 48 30
3 Amostragem
3.1 Conceitos
O número de objetos (ou indivı́duos) em uma população será indicado por N , e o número de
objetos (ou indivı́duos) de uma amostra será indicado por n. Em amostragem é comum surgir os
seguinte problemas: Como coletar a amostra? Quanto vale n? Qual técnica de amostragem a ser
utilizada?
A estimativa é fundamental em Estatı́stica, isto é, em uma pesquisa muitas vezes há a necessi-
dade de se fazer previsões. Em quase todos os casos, a estimativa está associada a uma pesquisa
ou a uma verificação de caracterı́sticas, realizada em uma parte da população (amostra), pois os
custos podem ser proibitivos de se realizar em toda a população (censo). Assim, um dos objetivos
da estatı́stica é tirar conclusões sobre o “todo” (população) a partir das informações fornecidas por
“parte representativa” do todo (amostra).
A maneira de se escolher os elementos para compor uma amostra é denominada Amostragem.
Como as conclusões relativas à população vão estar baseadas nos resultados obtidos nas amostras
dessa população, vemos o quão importante é a fase de coleta dos dados (amostragem). Se erros
forem cometidos no momento de selecionarmos os elementos da amostra o trabalho fica compro-
TA
metido e os resultados finais serão provavelmente incorretos.
Dessa forma, é necessário garantir que a amostra seja representativa da população. Exceto por
discrepâncias inerentes a aleatoriedade a amostra deve possuir as mesmas caracterı́sticas básicas
da população no que diz respeito à(s) variável(eis) que desejamos pesquisar. Algums vantagens da
U
amostragem são: menor custo, menor tempo, logı́stica, maior amplitude do universo, menor erro
da medida.
IN
Exemplo 3.2.1. Considere uma população com N = 340. Determine o tamanho da amostra para
um erro amostral e = 5%.
Solução
2. ∴ n = 184
Estatı́stica 75
options(digits=6)
N <- 340
e <- 5/100
n <- N/(1 + N * eˆ2)
n
## [1] 183.784
round(n)
## [1] 184
Se for possı́vel supor que a população possui distribuição normal de probabilidade com média
IN
σ 2 · Zα/2
2
n=
M
e2
em que Zα/2 é o valor da tabela normal padronizada Z com nı́vel de significância α e nı́vel de
confiança (1 − α), σ é o desvio padrão da população e e é o erro amostral máximo tolerado.
Exemplo 3.2.3. Considere uma população com desvio padrão σ = 0, 4 Determine o tamanho da
amostra, com significância α = 5% e um erro amostral e = 10%.
Solução
1. Como σ = 0, 4 ⇒ σ 2 = 0, 16, sendo e = 10% = 0, 1.
2. Zα/2 são valores obtidos da tabela normal padronizada Z (Seção 13).
3. Como α = 5% de significância corresponde a
(1 − 5%) = (1 − 0, 05) = 0, 95
de confiança. O valor 0,95 corresponde a uma área, delimitada pelo eixo x, pela curva
normal e pelas retas x = 0 e x = Zα/2 . Como a curva da distribuição normal é simétrica,
se tem que essa área é dividida em duas, ou seja, 0, 95/2 = 0, 475. Logo,
Zα/2 = Z5%/2 = ±1, 96
Estatı́stica 76
dessa forma se obtém a área de 0,475 que corresponde a probabilidade P (0 < Z < Zα/2 ),
que será abordada com mais detalhes nas seções a seguir.
4. Assim, o valor de n pode ser obtido como:
σ 2 · Zα2 0, 42 · 1, 962
n= = ≈ 61, 465 ≈ 61
e2 0, 12
5. ∴ n = 615
Exemplo 3.2.4. No Software .
options(digits=6)
sigma <- 0.4
e <- 0.1
alpha <- 5/100
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
n <- (sigmaˆ2 * Z_alphaˆ2)/eˆ2
n TA
## [1] 61.4633
round(n)
U
## [1] 61
IN
## [1] 61
Exemplo 3.2.5. Em uma pesquisa se tem 300 pessoas favoráveis a escolha do produto A e 152
contrárias. Determinar a proporção p e o tamanho da amostra n com significância α = 5% e um
erro amostral e = 2%.
Solução
2
p · (1 − p) · Zα/2 0, 664 · 0, 336 · 1, 962
n= = = 2.142, 690 ≈ 2.143
e2 0, 022
4. ∴ n = 2.143 TA
Exemplo 3.2.6. No Software .
options(digits=6)
U
cf <- 300
cc <- 152
IN
ct <- cf + cc
p <- cf/ct
M
q <- 1- p
e <- 0.02
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
n <- (p * q * Z_alphaˆ2)/eˆ2
n
## [1] 2143.5
round(n)
## [1] 2144
n <- (p * q * Z_alphaˆ2)/eˆ2
round(n)
## [1] 2144
No caso de uma população pequena (finita) e a amostragem for sem reposição é necessário
corrigir o tamanho da amostra, que pode ser feito com a expressão:
1
n= 2
e 1
2
+
Zα/2 · σ2 N
Exemplo 3.2.7. Considere uma população finita (N = 60), sendo realizada uma amostragem sem
reposição. Determine o tamanho da amostra, com significância α = 5%, erro amostral e = 10%
TA
e com desvio padrão σ = 0, 4.
Solução
U
1. Como σ = 0, 4 ⇒ σ 2 = 0, 16, sendo e = 10% = 0, 1.
IN
4. ∴ n = 30
options(digits=6)
N <- 60
sigma <- 0.4
e <- 0.1
alpha <- 5/100
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
n <- 1/(eˆ2/(Z_alphaˆ2 * sigmaˆ2) + 1/N)
n
Estatı́stica 79
## [1] 30.3614
round(n)
## [1] 30
da amostra.
Algumas caracterı́sticas da amostragem simples aleatória são: é equivalente a um sorteio de
loteria, considera a população homogênea, cada elemento da população (unidade experimental)
tem a mesma chance de ser escolhida, utilizam-se números aleatórios, programas computacionais,
calculadoras, bolinhas numeradas, etc.
Exemplo 3.3.1. Considere a população com 60 objetos. Determine duas amostras de 10 objetos
cada pela técnica de amostragem simples aleatória.
Solução
Estatı́stica 80
1. A população deve ser enumerada com cada objeto recebendo um número de 1 a 60.
2. Como n = 10, basta sortear dois grupos de 10 números para compor a amostra.
3. Grupo 1: 2, 5, 20, 19, 52, 31, 45, 29, 11, 48.
4. Grupo 2: 55, 2, 4, 7, 8, 14, 25, 33, 28, 51.
Exemplo 3.3.2. No Software .
options(digits=6)
N <- 60
n <- 10
simples_casual_1 <- round(runif(n, min=1, max=N))
simples_casual_1
## [1] 19 6 7 58 10 9 15 39 38 23
## [1] 60 53 30 12 54 1 51 47 17 21
2. Definimos:
Ne
We =
N
em que N é o tamanho da população; Ne é o tamanho do estrato; We é a proporção de cada
estrato.
3. Definimos
ne = n · We
em que: e = 1, 2, . . . , E com E número de estratos; n é o tamanho da amostra; PEne é o
tamanho da amostra por estrato; We é a proporção da população por estrato; N = e=1 Ne .
Exemplo 3.4.1. Determine o tamanho da amostra por estrato, para uma amostra n = 60. Nessa
população se tem que o número de casados é 210, solteiro é 50 e outro é 40.
Solução
TA
1. Os tamanhos dos estratos são: Ne1 = 210, Ne2 = 50 e Ne3 = 40 informados no enunciado.
N 300 30
Ne2 50 5
(b) W2 = = =
N 300 30
Ne3 40 4
(c) W3 = = =
N 300 30
5. O tamanho da amostra por estrato são:
21
(a) n1 = W1 · n = · 60 = 42
30
5
(b) n2 = W2 · n = · 60 = 10
30
4
(c) n3 = W3 · n = · 60 = 8
30
Exemplo 3.4.2. No Software .
Estatı́stica 82
options(digits=6)
Ne1 <- 210
Ne2 <- 50
Ne3 <- 40
N <- Ne1 + Ne2 + Ne3
n <- 60
#Proporção dos estratos
W1 <- Ne1/N
W2 <- Ne2/N
W3 <- Ne3/N
#Tamanho da amostra por estrato
n1 <- W1 * n
n2 <- W2 * n
n3 <- W3 * n
c(n1, n2, n3)
## [1] 42 10 8
## [1] 42 10 8
## [1] 11 27 22
não mais os elementos individuais da população. É utilizada quando a população pode ser dividida
em pequenos grupos, chamados conglomerados. Essa amostragem é de fácil escolha da amostra.
Solução
1. Os grupos devem ser enumerados, sendo que cada grupo recebe um número de 1 a 80.
3. Grupo 1: 8, 14, 25, 33, 28, 52, 31, 45, 29, 11, 48, 55, 2, 4, 7
options(digits=6)
N <- 80
n <- 15 TA
amostra_cong <- round(runif(n, min=1, max=N))
amostra_cong
## [1] 23 65 40 55 45 18 49 53 54 68 68 3 15 18 78
U
#Com uma função
IN
amostra_cong(80, 15)
## [1] 31 24 54 78 68 18 36 31 5 15 40 27 71 66 11
Exemplo 3.6.1. Considere uma população com N = 90. Determine uma amostra com 25 elemen-
tos pela técnica de amostragem sistemática.
Solução
options(digits=6)
N <- 90
n <- 25
k <- floor(N/n)
a <- 2
## [1] 2 5 8 11 14 17 20 23 26 29 32 35 38 41 44
amostra_sis[16:25]
## [1] 47 50 53 56 59 62 65 68 71 74
Estatı́stica 85
## [1] 2 5 8 11 14 17 20 23 26 29 32 35 38 41 44
## [1] 47 50 53 56 59 62 65 68 71 74
tivo aleatório confiável. Os resultados da amostragem a esmo são em geral equivalentes aos
de uma amostragem probabilı́stica se a população é homogênea e se não existe a possibi-
lidade de o “amostrador” ser inconscientemente influenciado por alguma caracterı́stica dos
elementos da população.
3.7 Exercı́cios
1. Considere uma população com N = 650. Determine o tamanho da amostra para um erro
amostral e = 10%.
2. Considere uma população com desvio padrão σ = 0, 7 Determine o tamanho da amostra, com
significância α = 5% e um erro amostral e = 13%.
3. Em uma pesquisa se tem 630 pessoas favoráveis a escolha do produto A e 352 contrárias.
Determinar a proporção p e o tamanho da amostra n com significância α = 5% e um erro
amostral e = 6%.
4. Considere uma população finita (N = 90), sendo realizada uma amostragem sem reposição.
Determine o tamanho da amostra, com significância α = 5%, erro amostral e = 8% e com
desvio padrão σ = 1, 2.
Estatı́stica 86
5. Considere a população com 42 objetos. Determine uma amostra de 12 objetos pela técnica de
amostragem simples aleatória.
6. Determine o tamanho da amostra por estrato, para uma amostra n = 80. Nessa população se
tem que o número de casados é 420, solteiro é 120 e outro é 85.
7. Considere uma população com N = 36. Determine uma amostra com 11 elementos pela
técnica de amostragem sistemática.
TA
U
IN
M
Estatı́stica 87
4 Probabilidade
4.1 Espaço Amostral
Na natureza há dois tipos de fenômenos os Determinı́sticos, cujo resultados são os mesmos não
importando quantas vezes se repete o experimento e os Aleatórios, cujos resultados são, em geral,
distintos a cada repetição do experimento. Os Experimentos Aleatórios são conduzidos pelo ho-
mem com o intuito de estudar um fenômeno. O resultado de um experimento aleatório é chamado
de Evento Aleatório, sendo que o conjunto de todos os resultados do experimento aleatório será
denominado de Espaço Amostral do experimento aleatório. Os elementos do espaço amostral são
também chamados de pontos amostrais. O espaço amostral é representado pela letra Ω.
1. Ω = {c, r}
2. Ω = {1, 2, 3, 4, 5, 6}
M
3. Ω = {Ao , . . . , Ro , Ap , . . . , Rp , Ac , . . . , Ac , Ae , . . . , Re }
4. Ω = {(c, c), (c, r), (r, c), (r, r)}
5. Ω = {t ∈ R/t ≥ 0}
Solução
Inicialmente, é necessário criar uma tabela de dupla entrada com o espaço amostral do
lançamento de dois dados. Esse espaço amostral pode também se representado por meio de
um Diagrama de Árvore.
Estatı́stica 88
D1\D2 1 2 3 4 5 6
1 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6)
2 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6)
3 (3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
4 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6)
5 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6)
6 (6,1) (6,2) (6,3) (6,4) (6,5) (6,6)
Tabela 4.1: Tabela de dupla entrada com o espaço amostral do lançamento de dois dados.
1. A = {(1, 1), (2, 2), (3, 3), (4, 4), (5, 5), (6, 6)}
3. C = { } ou ϕ evento impossı́vel.
## Var1 Var2
## 1 1 1
M
## 2 2 1
## 3 3 1
## 4 4 1
## 5 5 1
## 6 6 1
## 7 1 2
## 8 2 2
## 9 3 2
## 10 4 2
## 11 5 2
## 12 6 2
## 13 1 3
## 14 2 3
## 15 3 3
## 16 4 3
## 17 5 3
## 18 6 3
## 19 1 4
Estatı́stica 89
## 20 2 4
## 21 3 4
## 22 4 4
## 23 5 4
## 24 6 4
## 25 1 5
## 26 2 5
## 27 3 5
## 28 4 5
## 29 5 5
## 30 6 5
## 31 1 6
## 32 2 6
## 33 3 6
## 34 4 6
## 35 5 6
## 36 6 6 TA
#Solucao 1
subset([Link](x, y),
[Link](x, y)[,1] == [Link](x, y)[,2])
U
## Var1 Var2
IN
## 1 1 1
## 8 2 2
## 15 3 3
M
## 22 4 4
## 29 5 5
## 36 6 6
#Solucao 2
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2])==10)
## Var1 Var2
## 24 6 4
## 29 5 5
## 34 4 6
#Solucao 3
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2]) < 2)
#Solucao 4
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2]) < 15)
## Var1 Var2
## 1 1 1
## 2 2 1
## 3 3 1
## 4 4 1
## 5 5 1
## 6 6 1
## 7 1 2
## 8 2 2
## 9 3 2
## 10 4 2
## 11 5 2
## 12 6 2
##
##
13
14
1
2
3
3
TA
## 15 3 3
## 16 4 3
U
## 17 5 3
## 18 6 3
IN
## 19 1 4
## 20 2 4
## 21 3 4
M
## 22 4 4
## 23 5 4
## 24 6 4
## 25 1 5
## 26 2 5
## 27 3 5
## 28 4 5
## 29 5 5
## 30 6 5
## 31 1 6
## 32 2 6
## 33 3 6
## 34 4 6
## 35 5 6
## 36 6 6
Estatı́stica 91
suppressWarnings(suppressMessages(library("sets")))
library("sets")
#Conjunto com dois eventos.
eventos <- paste0("E", 1:2)
eventos
TA
## [1] "E1" "E2"
U
classe_eventos <- set_power(eventos)
classe_eventos
IN
A B
A B
TA
Figura 4.3: Operação de Complementação.
1. Idempotentes
(a) A ∩ A = A
M
(b) A ∪ A = A
2. Comutativas
(a) A ∪ B = B ∪ A
(b) A ∩ B = B ∩ A
3. Associativas
(a) A ∩ (B ∩ C) = (A ∩ B) ∩ C
(b) A ∪ (B ∪ C) = (A ∪ B) ∪ C
4. Distributivas
(a) A ∪ (B ∩ C) = (A ∪ B) ∩ (A ∪ C)
(b) A ∩ (B ∪ C) = (A ∩ B) ∪ (A ∩ C)
5. Absorções
(a) A ∪ (B ∩ B) = A
Estatı́stica 93
(b) A ∩ (B ∪ B) = A
6. Identidades
(a) A ∩ Ω = A
(b) A ∪ Ω = Ω
(c) A ∩ ϕ = ϕ
(d) A ∪ ϕ = A
7. Complementares
(a) Ω = ϕ
(b) ϕ = Ω
(c) A ∩ A = ϕ
(d) A ∪ A = Ω
(e) (A) = A TA
8. Leis das Dualidades (ou Leis de Morgan)
(a) (A ∩ B) = A ∪ B
(b) (A ∪ B) = A ∩ B
U
Exemplo 4.4.1. Lança-se um dado. Sejam A, saı́da de uma face par e B, saı́da de uma face menor
IN
1. A ∪ B
M
2. A ∩ B
3. A
4. B
5. A ∪ B
6. A ∩ B
Solução
1. A ∪ B = {1, 2, 3, 4, 6}
2. A ∩ B = {2}
4. B = {4, 5, 6}
Estatı́stica 94
5. A ∪ B = Ω − (A ∪ B) = {5}
6. A ∩ B = Ω − (A ∩ B) = {1, 3, 4, 5, 6}.
#Saidas possiveis
eventos <- c(1:6)
eventos
## [1] 1 2 3 4 5 6
#Evento A
A <- eventos[eventos %% 2 == 0]
B <- eventos[eventos < 4]
#Solucao 1
sort(union(A, B)) TA
## [1] 1 2 3 4 6
#Solucao 2
U
intersect(A,B)
IN
## [1] 2
#Solucao 3
M
setdiff(eventos, A)
## [1] 1 3 5
#Solucao 4
setdiff(eventos, B)
## [1] 4 5 6
i. Ai ̸= ϕ, para i = 1, . . . , n
ii. Ai ∩ Aj = ϕ, para i ̸= j
iii. ni=1 Ai = Ω
S
Estatı́stica 95
A1 A4
A3
A2
An
4.6 Exercı́cios
1. Lançam-se três moedas. Enumerar o espaço amostral e os eventos:
a. Faces iguais
b. cara na 1a moeda
c. coroa na 2a e 3a moedas. TA
2. Considere a experiência que consiste em pesquisar famı́lias com três ciranças, em relação ao
sexo delas, segundo a ordem de nascimento. Enumerar os eventos:
U
a. ocorrência de dois filhos do sexo masculine;
b. ocorrência de pelo menos um filho do sexo masculino;
IN
3. Um lote contém peças de 5, 10, 15, . . . , 50 mm de diâmetro. Suponha que duas peças seja
M
a. A = {x = y}
b. B = {y < x}
c. C = {x = y − 10}
d. D = {(x + y)/2 < 10}
a. somente A ocorre;
b. A e C ocorrem, mas B não;
c. A, B e C ocorrem;
d. pelo menos um evento ocorre;
e. exatamente um ocorre;
Estatı́stica 96
f. nenhum ocorre;
g. exatamente dois ocorrem;
h. pelo menos dois ocorrem;
i. no máximo dois ocorrem.
TA
U
IN
M
Estatı́stica 97
5 Probabilidade
5.1 Função de Probabilidade
Definição 5.1.1. Função de probabilidade é uma função P que associa a cada evento de F um
único número real pertencente ao intervalo [0, 1], satisfazendo aos axiomas:
1. P (Ω) = 1
P (A ∪ B) = P (A) + P (B) − P (A ∩ B)
P (A ∪ B) ≤ P (A) + P (B)
Solução
(a) (b)
1. P (A ∪ B) = P (A ∩ B) = 1 − P (A ∩ B) = 1 − z
(a) Leis de Morgan
(b) P (A) = 1 − P (A)
(a) (b)
2. P (A∩B) = P (A ∪ B) = 1−P (A∪B) = 1−{P (A)+P (B)−P (A∩B)} = 1−x−y −z
TA
(a) Leis de Morgan
(b) P (A) = 1 − P (A)
(a)
U
3. P (A ∩ B) = P (B) − P (A ∩ B) = y − z
(a) P (A ∩ B) = P (B) − P (A ∩ B), diagrama de Venn-Euler.
IN
k
∴ P (A) =
n
Estatı́stica 99
Exemplo 5.2.1. Retira-se uma carta de um baralho completo de 52 cartas. Qual a probabilidade
de sair um rei ou uma carta de espadas?
Solução
2. P (A ∪ B) = P (A) + P (B) − P (A ∩ B)
4
3. Como A = {Ro , Re , Rc, Rp } =⇒ P (A) = .
52
13
4. Como B = {Ae , 2e , . . . , Re } =⇒ P (B) =
52
1
5. Como A ∩ B = {Re } =⇒ P (A ∩ B) =
52
4 13 1 16
6. P (A ∪ B) = P (A) + P (B) − P (A ∩ B) = + − =
TA 52 52 52 52
e
P (B ∩ A)
P (B/A) = , se P (A) ̸= 0
M
P (A)
Exemplo 5.3.1. Exemplo: Consideremos 250 alunos que cursam o primeiro ciclo de uma facul-
dade. Destes alunos, 100 são homes (H) e 150 são mulheres (M); 110 cursam fı́sica (F) e 140
cursam quı́mica (Q). Distribuição dos alunos é a seguinte: Exemplo: Um aluno é sorteado ao
Sexo\Disciplina F Q Total
H 40 60 100
M 70 80 150
Total 110 140 250
caso. Qual a probabilidade de que esteja cursando quı́mica, dado que é mulher?
Solução
1. P (Q/M ) =?
80 150
2. P (M ∩ Q) = e P (M ) =
250 250
Estatı́stica 100
80
P (M ∩ Q) 80
3. P (Q/M ) = = 250 =
P (M ) 150 150
250
1 3 11
Exemplo 5.3.2. Sendo P (A) = , P (B) = e P (A ∪ B) = . Calcular P (A/B).
3 4 12
Solução
P (A ∩ B)
1. P (A/B) = , seP (B) ̸= 0
P (B)
2. Devemos obter P (A ∩ B)
3. P (A ∪ B) = P (A) + P (B) − P (A ∩ B) =⇒ P (A ∩ B) = P (A) + P (B) − P (A ∪ B)
1 3 11 2 1
=⇒ P (A ∩ B) = + − = =
3 4 12 12 6
1
P (A ∩ B) 2
4. P (A/B) = = 6 =
3
P (B) 9
TA
4
e
P (B ∩ A) = P (A) · P (B/A)
Sejam A ⊂ Ω e B ⊂ Ω. Se A e B são independentes:
P (A/B) = P (A) e P (B/A) = P (B)
Definição 5.4.1. A e B são eventos independentes se
P (A ∩ B) = P (A) · P (B)
A1 A4
A3
A2 B
An
Teorema 5.5.2. Teorema de Bayes: Sejam A1 , A2 , . . . , An eventos que formam uma partição
do espaço amostral Ω. Seja B ⊂ Ω e conhecidas as probabilidades P (Ai ) e P (B/Ai ) para
i = 1, . . . , n.
P (Aj ) · P (B/Aj )
P (Aj /B) = Pn
i=1 P (Ai ) · P (B/Ai )
para j = 1, . . . , n.
Exemplo 5.5.1. A urna A contém 3 fichas vermelhas e 2 azuis, e a urna B contém 2 vermelhas e 8
TA
azuis. Joga-se uma moeda ”honesta”. Se a moeda der cara (C), extrai-se uma ficha da urna A; se
der coroa (r) extrai-se uma ficha da urna B. Uma ficha vermelha é extraı́da. Qual a probabilidade
de ter saı́do cara (C) no lançamento?
U
IN
3V 2V
2A 8A
M
A B
Figura 5.2: Ilustração das urnas
Solução
P (V ∩ C)
1. P (C/V ) =
P (V )
1 1
2. P (C) = e P (r) =
2 2
3 2
3. P (V /C) = e P (V /r) =
5 10
4. P (V ) = P (C ∩ V ) + P (r ∩ V ) = P (C) · P (V /C) + P (r) · P (V /r)
1 3 1 2 3 2 4
= · + · = + =
2 5 2 10 10 20 10
Estatı́stica 102
3
P (r ∩ C) 3
5. P (C/V ) = = 10 =
P (V ) 4 4
10
5.6 Exercı́cios
1. Uma urna contém 5 bolas brancas, 4 vermelhas e 3 azuis. Extraem-se simultaneamente 3
bolas. Achar a probabilidade de que:
a. nenhuma seja vermelha;
b. extamente uma seja vermelha;
c. todas sejam da mesma cor.
2. As probabilidades de três jogadores A , B e C marcarem um gol quando cobram um pênalti
são 2/3, 4/5 e 7/10, respectivamente. Se cada um cobrar uma única vez, qual a probabilidade
de que pelo menos um marque um gol?
3. Em uma indústria há 10 pessoas que ganham mais de 20 salários mı́nimos (s. m.), 20 ganham
TA
entre 10 e 20 s.m. e 70 ganham menos de 10 s.m. Três pessoas desta indústria são selecionadas.
Determinar a probabilidade de que pelo menos uma ganhei menos de 10 s.m.
4. A e B jogam 120 partidas de xadrez, quais A ganha 60, B ganha 40 e 20 terminam empatadas.
U
A e B concordam em jogar 3 partidas. Determinar a probabilidade de que:
IN
5. Um lote de 120 peças é entregue ao controle de qualidade de uma firma. O responsável pelo
setor seleciona 5 peças. O lote será aceito se forem observadas 0 ou 1 defeituosas. Há 20
defeituosas no lote.
a. Qual a probabilidade de o lote ser aceito?
b. Admitindo-se que o lote seja aceito, qual a probabilidade de ter sido observado só um
defeito?
6. Uma urna contém 5 bolas brancas, 4 vermelhas e 3 azuis. Extraem-se simultaneamente 3
bolas. Achar a probabilidade de que:
a. nenhuma seja vermelha;
b. exatamente uma seja vermelha;
c. todas sejam da mesma cor.
7. As probabilidades de três jogadorese A, B e C marcarem um gol quando cobram um pênalt
2 4 7
são , e , respectivamente. Se cada um cobrar uma única vez, qual a probabilidade d que
3 5 10
pelo menos um marque um gol?
Estatı́stica 103
Ω = {(c, c, c), (c, c, r), (c, r, c), (c, r, r), (r, c, c), (r, c, r), (r, r, c), (r, r, r)}
X Evento correspondente
0 A0 = {(r, r, r)}
1 A1 = {(c, r, r), (r, c, r), (r, r, c)}
2 A3 = {(c, c, r), (c, r, c), (r, c, c)}
3 A4 = {(c, c, c)}
0
𝐴2 1
𝐴3
M
2
𝐴4 3
ℝ
1
P (X = 0) = P (A1 ) =
8
3
P (X = 1) = P (A2 ) =
8
3
P (X = 2) = P (A3 ) =
8
1
P (X = 3) = P (A4 ) =
8
Estatı́stica 104
X P (X)
0 1/8
1 3/8
2 3/8
3 1/8
Tabela 6.1: Representação em Quadro
3/8
Probabilidade
TA
2/8
U
IN
1/8
M
0 1 2 3
Valor da Variável X
6.1 Definições
Definição 6.1.1. Variável aleatória é a função que associa a todo evento pertencente a uma
partição do espaço amostral um único número real.
Variável aleatória discreta deve assumir valores em um conjunto finito ou infinito, porém enu-
merável. No caso finito será indicado por: x1 , x2 , . . . , xn .
Definição 6.1.2. Função de probabilidade é a função que associa a cada valor assumido pela
variável aletatória a probabilidade do evento correspondente, isto é:
P (X = xi ) = P (Ai ), para i = 1, 2, . . . , n
Estatı́stica 105
Observação.
n
X
p(xi ) = 1
i=1
Exemplo 6.1.1. Lançam-se 2 dados. Seja X a soma das faces, determinar a distribução de proba-
bilidades de X.
Solução
1. Representação em quadro:
X P (X)
2 1/36
3 2/36
4 3/36
5 4/36
TA
6 5/36
7 6/36
8 5/36
U
9 4/36
10 3/36
IN
11 2/36
12 1/36
1
M
2. Representação gráfica
Estatı́stica 106
6/36
5/36
4/36
Probabilidade
3/36
TA
2/36
U
1/36
IN
2 3 4 5 6 7 8 9 10 11 12
M
Valor da Variável X
0.16
0.12
Probabilidade
0.08
0.04
TA
2 4 6 8 10 12
U
Valor da Variável X
IN
Exemplo 6.1.3. Suponhamos que a variável X tenha função de probabilidade dada por:
1
P (X = j) = para j = 1, 2, , n, . . .
2j
1. P (X ser par);
2. P (X ≥ 3);
3. P (Xser múltiplo de 3)
Solução
1. P (X ser par) = P (X = 2) + P (X = 4) + P (X = 6) + · · · =
1 1 1 (a) 1/4 1
= + + + ··· = =
4 16 64 1 − 1/4 3
a1 an+1
(a) Sn = em que q =
1−q an
Estatı́stica 108
1/16 4 1
(b) q = = =
1/4 16 4
2. P (X ≥ 3) = P (X = 3) + P (X = 4) + P (X = 5) + · · · =
1 1 1 (a) 1/8 1
= + + + ··· = =
8 16 32 1 − 1/2 4
a1 an+1
(a) Sn = em que q =
1−q an
1/16 8 1
(b) q = = =
1/8 16 2
3. P (Xser múltiplo de 3) = P (X = 3) + P (X = 6) + P (X = 9) + · · · =
1 1 1 (a) 1/8 1
= + + + ··· = =
8 64 512 1 − 1/8 7
a1 an+1
(a) Sn = em que q =
1−q an
1/64 8 1
(b) q = = =
TA
1/8 64 8
muito importantes. Essas caracterı́sticas são os parâmetros das distribuições. A seguir serão de-
findos os parâmetros de uma distribuição denominados de Esperança matemática (ou média) e
variância.
M
Observação. A esperança matemática E(X) também poderá ser denotada por µ(x), µx ou apenas
por µ, quando não houver ambiguidade. A esperança matemática é um número real, e também
uma média aritmética ponderada.
Exemplo 6.2.1. Uma Seguradora paga R$ 30.000,00 em caso de acidente de carro e cobra uma
taxa de R$ 1.000,00. Sabe-se que a probabilidade de que um carro sofra acidente é de 3%. Quanto
espera a seguradora ganhar por carro segurado?
Solução
n
X
1. E(X) = xi · p(xi ) = x1 · p(x1 ) − x2 · p(x2 )
i=1
= 1.000 · 0, 97 − 29.000 · 0, 03 = 10.000
Estatı́stica 109
LM C = 10.000/100 = R$100
b. E(k · X) = k · E(X);
f. E(X − µx ) = 0.
6.3 Variância
TA
A variância é a medida que fornece o grau de dispersão de probabilidade em torno da média.
U
Definição 6.3.1. A variância de uma variável aleatório X é definida como:
ou,
V AR(X) = E(X 2 ) − {E(X)}2
M
Observação. E(X 2 ) = ni=1 x2i · p(xi ). A variância V AR(X) também poderá ser denotada por
P
V (X), σ 2 (X), σX
2
ou apenas por σ 2 , quando não houver ambiguidade.
X P (X) X · P (X)
0 1/8 0
1 6/8 6/8
2 1/8 2/8
µX = 1
Tabela 6.3: Distribuição da variável X
Estatı́stica 110
Solução
1. O quadro a seguir, apresenta os cálculos para determinar a variância de X:
2. ∴ V AR(X) = 0, 25
Exemplo 6.3.2. Consideremos a distribuição da variável aleatória Y e sua média.
Y P (Y ) Y · P (Y )
-2 1/5 -2/5
-1 1/5 -1/5
0 1/5 0
3 1/5
TA 3/5
5 1/5 5/5
1 µy = 1
Tabela 6.4: Distribuição da variável Y
U
IN
Solução
1. O quadro a seguir, apresenta os cálculos para determinar a variância de Y:
M
Y P (Y ) Y · P (Y ) Y 2 · P (Y )
-2 1/5 -2/5 4/5
-1 1/5 -1/5 1/5
0 1/5 0 0
3 1/5 3/5 9/5
5 1/5 5/5 25/5
1 µy = 1 E(Y 2 ) = 39/5
39 34
2. ∴ V AR(X) = E(X 2 ) − {E(X)}2 = − 12 = = 6, 8
5 5
Observação. A variância é um quadrado, por exemplo a altura média de um grupo de pessoas é
1,70 m e a variância 25 cm2. De forma que a interpretação em cm2 é “estranha” e para facilitar
a interpretação é definido o desvio padrão.
Definição 6.3.3. Desvio padrão da variável X é a raiz quadrada da variância de X, isto é:
p
σx = V AR(X)
Observação. O desvio padrão populacional σx também será denotado por σ(X) e σ. No caso
amostral, a variância será indicada por s2 e o desvio padrão por s.
Estatı́stica 111
b. V AR(k · X) = k 2 · V AR(X);
6.4 Correlação
A covariância mede o grau de dependência entre as duas variáveis X e Y .
Pn
i=1 (xi − x)(yi − y)
cov(X, Y ) =
n−1
Exemplo 6.4.1.
M
X P (X)
1 0,1
2 0,2
3 0,4
4 0,2
5 0,1
Solução
1. (a) F (1) = P (X ≤ 1) = P (X = 1) = 0, 1
(b) F (2) = P (X ≤ 2) = P (X = 1) + P (X = 2) = 0, 3
(c) F (3) = P (X ≤ 3) = P (X = 1) + P (X = 2) + P (X = 3) = 0, 7
(d) F (4) = P (X ≤ 4) = P (X = 1) + P (X = 2) + P (X = 3) + P (X = 4) = 0, 9
(e) F (5) = P (X ≤ 5) = P (X = 1) + P (X = 2) + P (X = 3)
+ P (X = 4) + P (X = 4) = 1
(f) F (1, 34) = P (X ≤ 1, 34) = P (X ≤ 1) = F (1) = 0, 1
(g) F (3, 98) = P (X ≤ 3, 98) = P (X ≤ 3) = F (3) = 0, 7
(h) F (−1) = P (X ≤ −1) = 0
(i) F (−2) = P (X ≤ −2) = 0
(j) F (−3) = P (X ≤ −3) = 0
TA
2.
U
0 se X < 1
IN
0, 1 se 1 ≤ X < 2
0, 3 se 2 ≤ X < 3
F (X) =
0, 7 se 3 ≤ X < 4
M
0, 9 se 4 ≤ X < 5
1 se X ≥ 5
Estatı́stica 113
1
0.9
0.7
Valores de X
TA
0.3
U
0.1
IN
0
F(X)
3.
g. P (a ≤ X ≤ b) = F (b) − F (a) + P (X = a)
i. Como P (a < X ≤ b) = F (b) − F (a) ≥ 0 =⇒ F (b) ≥ F (a), F (x) é uma função não
decrescente.
6.6 Exercı́cios
1. Uma urna contém 4 bolas brancas e 6 pretas. Três bolas são retiradas com reposição. Seja X
o número de bolas brancas. Calcular E(X).
TA
2. Sabe-se que uma moeda mostra a face cara quarto vezes mais do que a face coroa, quando
lançada. Essa moeda é lança 4 vezes. Seja X o número de caras que aparece, determine:
a. E(X)
U
b. V AR(X)
c. P (X ≥ 2)
IN
d. P (1 ≤ X ≤ 3)
M
Estatı́stica 115
Assim, a variável X tem distribuição de Bernoulli, e sua função de probabilidade é dada por:
P (X = x) = pX · q 1−X
V AR(X) = p · q
M
Exemplo 7.1.1. Uma urna tem 30 bolas brancas e 20 verdes. Retira-se uma bola dessa urna. Seja
X um número de bolas verdes, calcular E(X) e V AR(X) e determinar P (X).
Solução
0 −→ q
1. X =
1 −→ p
30 20
2. q = ep=
50 50
30
0 −→ q =
3. X = 50
1 −→ p = 20
50
20 20 30 6
4. E(X) = p = e V AR(X) = p · q = · =
50 50 50 25
x 1−x
2 3
5. P (X = x) = pX · q 1−X = ·
5 5
Estatı́stica 116
V AR(X) = n · p · q
U
Exemplo 7.2.1. Uma prova tipo teste tem 50 questões independentes. Cada questão tem 5 alter-
nativas. Apenas uma das alternativas é a correta. Se o aluno resolve a prova respondendo a esmo
IN
25 25
1 50 1 4 (a)
4. X : B 50; , P (X = 25) = · ≈ 0, 000002
5 25 5 5
n n! 50 50!
(a) = =⇒ =
k k!(n − k)! 25 25!(25)!
Exemplo 7.2.2. Determinar a média e a variância da variável aleatória Y = 3X + 2, sendoX :
B(20; 0, 3).
Solução
1. E(X) = n · p = 20 · 0, 3 = 6, V AR(X) = n · p · q = 20 · 0, 3 · (1 − 0, 3) = 4, 2
2. E(Y ) = E(3X + 2) = E(3X) + E(2) = 3E(X) + 2 = 3 · 6 + 2 = 20
3. V AR(Y ) = V AR(3X + 2) = 32 V AR(X) = 9V AR(X) = 9 · 4, 2 = 37, 8
Estatı́stica 117
V AR(X) = λ
TA
Exemplo 7.3.1. Num livro de 800 páginas há 800 erros de impressão. Qual a probabilidade de
U
que uma página contenha pelo menos 3 erros?
Solução
IN
e−λ · λk
1. P (X = k) = , λ é a media de ocrrência em um intervalo.
k!
M
erros 800
2. λ = = =1
páginas 800
3. P (X ≥ 3), X : número de erros por página.
4. P (X ≥ 3) = 1 − P (X < 3) = 1 − {P (X = 0) + P (X = 1) + P (X = 2)}
−1 0
e−1 · 11 e−1 · 12
e ·λ
=1− + +
0! 1! 2!
= 1 − 0, 919698 ≈ 0, 080301
Exemplo 7.3.2. Numa central telefônica chegam 300 telefonemas por hora. Qual a probabilidade
de que:
Solução
Estatı́stica 118
(b) P (X = k) =
e−λ · λk
k!
TA
, λ é a media de ocrrência em um intervalo.
300
(c) λ = = 5, logo em t minutos =⇒ λ = 5 · t = 5t
60
U
e−5t · (5t)0
(d) P (X = 0) = = e−5t
0!
IN
M
Estatı́stica 119
X P(X)
1 0,1
2 0,2
3 0,4
4 0,2
5 0,1
𝑃(𝑋)
0,4 TA
0,3
0,2
U
0,1 𝐴𝑟1 𝐴𝑟2 𝐴𝑟3 𝐴𝑟4 𝐴𝑟5
IN
0 1 2 3 4 5 𝑋
Para calcular P (1 ≤ X ≤ 3), basta calcular a soma das áreas Ar1 , Ar2 e Ar3 , da seguinte forma:
P (1 ≤ X ≤ 3) = 3i=1 Ari = 0, 1 + 0, 2 + 0, 3 = 0, 7
P
Se tomarmos os pontos médios das bases superiores dos retângulos e ligarmos, temos a curva. Se
X é uma variável aleatória contı́nua, uma função contı́nua f (x) pode ser indicada no gráfico, a
seguir:
Estatı́stica 120
𝑃(𝑋)
0,4
𝑓(𝑥)
0,3
0,2
0,1
𝐴𝑟1 𝐴𝑟2 𝐴𝑟3 𝐴𝑟4 𝐴𝑟5
0 1 2 3 4 5 𝑋 a b 𝑋
8.1 Definições
Uma variável aleatória X é contı́nua em R se existir uma função f (x), tal que:
P (a ≤ X ≤ b) = f (x)dx
a
que corresponde a área delimitada pela função f (x), eixo dos X, e pelas retas X = a e X = b,
M
𝑓(𝑥)
a b 𝑋
Figura 8.3: Probabilidade igual a área delimitada
ou seja, Z b
A = P (a ≤ X ≤ b) = f (x)dx
a
Estatı́stica 121
R +∞
V AR(X) =
{x − E(X)}2 dx
−∞
F (X) = P (X ≤ x) = f (s)ds
U
−∞
IN
𝐹(𝑥)
𝑋
Figura 8.4: Função de distribuição
d
F (x) = f (x)
dx
em pontos em que F (x) é derivável.
Estatı́stica 122
𝑓(𝑋)
1
TA
𝑏−𝑎
U
IN
a b 𝑋
Figura 9.1: Distribuição Uniforme
M
2
V AR(X) = (b − a)
12
a b 𝑋
0 se x ≤ a
x−a
F (x) = se a < x < b
b−a
TA
1 se x ≥ b
Solução
M
1
se 0 ≤ x ≤ 2
1. f (x) = 2
0 se x < 0 ou x > 2
Z 1,5
1,5
1 1
2. P (1 ≤ X ≤ 1, 5) = dx = x
2 2 1
1
1 1 1 3 1 3 1 3−2 1
= · 1, 5 − · 1 = · − = − = =
2 2 2 2 2 4 2 4 4
𝑓(𝑋)
𝜆
𝑋
Figura 9.3: Distribuição Exponencial
V AR(X) = 1
λ2
M
𝐹(𝑋)
1
𝑋
Figura 9.4: Função de distribuição Exponencial
Exemplo 9.2.1. Seja X uma variável aleatória com distribuição exponencial, sendo λ = 25.
Calcular P (X > 0, 1).
Solução
R ∞ (a)
1. P (X > 0, 1) = 25e−25x dx = e−25(0,1) = 0, 082
TA
0,1
R ∞
∞
(a) λe−λx dx = −e−λx 0
0
U
Alternativamente, a solução pode ser obtida pela função de distribuição F (x), da se-
guinte forma:
IN
Uma variável aleatória contı́nua X tem distribuição normal de probabilidade se a sua f.d.p. é
dada por:
1 x − µ !2
1 −
f (x) = √ e 2 σ
σ 2π
para −∞ < x < ∞. A notação será X : N (µ; σ 2 ).
Uma representação gráfica da distribuição normal é apresentada na Figura (9.5)
Estatı́stica 126
𝜇−𝜎 𝜇 𝜇+𝜎
𝑋
Figura 9.5: Distribuição Normal
A probabilidade P (a ≤ X ≤ b) é a área delimitada pelo eixo dos X pela curva da função f (x)
U
e pelas retas X = a e X = b, coforme indicado na Figura (9.6)
IN
M
a 𝑏
𝑋
Figura 9.6: Distribuição Normal - Área
V AR(X) = σ 2
Definição 9.3.1. Seja X uma variável aleatória X : N (µ; σ 2 ), definimos a variável aleatória Z a
seguir:
X −µ
Z=
σ
Z é denominada variável normal reduzida, normal padronizada ou variável normalizada.
−z 2
1
f (z) = √ e 2
M
2π
para −∞ < x < ∞. Logo,
X : N (µ, σ 2 ) −→ Z : (0; 1)
Uma representação gráfica da distribuição normal padronizada é apresentada na Figura (9.7)
−1 0 1 𝑍
Figura 9.7: Distribuição Normal Padronizada
a. X1 = 14 e. X5 = 22
b. X2 = 16
f. X6 = 24
c. X3 = 18
d. X4 = 20 g. X7 = 26
Solução
Observe que µ = 20 e σ2 = 2 ⇒ σ = 2
14 − 20
a. X1 = 14 =⇒ Z1 = = −3
2
16 − 20
b. X2 = 16 =⇒ Z2 = = −2
2
18 − 20
c. X3 = 18 =⇒ Z3 = = −1
2
20 − 20
d. X4 = 20 =⇒ Z4 = =0 TA
2
22 − 20
e. X5 = 22 =⇒ Z5 = =1
2
U
24 − 20
f. X6 = 24 =⇒ Z6 = =2
2
IN
26 − 20
g. X7 = 26 =⇒ Z7 = =3
2
Uma relação da variável X com a variável padronizada Z é indicada na figura a seguir:
M
14 16 18 20 22 24 26 𝑋 −3 −2 −1 0 1 2 3 𝑍
14 = 𝜇𝑥 − 3𝜎 −3 = 𝜇𝑧 − 3𝜎
16 = 𝜇𝑥 − 2𝜎 −2 = 𝜇𝑧 − 2𝜎
18 = 𝜇𝑥 − 𝜎 −1 = 𝜇𝑧 − 𝜎
20 = 𝜇𝑥 0 = 𝜇𝑧
22 = 𝜇𝑥 + 𝜎 1 = 𝜇𝑧 + 𝜎
24 = 𝜇𝑥 + 2𝜎 2 = 𝜇𝑧 + 2𝜎
{ 26 = 𝜇𝑥 + 3𝜎 { 3 = 𝜇𝑧 + 3𝜎
É possı́vel observar que a variável Z indica quantos desvios padrões a variável X está afastada
da média.
𝜇−𝜎 𝜇 𝜇+𝜎 𝑋 −1 0 1 𝑍
𝑃(𝜇 − 𝜎 ≤ 𝑋 ≤ 𝜇) = 𝑃(𝜇 ≤ 𝑋 ≤ 𝜇 + 𝜎) 𝑃(−1 ≤ 𝑍 ≤ 0) = 𝑃(0 ≤ 𝑍 ≤ 1)
TA
𝜇
U
𝑋1 𝑋2 𝑋 𝑍1 0 𝑍2 𝑍
IN
𝑃(𝑋1 ≤ 𝑋 ≤ 𝑋2 ) = 𝑃(𝑍1 ≤ 𝑍 ≤ 𝑍2 )
Figura 9.10: Igualdade das probabilidades
M
X −µ
A vantagem de se utilizar a variável Z = é que podemos tabelar os valores da área, ou
σ
as probabilidades, pois para cada dado, a área depende de µ e σ 2 . Como µ = 0 e σ 2 = 1, uma
tabela Z é suficiente.
𝑃(0 ≤ 𝑍 ≤ 𝑍𝛼 ) = 𝛼
𝛼
0 𝑍𝛼 𝑍
Figura 9.11: Área da variável com nı́vel α
2. P (89 ≤ X ≤ 107)
Solução
10 1,40 93,65
11 1,19 93,54
12 1,15 92,52
M
13 0,98 90,56
14 1,10 89,54
15 1,11 87,85
16 1,20 90,39
17 1,26 93,25
18 1,32 93,41
19 1,43 94,98
20 0,95 87,33
O diagrama de dispersão dos dados é um gráfico no qual cada par (xi , yi ) para i = 1, . . . n é
representado como um ponto plotado em um sistema bidimensional de coordenadas.
100
98
96
94
92
90
88
86
0,85 0,95 1,05 1,15 1,25 1,35 1,45 1,55
Valores
M
𝑦 observados (y)
Linha de regressão
estimada
𝑥
Figura 10.3: Desvios dos dados em relação ao modelo estimado de regressão.
Y = β0 + β1 x + ϵ
podem ser estimados de modo a minimizar a soma dos quadrados dos desvios verticais pelo método
de mı́nimos quadrados. Podemos expressar as n observações na amostra como:
y i = β0 + β1 x + ϵ
para i = 1, . . . , n, sendo a soma dos quadrados dos desvios das observações me relação à linha
verdadeira de regressão dada por:
n
X n
X
L= ϵi 2 = (yi − β0 − β1 x)2
i=1 i=1
n
X n
X
nβb0 + βb1 xi = yi
i=1 i=1
M
n
X n
X n
X
βb0 xi + βb1 x2i = y i xi
i=1 i=1 i=1
Essas equações São chamadas de equações normais dos mı́nimos quadrados. A solução para as
equações normais resulta nos estimadores de mı́nimos quadrados β0 e β1 .
As estimativas de mı́nimos quadrados da interseção e da inclinação do modelo de regressão
linear simples são:
βb0 = y − βb1 x
( ni=1 yi )( ni=1 xi )
P P
Pn
i=1 yi xi −
βb1 = P n
Pn 2 ( ni=1 xi )2
i=1 xi −
n
Pn Pn
i=1 yi xi
em que y = e x = i=1
n n
A linha de regressão ajustada ou estimada é, consequentemente,
yb = βb0 + βb1 x
Estatı́stica 135
yi = βb0 + βb1 xi + ϵi
Exemplo 10.2.1. Ajustar um modelo de regressão linear simples aos dados de pureza de oxigênio.
Solução
P20 P20
1. Como n = 20, xi = 24, 0100, yi = 1841, 2100,
i=1
TAi=1
Pn
x = 1, 2005, y = 92, 0605, i=1 yi xi = 2220, 4952
U
2. Sxx será obtido como:
IN
n Pn
yi )( ni=1 xi )
P
X ( i=1 (1841, 2100)(24, 0100)
Sxx = yi xi − = 2220, 4952 − ≈= 10, 1226
i=1
n 20
M
n
( ni=1 xi )2 (24, 0100)2
X P
Syy = x2i − = 29, 4791 − ≈ 0, 6551
i=1
n 20
5. Assim, o modelo de regressão linear simples (coeficientes com quatro casas decimais) é:
6. Interpretação
Estatı́stica 136
6.1 Por meio do modelo esperarı́amos uma pureza do oxigênio yb = 88, 96, quando o nı́vel
de hidrocarboneto fosse x = 1, 0%;
6.2 A pureza de 88,96% pode ser interpretada como uma estimativa da pureza média da
população verdadeira quando x = 1, 0%;
6.3 A pureza de 88,96% pode ser interpretada também como uma estimativa de uma nova
observação quando x = 1, 0%;
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
TA
93.25, 93.41, 94.98, 87.33)
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
U
Sxx
IN
## [1] 10.1226
Syy
## [1] 0.655095
## [1] 15.4521
## [1] 73.5103
A SQE pode ser entendida como a variabilidade da variável dependente não explicada pelas
variáveis independentes. Essa medida representa as distâncias ao quadrado entre os valores obser-
vados de yi e seus valores ajustados pelo modelo ybi .
TA
Podemos mostrar que o valor esperado da soma dos quadrados dos erros é dado por:
E(SQE ) = (n − 2)σ 2
U
Logo um estimador não tendencioso de σ 2 é dado por:
IN
SQE
σ2 =
n−2
M
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)
## [1] 30.0035
## [1] 1.66686
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
M
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)
## [1] 156.415
Estatı́stica 139
A soma total dos quadrados (SQT ) é a variabilidade total da variável dependente. Essa medida
é represntada pelas distâncias ao quadrado dos valores de yi em relação à média aritmética y. A
SQT é dada por:
n
X
SQT = (yi − y)2
i=1
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
TA
#Soma total dos quadrados - SQT
## [1] 186.419
M
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
#Modelo Linear
Estatı́stica 140
## [1] 30.0035
## [1] 156.415
O valor de Fcalc obtido na Tabela 12.6 é utilizado para realizar o seguinte teste de hipóteses
sobre o modelo de regressão, com vistas a verificar se as variáveis independentes contribuem para
explicar a variação na variável dependente.
H0 : βk = · · · = β0 = 0 (não contribui)
A rejeição da hipótese nula H0 significa afirmar que o modelo, com um certo nı́vel de signi-
ficância α%, contribui para explicar a variável dependente y, ou seja, há relação significativa entre
pelo menos uma variável explicativa e a variável dependente.
A regra de decisão requer a obtenção do Fcrı́tico = Fk, n−2, α% que é obtido da tabela F:
Se Fcalc < Fcrı́tico =⇒ Não rejeita H0 (não contribui)
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
TA
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
U
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)
IN
## [1] 30.0035
## [1] 156.415
## [1] 186.419
Estatı́stica 142
options(digits=4)
Fonte <- c("Regressão", "Resı́duos", "Total")
GL <- c(1, length(x)-2, length(x)-1)
SQ <- c( SQR, SQE, SQT)
SQM <- c( SQR/1, SQE/(length(x)-2), SQT/(length(x) - 1))
F_calc <- c((SQR/1)/(SQE/(length(x)-2)), NA, NA)
#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
TA
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, 1, (length(x) - 2), [Link]=F)
U
F_tab_5
IN
## [1] 4.414
F_tab_10
## [1] 3.007
SQR SQE
R2 = =1−
SQT SQT
Exemplo 10.2.8. No Software .
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x) TA
beta_1 <- Sxx/Syy
beta_0 <- mean(y) - beta_1 * mean(x)
U
#Soma dos quadrados dos resı́duos - SQE
SQE <- sum((y - beta_0 - beta_1*x)ˆ2)
IN
SQE
## [1] 30
M
## [1] 156.4
## [1] 186.4
#Coeficiente de determinação
R2 <- SQR/SQT
R2
## [1] 0.8391
Estatı́stica 144
2
O coeficiente de determinação ajustado (Rajus ), é obtido por meio de uma ponderação do coe-
2
ficiente de determinação (R ) pelo número de variáveis explicativas e pelo número de observações
2
da amostra. O Rajus é utilizado quando fazemos compararações de modelos de regressão múltipla
que prevêem a mesma variável dependente, pois penaliza aquele modelo com maior número de
2
variáveis independentes. O Rajus é dado por:
SQE
2 n − (k + 1) n−1
Rajus =1− = 1 − (1 − R2 )
SQT n − (k + 1)
(n − 1)
Exemplo 10.2.9. No Software .
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
TA
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
U
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
IN
## [1] 30
## [1] 156.4
## [1] 186.4
Estatı́stica 145
#Coeficiente de determinação
R2 <- SQR/SQT
R2
## [1] 0.8391
## [1] 0.8301
cov(X, Y ) σXY
ρXY = p =
V AR(X) · V AR(Y ) σX σY
U
em que cov(X, Y ) = E(XY ) − µX µY . Como σX > 0 e σY > 0, se a covariância entre X e Y
IN
for positiva, negativa ou zero, a correlação entre X e Y será positiva, negativa ou zero, respectiva-
mente. Um resultado importante sobre ρXY , é que para quaisquer duas variáveis aleatórias X e Y ,
se tem:
M
−1 ≤ ρXY ≤ 1
A correlação só escalona a covariância por meio do desvio-padrão de cada variável. Duas
variáveis aleatórias X e Y com correlação não zero são ditas estar correlacionadas. A correlação e
a covariância são medidas da relação linear entre as variáveis aleatórias.
O coeficiente ρXY é também chamado de correlação de Pearson, e pode ser calculado por:
Pn
cov(X, Y ) (xi − x) · (yi − y)
ρXY = p = pPn i=1 pPn
2 2
V AR(X) · V AR(Y ) i=1 (xi − x) · i=1 (yi − y)
1 Pn 1 Pn
em que x1 . . . , xn e x1 . . . , xn são valores das variáveis X e Y , x = i=1 xi e y = yi
n n i=1
são as médias de X e Y .
#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
Estatı́stica 146
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
#Correlação
rho_xy <- sum((x - mean(x)) * (y - mean(x)))/
(sqrt(sum((x - mean(x))ˆ2)) * sqrt(sum((y - mean(y))ˆ2)))
rho_xy
## [1] 0.916
−1 ≤ ρXY ≤ 1
TA
sendo que O sinal indica o sentido, se a correlação é positiva ou negativa. E o valor indica a força
da correlação, ou seja, mais próximos de -1 e 1 indicam correlação mais forte. A Figura a seguir
ilustra a relação da dispersão dos pontos com a correlação.
U
Sentido Força
IN
y y
y y
M
x x
Correlação Positiva Correlação Negativa x x
Correlação “mais” forte Correlação “mais” fraca
x
Correlação Zero
Uma vez calculado o valor da correlação ρXY uma interpretação que poser ser realizada para
ρXY é:
Solução
1. Gráfico de dispersão
Estatı́stica 148
10
8
Renda
6 4
2
4 6 8 10 12
Anos Estudo
P6 P20
TA
2. Como n = 6, i=1 xi = 43, i=1 yi = 33,
Pn
x = 7, 1667, y = 5, 5, yi xi = 297
U
i=1
n Pn
yi )( ni=1 xi )
P
X ( i=1 (33)(43)
Sxx = yi xi − = 297 − = 60, 5
n 6
M
i=1
3. Interpretação
Estatı́stica 149
6.1 Por meio do modelo esperarı́amos uma renda de yb = 1.3561, 00, para três anos de
estudo, ou seja, para x = 3 anos.
SQE
σ2 =
n−2
Pn
(a) Como n = 6 e SQE = i=1 (yi − βb0 − βb1 xi ) = 1, 331609, segue que
(a) A SQT = 61, 5, como SQR = SQT − SQE = 61, 5 − 1, 331609 = 60, 168391
TA
(b) Logo, a tabela será:
1, 33161
Resı́duos 4 1, 33161 SQEM =
4
61, 5
Total 5 61, 5 SQT M =
5
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, k: é o número de variáveis independentes no
modelo de regressão, para o caso univariado k = 1.
6. Pela regra de decisão se Fcalc < Fcrı́tico se rejeita a hipótese nula H0 com nı́vel de signi-
ficância α%.
(d) A 5% de significância se rejeita H0, pois Fcalc = 180, 73891 > 7, 7086 = Fcrı́tico
(e) A 10% de significância se rejeita H0, pois Fcalc = 180, 73891 > 4, 5448 = Fcrı́tico
Estatı́stica 150
#Dados - Renda
##Anos de Estudo x Renda
x <- c(3, 4, 6, 8, 10, 12)
y <- c(1, 3, 4, 6, 9, 10)
#Grafico Dispersão
par(mar = c(2.5,2.5,1,1), mgp=c(1.5,0.5,0))
plot(x,y, xlab="Anos Estudo", ylab="Renda")
10
TA
8
U
Renda
6
IN
4
M 2
4 6 8 10 12
Anos Estudo
#Parametros do Modelo
lm(y˜x)
##
## Call:
## lm(formula = y ˜ x)
##
## Coefficients:
## (Intercept) x
## -1.627 0.995
Estatı́stica 151
#Interpretar: Discursivo
#Decisão
#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, 1, (length(x) - 2), [Link]=F)
F_tab_10 <- qf(0.1, 1, (length(x) - 2), [Link]=F)
11 Intervalos de Confiança - IC
O objetivo da Estatı́stica é conhecer populações por meio das informações amostrais. Como as
populações são caracterizadas por medidas numéricas descritivas, denominadas parâmetros, a es-
tatı́stica diz respeito a realização de inferências sobre esses parâmetros populacionais desconheci-
dos. Parâmetros populacionais tı́picos são a média, denotado por x (amostral) ou µ (populacional),
o desvio padrão, denotado por s (amostral) ou σ (populacional) ou a proporção (p) de determinado
evento populacional.
Os métodos para realizar inferências a respeito dos parâmetros pertencem a duas categorias:
Quando com base em dados amostrais calculamos um valor da estimativa do parâmetro po-
pulacional, temos uma estimativa por ponto do parâmetro considerado. Assim, o valor da média
amostral (x) é uma estimativa por ponto da média populacional (µ). De maneira análoga, o valor
TA
do desvio padrão amostral (s) constitui uma estimativa do parâmetro (σ).
Exemplo 11.0.1. Uma amostra aleatória de 260 alunos de uma universidade de 30.000 estudantes
U
revelou nota média amostral de 7,2. Lgo, x = 7, 2 é uma estimativa pontual da verdadeira média
dos 30.000 alunos.
IN
Exemplo 11.0.2. O intervalo [1,55 m; 1,74m] contém a altura média dos habitantes de uma certa
região, com um nı́vel de confiança de 95%.
Exemplo 11.0.3. Com 97,5% de confiança, o intervalo [12%; 16%] contém a proporção de anal-
fabetos de uma certa cidade.
Exemplo 11.0.4. O intervalo [10mm; 13,2mm] contém o desvio padrão do comprimento de uma
peça produzida por uma certa máquina, com 90% de confiança.
Estatı́stica 153
𝜑 =𝑛−1
𝛼 TA 𝛼
2 2
−𝑍𝛼 0 𝑍𝛼 𝑋
2 2
U
Figura 11.1: Interpretação geométrica do nı́vel de confiança (1 − α)%
IN
Como a distribuição normal é simétrica, pode ser utilizado os valores da área P (0 < Z < Zα )
delimitada pelo curva normal, pelo eixo de Z e pelas retas Z = 0 e Z = Zα . No caso Z : N (0, 1)
alguns valores para P (0 < Z < Zα ) são apresentados na Tabela (11.1), recorte da tabela normal
M
0 𝑍𝛼 𝑍
Os valores destacados na Tabela (11.1) correspondem as áreas P (0 < Z < Zα ) para o nı́vel de
significância α = 20%, 15%, 10%, 5%, 2, 5%e1%, conforme a Tabela (11.2) a seguir:
TA
Tabela 11.2: Valores para alguns nı́veis de significância
α (1 − α) Zα
0,20 0,80 1,28
U
0,15 0,85 1,44
IN
options(digits=8)
x_med <- 500; sigma <- 5; alpha<-0.05; n <- 100
Z_alpha5 <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
IC <- c(x_med - Z_alpha5*sigma/sqrt(n),
x_med + Z_alpha5*sigma/sqrt(n))
IC
11.2
TA
IC para a Média Populacional - Variância Populacional Desconhecida
Quando desconhecemos σ 2 , devemos estimar seu valor com base na amostra disponı́vel. Neste
caso, calcula-se a estimativa do desvio padrão a partir da amostra com a expressão:
U
" n #
Pn 2
1 X ( x
i=1 i )
s2 = x2 −
IN
n − 1 i=1 i n
A substituição do parâmetro σ por s somente será justificável para amostras grandes, ou seja,
para n ≥ 30. Em caso contrário, introduz-se uma correção a qual consiste em usar a variável t de
M
−𝑡 0 𝑡
Figura 11.3: Curva da função de densidade t
Uma distribuição t de Student é apropriada para inferências sobre a média quando σ for des-
conhecida e a população normalmente distribuı́da, qualquer que seja o tamanho da amostra. A
expressão do IC com a t de Student é dada por:
s s
IC(µ, (1 − α)%) = P x − tn−1, α/2 · √ ≤ µ ≤ x + tn−1, α/2 · √
n n
Estatı́stica 156
Exemplo 11.2.1. A seguinte amostra: 9, 8, 7, 12, 9, 6, 11, 6, 10, 9 foi extraı́da de uma população
normal. Construir um intervalo de confiança para a média (µ) ao nı́vel de 95% de confiança.
Solução
1. Para determinar o IC, o tamanho da amostra n deve ser considerado, de forma que
σ σ
(a) Se n ≥ 30, IC(x, (1 − α)%) = P x − Zα/2 · √ ≤ µ ≤ x + Zα/2 · √
n n
s s
(b) Se n < 30, IC(µ, (1 − α)%) = P x − tn−1, α/2 · √ ≤ µ ≤ x + tn−1, α/2 · √
n n
=
1
10 − 1
TA
793 −
7569
10
= 4, 01111
3. Como
U
87
(a) x = = 8, 7,
10
IN
(c) s = s2 = 4, 01111 ≈ 2, 0 e
(d) n = 10.
𝑃ሺ𝑡 > 𝑡𝛼 ሻ = 𝛼
0 𝑡𝛼 𝑡
O valor tn−1, α/2 com n = 10 e α = 0, 05, é indicado na Tabela (11.3) recorte da tabela t da
Seção 13. Nessa tabela ϕ é o grau de liberdade e α é o nı́vel de significância. O valor de t9, 0,025
será:
options(digits=3)
x <- c(9, 8, 7, 12, 9, 6, 11, 6, 10, 9)
x_med <- mean(x)
n <- length(x)
t_value <- qt(p = 0.025, df = (n-1), [Link]=F)
s2 <- 1/(length(x) - 1) * (sum(xˆ2) - sum(x)ˆ2/length(x))
s <- sqrt(s2)
IC <- c(x_med - t_value*s/sqrt(n), x_med + t_value*s/sqrt(n))
IC
x
pb =
n
em que x é o número de sucessos (casos favoráveis) e n é tamanho da amostra (número total
de casos observados). O intervalo de confiança para a proporção p, considerando n > 30 é dado
por:
r r !
pb(1 − pb) pb(1 − pb)
IC(p, (1 − α)%) = P pb − Zα/2 · ≤ p ≤ pb + Zα/2 ·
n n
Exemplo 11.3.1. Dentre 500 pessoas que foram entrevistadas a respeito de suas preferências
eleitorais, 260 mostraram-se favoráveis ao candidato y. Calcule o IC ao nı́vel de 90% para a
proporção de eleitores favoráveis ao candidato y.
Solução
r r !
0, 52(1 − 0, 52) 0, 52(1 − 0, 52)
=P 0, 52 − 1, 65 · ≤ p ≤ 0, 52 + 1, 65 ·
n n
M
options(digits=4)
n <- 500
x <- 260
p <- x/n
alpha <- 0.1
Z_alpha1 <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
𝑓(𝜒 2 𝑖)
𝜑 =𝑛−1
𝛼
1−𝛼 𝛼
2
2
2 2
𝜒𝐼𝑛𝑓𝑒𝑟𝑖𝑜𝑟 𝜒𝑆𝑢𝑝𝑒𝑟𝑖𝑜𝑟 𝜒2
TA
Exemplo 11.4.1. Os dados sobre a voltagem de quebra de circuitos eletricamente foram obtidos
U
de um gráfico de probabilidade normal com 17 pontos. Sabe-se que a variância da distribuição
da voltagem de quebra é de 137324,3. Construir um I.C. de 95% de confiança.
IN
Solução
1. Como
M
options(digits=8)
n <- 17
s2 <- 137324.3
alpha <- 0.05
0 𝜒𝛼2 𝜒2
IN
M
1. Como, s s !
s2 · (n − 1) s2 · (n − 1)
IC(σ, (1 − α)%) = P ≤σ≤
χ2n−1, α/2 χ2n−1, 1−α/2
√ √
2. Para determinar o IC para o desvio padrão s = s2 = 137324.3 ≈= 370.57293, basta
extrair a raiz quadrada dos limites do IC para a variância, ou seja:
p √ p
IC(σ, (1 − α)%) = P 76172, 259 ≤ σ 2 ≤ 318110, 439
options(digits=8)
U
n <- 17
s2 <- 137324.3
IN
11.6 Exercı́cios
1. A voltagem de quebra da corrente alternada (CA) de um lı́quido isolante indica sua resistência
dielétrica. Construa um intervalo de confiança com 1% de margem de erro, sabendo que foram
amostradas 48 tensões de quebra, com média de 54,7 kV e desvio padrão de 5,23 kV.
3. Sabe-se que o tempo de vida de certo tipo de válvula tem distribuição aproximadamente nor-
mal. Uma amostra de 25 válvulas forneceu e s = 50. Construir um I.C. para σ 2 , ao nı́vel de
2%.
4. Uma amostra de onze elementos, extraı́da de uma população com distribuição normal, forne-
ceu variância s2 = 7, 08 . Construir um I.C. de 90% para a variância da população.
TA
U
IN
M
Estatı́stica 163
12 Testes de Hipóteses
Uma hipótese em estatı́stica pode ser entendida como uma alternativa relativa a um parâmetro
de uma distribuição de probabilidade. Em estatı́stica é utilizado uma hipótese nula, denotada por
H0 , associada a um valor suposto para um parâmetro populacional. Com o uso da amostra esse
parâmetro é estimado, e se o resultado não for muito diferente do parâmetro a hipótese H0 não
poderá ser rejeitada. A hipótese alternativa, denotada por H1 , é uma hipótese que contraria a
hipótese nula. Essa hipótese, em estatı́stica, é aceita se os resultados da amostra forem diferentes
da indicada em H0 .
No processo de testar hipóteses, podem ocorrer, dois tipos de erros, denominados erro de Tipo
I e erro de Tipo II. O erro de tipo I ocorre ao rejeitar a hipótese nula (H0 ), quando na realidade ela
é verdadeira, esse erro também é chamdo de falsos positivos. O erro tipo II ocorre se a hipótese
nula (H0 ) não é rejeitada, quando na verdade ela é falsa, esses erro também é chamado de falsos
negativos. O quadro abaixo resumos os erros de Tipo I e II.
Geralmente, a hipótese nula é estabelecida com base no comportamento passado, já a alter-
nativa é formulada em função de alterações ou inovações recentes. Na realização de um teste de
hipóteses, é comum passar pelos seguintes passos:
M
A estatı́stica do teste é um valor calculado a partir da amostra e que será utilizado na tomada de
decisão. A decisão é realizada por meio da comparação do valor tabelado, segundo a distribuição
do teste, com a estatı́stica do teste.
A região crı́tica é a região em que a hipótese nula H0 é rejeita. A área da região crı́tica é igual
ao nı́vel de significância (α) estabelecido para a probabilidade de rejeição de H0 quando ela é
verdadeira.
Os testes de hipóteses podem ser unilateral à direita, unilateral à esquerda ou bilateral.
(
H0 : θ = θ0
H1 : θ > θ0
1−𝛼
𝛼
𝑋
Figura 12.2: Região de rejeição - Unilateral à direita
TA
2. Para um teste unilateral à esquerda, um parâmetro populacional é comparado com a estima-
tiva θ0 , da seguinte forma:
(
H0 : θ = θ0
U
H1 : θ < θ0
IN
1−𝛼
𝛼
𝑋
Figura 12.3: Região de rejeição - Unilateral à esquerda
1−𝛼
𝛼 𝛼
2 2
𝑋
Figura 12.4: Região de rejeição - Bilateral
2 2
Região de Rejeição Região de Região de Rejeição
Aceite
M
Como conclusão de um teste de hipótese, se tem que ao rejeitar a hipótse nula H0 , implica que
se tem evidências estatı́sticas com um nı́vel de significância α, que corresponde ao risco de uma
decisão errada, erro de tipo I. E ao aceitar a hipótese nula H0 , implica que a hipótese nula não pode
ser rejeitada com a significância α, que corresponde ao risco de uma decisão errada, ou seja, erro
de tipo II.
H1 : µ > µ0
H1 : µ < µ0
H1 : µ ̸= µ0
Estatı́stica 166
Zcalc = σ
√
n
M
2. O desvio padrão populacional σ é desconhecido. Nesse caso a estatı́stica do teste é dada por:
x − µ0
tcalc = s
√
n
sendo que a estimativa do desvio padrão σ é obtido a partir da amostra com a expressão:
v " n #
Pn 2
u
u 1 X ( x
i=1 i )
s=t x2 −
n − 1 i=1 i n
O valor tn−1, α/2 com n = 10 e α = 0, 05, é indicado na Tabela (12.2) recorte da tabela t da
Seção 13. Nessa tabela ϕ é o grau de liberdade (n − 1) e α é o nı́vel de significância. O valor de
t9, 0,025 será:
H1 : µ ̸= 44
Solução
x − µ0 42 − 44 −2
Zcalc = σ = = = −1, 4
√ 7 7
√
n 25 5
3. Como,
|Zcalc | = | − 1, 4| = 1, 4 < Zα/2 = 1, 96
Estatı́stica 168
4. Logo, a decisão é não rejeitar H0 , isto é, a média é igual a 44, com 5% de risco de não
rejeitarmos uma hipótese falsa.
Exemplo 12.1.2. Desvio padrão populacional σ é conhecido (unilateral à esquerda). Uma variável
X com distribuição normal tem desvio padrão igual a 3. Uma amostra de tamanho n = 12 dessa
população revelou uma média x = 23. Com um nı́vel de 5% de significância é possı́vel afirmar
que a média populacional é menor do que 26?
(
H0 : µ = 26
H1 : µ < 26
Solução
x − µ0 23 − 26 −3
Zcalc = σ = = = −3, 464
√ 3 3
√
TA √
n 12 12
2. Pelas regras de decisão se tem que:
U
(a) Se Zcalc < −Zα , rejeita-se H0 (unilateral à esquerda)
(b) Para α = 5%, Zα = Z5% = Z0,05 = 1, 64
IN
3. Como,
Zcalc = −3, 464 < −Zα = −Z0,05 = −1, 64
M
4. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que a média populacional é
menor do que 26, com 5% de risco de rejeitarmos uma hipótese verdadeira.
Exemplo 12.1.3. Desvio padrão populacional σ é conhecido (unilateral à direita). Uma variável
X com distribuição normal tem desvio padrão igual a 3. Uma amostra de tamanho n = 12 dessa
população revelou uma média x = 23. Com um nı́vel de 5% de significância é possı́vel afirmar
que a média populacional é maior do que 21?
(
H0 : µ = 21
H1 : µ > 21
Solução
x − µ0 23 − 21 2
Zcalc = σ = = = 2, 309
√ 3 3
√ √
n 12 12
Estatı́stica 169
3. Como,
Zcalc = 2, 309 > Zα = Z0,05 = 1, 64
4. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que a média populacional é
maior do que 21, com 5% de risco de rejeitarmos uma hipótese verdadeira.
H1 : µ1 − µ2 < d
U
H1 : µ1 − µ2 > d
H1 : µ1 − µ2 ̸= d
IN
d−d
tcalc = s
√
n
s
P 2 P
(di − d) di
em que s = ,d= , di = xi − yi com di representando a i-ésima diferença
n−1 n
entre duas observações emparelhadas. Nesse caso são calculadas as diferenças para cada par de
valores, obtendo n diferenças.
E as regras de decisão, utilizam o grau de liberdade ϕ = n − 1 são:
s2p +
n1 n2
em que
M
(x − y) − d
tcalc = r 2
s1 s2
+ 2
n1 n2
Solução
U
1. As diferenças di = xi − yi com i = 1, . . . , n já estão calculadas na tabela do enunciado.
P
di
d= = 35, 42
n
M
d−d 35, 42 − 0
tcalc = s = 21, 462 = 5, 716
√ √
n 12
5. O valor de ttabelado com ϕ = n − 1 graus de liberdade e α/2 = 5%/2 = 0, 025 é dado por:
7. Como,
tcalc = 5, 716 > 2, 201 = t11, 0,025 = tn−1, α/2
Estatı́stica 173
8. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que houve diferença nos
nı́veis de glicose após o tratamento, com 5% de risco de rejeitarmos uma hipótese verdadeira.
Solução
1. O teste é unilateral a direita, pois nos dados da Tabela 12.2.1 se tem que:
TA
µ1 = µx = 152, 67 > 123, 25 = µy = µ2
ou seja, µ1 − µ2 = µx − µy > 0.
U
2. As diferenças di = xi − yi com i = 1, . . . , n já estão calculadas na Tabela 12.2.1 do enunci-
ado.
IN
d−d 35, 42 − 0
tcalc = s = 21, 462 = 5, 717
√ √
n 12
8. Como,
tcalc = 5, 716 > 1, 796 = t11, 0,05 = tn−1, α
9. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que houve diminuição nos
nı́veis de glicose após o tratamento, com 5% de risco de rejeitarmos uma hipótese verdadeira
(Tipo I).
Solução
TA
1. As variâncias são conhecidas:
σ12 = σ22 = 36
U
2. As médias µx e µy são dadas por:
IN
64 75
µx = = 4 e µy = =3
16 25
M
(x − y) − d (4 − 3) − 0
Zcalc = r 2 2
= r = 0, 520
σ1 σ2 36 36
+ +
n1 n2 16 25
5. Como,
|Zcalc | = |0, 520| = 0, 520 < Zα/2 = Z0,025 = 2, 24
6. Logo, a decisão é não rejeitar H0 , isto é, as médias populacionais são iguais, com 5% de
risco de não rejeitarmos uma hipótese falsa.
Estatı́stica 175
Exemplo 12.2.4. (Dados Não emparelhados - Caso 2 - Bilateral) Um grupo de 12 pessoas foi
submetido a um tratamento para reduzir a glicose por um perı́odo de 30 dias. Os dados observados
para as 12 pessoas antes do tratamento foi denominada de xi . Considere a situação em que depois
do tratamento foi possı́vel observar a glicose de apenas 9 pessoas sendo as denominado de yi . Ao
nı́vel de 5% é possı́vel afirmar que houve diferença nos nı́veis de glicose após o tratamento? Essa
afirmação corresponde a testar com 5% as seguintes hipóteses:
H0 : µ1 − µ2 = d = 0
H : µ − µ2 ̸= d = 0
1 1
sendo µ1 = µx e µ2 = µy
192 123
180 130
177 121
M
166
168
192
Solução
1. O tamanho das amostras n1 = 12 e n2 = 9, podemos supor que desvios padrões são iguais.
Logo a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as expressões:
"n
2
# " 12 P12 2 #
1
( ni=1
P 1
1 xi ) 1 i=1 xi
X X
s21 = 2
xi − = 2
xi − = 552, 24
n1 − 1 i=1 n1 12 − 1 i=1 12
" n2 Pn2 2
# " 9 P9 2 #
1 X ( i=1 yi ) 1 X y
i=1 i
s22 = yi2 − = yi2 − = 101, 53
n2 − 1 i=1
n2 9 − 1 i=1 9
Estatı́stica 176
5. Como,
|tcalc | = |4, 78| = 4, 78 > tn−2, α/2 = t19, 0,025 = 2, 0930
U
6. Logo, a decisão é rejeitar H0 , isto é, as médias populacionais são diferentes, com 5% de
IN
Exemplo 12.2.5. Fazer o teste de hipótese do Exemplo 12.2.4 com a suposição de que os desvios
padrões são diferentes.
M
Solução
"n
1
Pn1 2
# " 12 P12 2 #
1 ( x
i=1 i ) 1 i=1 xi
X X
s21 = x2i − = x2i − = 552, 24
n1 − 1 i=1 n1 12 − 1 i=1 12
"n
2
Pn2 2
# " 9 P9 2 #
1 X ( y
i=1 i ) 1 X y
i=1 i
s22 = y2 − = y2 − = 101, 53
n2 − 1 i=1 i n2 9 − 1 i=1 i 9
(c) Para α = 5%, tv, α/2 = t16, 0,05/2 = t16, 0,025 = 2, 1199
5. Como, TA
|tcalc | = |5, 30| = 5, 30 > tv, α/2 = t16, 0,025 = 2, 1199
6. Logo, a decisão é rejeitar H0 , isto é, as médias populacionais são diferentes, com 5% de
risco de rejeitarmos uma hipótese verdadeira.
U
12.3 Teste para a variância populacional σ 2
IN
H0 : σ 2 = σ02
H1 pode ser formulada como:
H1 : σ 2 < σ02
H1 : σ 2 > σ02
H1 : σ 2 ̸= σ02
como a média µ conhecida, uma estimativa mais precisa para s2 utiliza µ no lugar de x,
sendo a estimativa de s2 obtida por:
Pn
2 (xi − µ)2
s = i=1
n
Estatı́stica 178
(c) Se χ2calc < χ2ϕ=n, 1−α/2 ou χ2calc > χ2ϕ=n, α/2 , rejeita-se H0 (bilateral)
(n − 1) · s2
χ2calc =
σ02
(c) Se χ2calc < χ2ϕ=(n−1), 1−α/2 ou χ2calc > χ2ϕ=(n−1), α/2 , rejeita-se H0 (bilateral)
Exemplo 12.3.1. P De uma população normal com média µ = 250, foi obtida uma amostra com 30
elementos sendo ni=1 (xi − µ)2 = 235.000. Ao nı́vel de 5% de significância é possı́vel afirmar
M
que a variância populacional é igual a 2.400. Essa afirmação corresponde a testar com 5% as
seguintes hipóteses:
(
H0 : σ 2 = 2.400
H1 : σ 2 ̸= 2.400
Solução
1. Calculo de s2 Pn
2 i=1 (xi − µ)2 235.000
s = = = 7.833, 33
n 30
2. A estatı́stica do teste é dada por:
n · s2 30 · 7.833, 33
χ2calc = 2
= = 97, 92
σ0 2.400
(a) Se χ2calc < χ2ϕ=(n−1), 1−α/2 ou χ2calc > χ2ϕ=(n−1), α/2 , rejeita-se H0 (bilateral)
4. Como,
χ2calc = 97, 92 > χ2ϕ=(n−1), α/2 = χ2ϕ=29, 0,025 = 45, 7223
5. Logo, a decisão é rejeitar H0 , isto é, a variância populacional é diferente de 2.400, com 5% de
risco de rejeitarmos uma hipótese verdadeira.
estatı́stica de teste deve ser calculada. Nesse caso a estatı́stica do teste é dada por:
s21
Fcalc =
s22
sendo que a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as expressões:
Pn1 2
Pn2
2 i=1 (xi − x) 2 (xi − x)2
s1 = e s2 = i=1
n1 − 1 n2 − 1
E as regras de decisão são:
3. Se Fcalc < F1−α/2, (n1 −1), (n2 −1) ou Fcalc > Fα/2, (n1 −1), (n2 −1) , rejeita-se H0
Estatı́stica 180
Exemplo 12.4.1. São obtidas amostras de duas populações possuem com número de elementos
n1 = 12 e n2 = 26. As variâncias calculadas em para as amostras foram s21 = 4, 55 e s22 =
15, 6. Ao nı́vel de 5% de significância é possı́vel afirmar que as populações possuem as mesmas
variâncias. Essa afirmação é equivalente a testar com 5% de significância as seguintes hipótese:
(
H0 : σ12 = 4, 55 = 15, 6 = σ22
H1 : σ12 = 4, 55 ̸= 15, 6 = σ22
Solução
s21
Fcalc = 2
s2
s22
TA 15, 6
Fcalc = 2
= ≈ 3, 65
s1 4, 55
4. Como Fα, (n1 −1), (n2 −1) = F0,05, (12−1), (26−1) = F0,05, 11, 25 = 2, 198
5. Logo,
M
6. Logo, a decisão é rejeitar H0 , isto é, as variâncias populacionais são diferentes, com 5% de
risco de rejeitarmos uma hipótese verdadeira.
H0 : p = p0
H1 pode ser formulada como:
H1 : p < p0
H1 : p > p0
H1 : p ̸= p0
Exemplo 12.5.1.
para estimar o erro experimental (obtido pelo desvio padrão dos resı́duos) é o maior possı́vel. Nesse
tipo de delineamento as principais desvantagens são: exigência da homogeneidade das condições
experimentais; a estimativa para a variância dos resı́duos pode ser alta, já que todas as variações
das unidades experimentais são consideradas como variação aleatória. A Tabela 12.5 apresenta a
organização dos dados para um DIC, com I tratamentos e J repetições.
X
yi = =
j=1
J J
I X J
X yij
y=
i=1 j=1
I ·J
em que:
• yij é o valor observado para a variável resposta obtido para o i-ésimo tratamento na j-ésima
repetição.
médias dos tratamentos em relação a média geral, ea soma dos qudrados dos resı́duos (SQR ) é a
soma dos quadrados dos desvios dos valores estimados pelo modelo e observados. As somas de
quadrados SQT , SQT rat e SQR são dadas por:
M
I X
J I X
J PI PJ
X
2
X ( i=1 j=1 yij )2
SQT = (yij − y) = yij2 −
i=1 j=1 i=1 j=1
I ·J
I X
J PI PJ
yij )2
PI 2
X
i=1 Ti
( i=1 j=1
SQT rat = J · (y i − y)2 = −
i=1 j=1
J I ·J
X J
I X I X
X J
SQR = ϵ2ij = (yij − y − τbi )2
i=1 j=1 i=1 j=1
I X
X J
= (yij − y − (y i − y))2
i=1 j=1
I X
X J
= (yij − y i )2
i=1 j=1
A soma de quadrado dos resı́duos SQR pode ser obtida das somas de quadrados SQT , SQT rat
e SQR por meio da relação:
Estatı́stica 184
2. Independência, os erros ϵij devem ser aleatórios e independentes, o que indica que os efeitos
dos tratamentos sejam também independnetes.
3. normalidade, os erros ϵij devem ser possuir uma distribuição normal de probabilidade, ou
seja, ϵij ∼N (0, σ 2 ) =⇒ yij ∼N (µi , σ 2 )
12.6.2 Teste F
Com a soma os quadrados é possı́vel construir a Tabela de Análise de Variância (ANOVA) para
TA
o DIC e utilizar o teste F sobre as hipóteses enunciadas. A Tabela ANOVA é apresentada a seguir:
Total IJ − 1 SQT
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.
O valor de Fcalc obtido na Tabela 12.6 é utilizado para realizar o seguinte teste de hipóteses H0
de 12.2 (ou 12.3).
A rejeição da hipótese nula H0 significa afirmar que pelo menos um tratamento teve efeito
sobre a variável em estudo (ou pelo menos um par de médias são diferentes), com um certo nı́vel
de significância α%.
A regra de decisão requer a obtenção do Fcrı́tico = FI−1, I(J−1), α% que é obtido da tabela F,
com nı́vel α de probabilidade, I − 1 graus de liberdade do numerador e I(J − 1) graus de liberdade
do denominador:
Se Fcalc < Fcrı́tico =⇒ Não rejeita H0
Se Fcalc > Fcrı́tico =⇒ rejeita H0
Estatı́stica 185
Se Fcalc < Fcrı́tico é comum concluir que não há evidencias para rejeitar H0 . Uma medida
para avaliar
√ a precisão de experimentos é o coeficiente de variação (CV ) que pode ser obtido por
SQRM
CV = · 100, sendo que quanto menor o CV , mais preciso é o experimento.
y
Exemplo 12.6.1. Para verificar a influência de quatro tratamentos em uma certa variável foi
realizado um experimento em um área homogênea, cujos dados são apresentados na tabela a
seguir. Realizar o teste F .
Solução
U
1. Cálculo de SQT
I X
X J
SQT = (yij − y)2 = 48, 0
IN
i=1 j=1
I X
X J
SQT rat = J · (y i − y)2 = 33, 8
i=1 j=1
3. Cálculo de SQR
I X
X J I X
X J
SQR = ϵ2ij = (yij − y i )2 = 14, 2
i=1 j=1 i=1 j=1
4. Para a tabela de Análise de Variância também devemos calcular SQT ratM e SQR M da
seguinte forma:
SQT rat 33, 8 33, 8
SQT ratM = = = ≈ 11, 3
I −1 4−1 3
Resı́duos 16 14, 2 0, 9
Total 19 48, 0
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.
#Calculo SQT
SQT <- sum((dados - mean(dados))ˆ2)
#Calulo SQTrat
SQTrat <- length(T1)*(sum((mean(T1) - mean(dados))ˆ2)+
sum((mean(T2) - mean(dados))ˆ2) +
sum((mean(T3) - mean(dados))ˆ2) +
sum((mean(T4) - mean(dados))ˆ2))
#Claulo SQR
Estatı́stica 187
#Calculo do F_calc
F_calc <- SQTratM/SQRM
options(digits=3)
Fonte <- c("Tratamento", "Residuos", "Total")
I_Trat <- dim(dados)[1]
J_Rep <- dim(dados)[2]
GL <- c(I_Trat-1, I_Trat*(J_Rep-1), I_Trat*J_Rep-1)
SQ <- c(SQTrat, SQR, SQT)
SQM <- c(SQTratM, SQRM, NA)
F_calc <- c(F_calc, NA, NA)
TA
tab_anova <- [Link](Fonte, GL, SQ, SQM, F_calc)
tab_anova
U
## Fonte GL SQ SQM F_calc
IN
#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)
F_tab_5
## [1] 3.24
## [1] 2.46
Exemplo 12.6.3. Para verificar a influência de quatro tratamentos em uma certa variável foi
realizado um experimento em um área homogênea, cujos dados são apresentados na tabela a
seguir. Realizar o teste F .
1. Cálculo de SQT
I X
X J
SQT = (yij − y)2 = 275, 75
i=1 j=1
M
3. Cálculo de SQR
I X
X J I X
X J
SQR = ϵ2ij = (yij − y i )2 = 112, 00
i=1 j=1 i=1 j=1
4. Para a tabela de Análise de Variância também devemos calcular SQT ratM e SQR M da
seguinte forma:
SQT rat 163, 75 163, 75
SQT ratM = = = ≈ 54, 58
I −1 4−1 3
Resı́duos 16 112, 00 7, 00
Total 19 275, 75
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.
TA
7. A regra de decisão é se Fcalc > Fcrı́tico se rejeita H0 . O Fcrı́tico para 5% de significância é
U
Fcrı́tico = FI−1, I(J−1), α% = F3, 16, 5% = 3, 49
ou seja pelo menos duas médias são diferentes, ou pelo menos um tratamento tem efeito na
variável em estudo.
M
#Calculo SQT
SQT <- sum((dados - mean(dados))ˆ2)
#Calulo SQTrat
SQTrat <- length(T1)*(sum((mean(T1) - mean(dados))ˆ2)+
sum((mean(T2) - mean(dados))ˆ2) +
Estatı́stica 190
sum((mean(T3) - mean(dados))ˆ2) +
sum((mean(T4) - mean(dados))ˆ2))
#Claulo SQR
SQR <- SQR <- SQT - SQTrat
#Calculo do F_calc
F_calc <- SQTratM/SQRM
options(digits=3)
Fonte <- c("Tratamento", "Residuos", "Total")
I_Trat <- dim(dados)[1]
J_Rep <- dim(dados)[2]
TA
GL <- c(I_Trat-1, I_Trat*(J_Rep-1), I_Trat*J_Rep-1)
SQ <- c(SQTrat, SQR, SQT)
SQM <- c(SQTratM, SQRM, NA)
U
F_calc <- c(F_calc, NA, NA)
IN
#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)
F_tab_5
## [1] 3.24
## [1] 2.46
Estatı́stica 191
H1 : mu ̸= mv , u ̸= v
ou, alternativamente como:
M
(
H0 : mu − mv = 0, u ̸= v
(12.5)
H1 : mu − mv ̸= 0, u ̸= v
Para realizar o teste de Tukey, basta seguir o procedimento a seguir:
1. Calcular o valor absoluto da diferença entre as médias (duas a duas), ou seja, para os trata-
mentos u e v com u ̸= v calcular
|m
bu − m b v|
Exemplo 12.7.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo, pelo
menos duas médias são diferentes. Realizar o teste de Tukey para comparar as múltiplas médias.
Solução
U
1. Calcular o valor absoluto da diferença entre as médias (duas a duas):
IN
|m
b1 − m
b 2 | = |2, 6 − 5, 7| = 3, 1
|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
M
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
3. A Regra de Decisão diz que as médias de dois tratamentos são estatisticamente diferentes
(ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms
4. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
U
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.
IN
1 5,7 a
2 3,1 b
3 2,6 a
4 2,4 a
Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.
3. Regra de Decisão: As médias dos tratamentos u e v são estatisticamente diferentes (ou há
uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms
Solução
|m
b1 − m
b 2 | = |2, 6 − 5, 7| = 3, 1
|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
Estatı́stica 195
|m
b1 − m
b 2| |2, 6 − 5, 7| = 3, 1 > 1, 27∗
|m
b1 − m
b 3| |2, 6 − 3, 1| = 0, 5 < 1, 27 ns
M
|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 27 ns
|m
b2 − m
b 3| |5, 7 − 3, 1| = 2, 6 > 1, 27∗
|m
b2 − m
b 4| |5, 7 − 2, 4| = 3, 3 > 1, 27∗
|m
b3 − m
b 4| |3, 1 − 2, 4| = 0, 7 < 1, 27 ns
A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.
Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.
|m
bu − m
b v | ≥ dms
5. A comparação é inicida pelo maior intervalo de médias dos I tratamentos (maior diferença
M
Solução
m
b 2 = 5, 7
m
b 3 = 3, 1
m
b 1 = 2, 6
m
b 4 = 2, 4
2. Calcular o valor absoluto da diferença entre as médias (duas a duas), e ordenar da maior
diferença para a menor:
|m
b2 − mb 4 | = |5, 7 − 2, 4| = 3, 3
|m
b2 − m
b 1 | = |2, 6 − 5, 7| = 3, 1
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
TA
|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
U
3. Calcular a Diferença Mı́nima Significativa (dms), dada por:
IN
r
SQRM
dms4 = Zα, mI , I(J−1)
r J
0, 9
= Z5%, 4, 4(5−1)
5
r
0, 9
= Z5%, 4, 16
5
r
0, 9
= 3, 23 ≈ 1, 37
5
r
0, 9
= 2, 99 ≈ 1, 27
5
M
sendo Zα, mI , I(J−1) o valor obtido da tabela para o teste de Duncan com nı́vel α de proba-
bilidade, mI número de médias abrangidas pela diferença de média considerada e I(J − 1)
graus de liberdade.
4. A Regra de Decisão diz que as médias de dois tratamentos são estatisticamente diferentes
(ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms
5. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
Estatı́stica 199
A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.
Tratamentos
TA
Tabela 12.19: Teste de Duncan - Utilizando Letras
Médias
1 5,7 a
U
2 3,1 b
3 2,6 a
IN
4 2,4 a
M
Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.
1. Calcular o valor absoluto da diferença entre as médias u com a média do controle, ou seja,
|m
bu − m
b controle |
|m
bu − m
b controle | ≥ dms
Exemplo 12.10.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo,
TA
pelo menos duas médias são diferentes. Realizar o teste de Dunnett para comparar as múltiplas
médias, considerando o tratamento 4 como controle..
U
Tabela 12.20: Dados de um DIC com 4 tratamentos e 5 repetições
Tratamentos Repetições/Observações Totais Médias
IN
1 2 3 4 5
1 2,9 2,2 3,8 2,0 2,1 13,0 2,6
M
Solução
1. Calcular o valor absoluto da diferença entre as médias dos tratamentos com a média do
tratameno controle (m4 = mcontrole = mcon ).
|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
2. Calcular a Diferença Mı́nima Significativa (dms), que nos caso de dados balanceados (mesmo
número de repetições nos tratamentos), é dada por:
Estatı́stica 201
r
2 · SQRM
dms = tα, I−1, I(J−1)
r J
2 · 0, 9
= tα, 4−1, 4(5−1)
5
r
2 · 0, 9
= tα, 3, 16
5
r
1, 8
= 2, 42 ≈ 1, 45
5
sendo tα, I−1, I(J−1) o valor obtido da tabela para o teste de Dunnett com nı́vel α de proba-
bilidade, I − 1 número de médias de tratamentos e I(J − 1) graus de liberdade.
3. A Regra de Decisão diz que as médias de um tratamento com o controle são estatisticamente
diferentes (ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
TAb controle | ≥ dms
4. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
U
Tabela 12.21: Compração de múltiplas médias - Teste de Dunnett
IN
|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 45 = dms ns
A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.
Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.
Estatı́stica 202
13 Tabelas de Distribuições
Tabela da distribuição Normal Padronizada - N (0, 1)
0 𝑍𝛼 𝑍
Z 0,00 0,01 0,02 0,03 0,04 0,05 0,06 0,07 0,08 0,09 Z
0,00 0,000000 0,003989 0,007978 0,011967 0,015953 0,019939 0,023922 0,027903 0,031881 0,035856 0,00
0,10 0,039828 0,043795 0,047758 0,051717 0,055670 0,059618 0,063559 0,067495 0,071424 0,075345 0,10
0,20 0,079260 0,083166 0,087064 0,090954 0,094835 0,098706 0,102568 0,106420 0,110261 0,114092 0,20
0,30 0,117911 0,121719 0,125516 0,129300 0,133072 0,136831 0,140576 0,144309 0,148027 0,151732 0,30
0,40 0,155422 0,159097 0,162757 0,166402 0,170031 0,173645 0,177242 0,180822 0,184386 0,187933 0,40
0,50 0,191462 0,194974 0,198468 0,201944 0,205402 0,208840 0,212260 0,215661 0,219043 0,222405 0,50
0,60 0,225747 0,229069 0,232371 0,235653 0,238914 0,242154 0,245373 0,248571 0,251748 0,254903 0,60
0,70 0,258036 0,261148 0,264238 0,267305 0,270350
TA 0,273373 0,276373 0,279350 0,282305 0,285236 0,70
0,80 0,288145 0,291030 0,293892 0,296731 0,299546 0,302338 0,305106 0,307850 0,310570 0,313267 0,80
0,90 0,315940 0,318589 0,321214 0,323814 0,326391 0,328944 0,331472 0,333977 0,336457 0,338910 0,90
1,00 0,341345 0,343752 0,346136 0,348495 0,350830 0,353145 0,355428 0,357690 0,359929 0,362146 1,00
1,10 0,364334 0,366500 0,368643 0,370762 0,372857 0,374928 0,376976 0,378999 0,381000 0,382977 1,10
U
1,20 0,384930 0,386860 0,388767 0,390651 0,392512 0,394350 0,396165 0,397958 0,399727 0,401475 1,20
1,30 0,403199 0,404902 0,406582 0,408241 0,409877 0,411492 0,413085 0,414656 0,416207 0,417736 1,30
1,40 0,419243 0,420730 0,422196 0,423641 0,425066 0,426471 0,427855 0,429219 0,430563 0,431888 1,40
IN
1,50 0,433193 0,434478 0,435744 0,436992 0,438220 0,439429 0,440620 0,441792 0,442947 0,444083 1,50
1,60 0,445201 0,446301 0,447384 0,448449 0,449497 0,450529 0,451543 0,452540 0,453521 0,454486 1,60
1,70 0,455435 0,456367 0,457284 0,458185 0,459071 0,459941 0,460796 0,461636 0,462462 0,463273 1,70
M
1,80 0,464070 0,464852 0,465621 0,466375 0,467116 0,467843 0,468557 0,469258 0,469946 0,470621 1,80
1,90 0,471284 0,471933 0,472571 0,473197 0,473810 0,474412 0,475002 0,475581 0,476148 0,476705 1,90
2,00 0,477250 0,477784 0,478308 0,478822 0,479325 0,479818 0,480301 0,480774 0,481237 0,481691 2,00
2,10 0,482136 0,482571 0,482997 0,483414 0,483823 0,484222 0,484614 0,484997 0,485371 0,485738 2,10
2,20 0,486097 0,486447 0,486791 0,487126 0,487455 0,487776 0,488089 0,488396 0,488696 0,488989 2,20
2,30 0,489276 0,489556 0,489830 0,490097 0,490358 0,490613 0,490863 0,491106 0,491344 0,491576 2,30
2,40 0,491802 0,492024 0,492240 0,492451 0,492656 0,492857 0,493053 0,493244 0,493431 0,493613 2,40
2,50 0,493790 0,493963 0,494132 0,494297 0,494457 0,494614 0,494766 0,494915 0,495060 0,495201 2,50
2,60 0,495339 0,495473 0,495603 0,495731 0,495855 0,495975 0,496093 0,496207 0,496319 0,496427 2,60
2,70 0,496533 0,496636 0,496736 0,496833 0,496928 0,497020 0,497110 0,497197 0,497282 0,497365 2,70
2,80 0,497445 0,497523 0,497599 0,497673 0,497744 0,497814 0,497882 0,497948 0,498012 0,498074 2,80
2,90 0,498134 0,498193 0,498250 0,498305 0,498359 0,498411 0,498462 0,498511 0,498559 0,498605 2,90
3,00 0,498650 0,498694 0,498736 0,498777 0,498817 0,498856 0,498893 0,498930 0,498965 0,498999 3,00
3,10 0,499032 0,499064 0,499096 0,499126 0,499155 0,499184 0,499211 0,499238 0,499264 0,499289 3,10
3,20 0,499313 0,499336 0,499359 0,499381 0,499402 0,49S423 0,499443 0,499462 0,499481 0,499499 3,20
3,30 0,499517 0,499533 0,499550 0,499566 0,499581 0,499596 0,499610 0,499624 0,499638 0,499650 3,30
3,40 0,499663 0,499675 0,499687 0,499698 0,499709 0,499720 0,499730 0,499740 0,499749 0,499758 3,40
3,50 0,499767 0,499776 0,499784 0,499792 0,499800 0,499807 0,499815 0,499821 0,499828 0,499835 3,50
3,60 0,499841 0,499847 0,499853 0,499858 0,499864 0,499869 0,499874 0,499879 0,499883 0,499888 3,60
3,70 0,499892 0,499896 0,499900 0,499904 0,499908 0,499912 0,499915 0,499918 0,499922 0,499925 3,70
3,80 0,499928 0,499930 0,499933 0,499936 0,499938 0,499941 0,499943 0,499946 0,499948 0,499950 3,80
3,90 0,499952 0,499954 0,499956 0.499958 0,499959 0,499961 0,499963 0,499964 0,499966 0,499967 3,90
4,00 0,499968 0,499970 0,499971 0,499972 0,499973 0,499974 0,499975 0,499976 0,499977 0,499978 4,00
Estatı́stica 203
𝑃ሺ𝑡 > 𝑡𝛼 ሻ = 𝛼
0 𝑡𝛼 𝑡
𝛼
0 𝜒𝛼2 𝜒2
ϕ/α 0,995 0,99 0,975 0,95 0,9 0,8 0,75 0,25 0,2 0,1 0,05 0,025 0,01 0,005 ϕ/α
1 0,0000 0,0002 0,0010 0,0039 0,0158 0,0642 0,1015 1,3233 1,6424 2,7055 3,8415 5,0239 6,6349 7,8794 1
2 0,0100 0,0201 0,0506 0,1026 0,2107 0,4463 0,5754 2,7726 3,2189 4,6052 5,9915 7,3778 9,2104 10,5965
3 0,0717 0,1148 0,2158 0,3518 0,5844 1,0052 1,2125 4,1083 4,6416 6,2514 7,8147 9,3484 11,3449 12,8381 3
4 0,2070 0,2971 0,4844 0,7107 1,0636 1,6488 1,9226 5,3853 5,9886 7,7794 9,4877 11,1433 13,2767 14,8602 4
5
6
0,4118
0,6757
0,5543
0,8721
0,8312
1,2373
1,1455
1,6354
1,6103
2,2041
2,3425
3,0701
TA
2,6746
3,4546
6,6257
7,8408
7,2893 9,2363 11,0705 12,8325 15,0863 16,7496
8,5581 10,6446 12,5916 14,4494 16,8119 18,5475
5
6
7 0,9893 1,2390 1,6899 2,1673 2,8331 3,8223 4,2549 9,0371 9,8032 12,0170 14,0671 16,0128 18,4753 20,2777 7
8 1,3444 1,6465 2,1797 2,7326 3,4895 4,5936 5,0706 10,2189 11,0301 13,3616 15,5073 17,5345 20,0902 21,9549 8
U
9 1,7349 2,0879 2,7004 3,3251 4,1682 5,3801 5,8988 11,3887 12,2421 14,6837 16,9190 19,0228 21,6660 23,5893 9
10 2,1558 2,5582 3,2470 3,9403 4,8652 6,1791 6,7372 12,5489 13,4420 15,9872 18,3070 20,4832 23,2093 25,1881 10
IN
11 2,6032 3,0535 3,8157 4,5748 5,5778 6,9887 7,5841 13,7007 14,6314 17,2750 19,6752 21,9200 24,7250 26,7569 11
12 3,0738 3,5706 4,4038 5,2260 6,3038 7,8073 8,4384 14,8454 15,8120 18,5493 21,0261 23,3367 26,2170 28,2997 12
13 3,5650 4,1069 5,0087 5,8919 7,0415 8,6339 9,2991 15,9839 16,9848 19,8119 22,3620 24,7356 27,6882 29,8193 13
14 4,0747 4,6604 5,6287 6,5706 7,7895 9,4673 10,1653 17,1169 18,1508 21,0641 23,6848 26,1189 29,1412 31,3194 14
M
15 4,6009 5,2294 6,2621 7,2609 8,5468 10,3070 11,0365 18,2451 19,3107 22,3071 24,9958 27,4884 30,5780 32,8015 15
16 5,1422 5,8122 6,9077 7,9616 9,3122 11,1521 11,9122 19,3689 20,4651 23,5418 26,2962 28,8453 31,9999 34,2671 16
17 5,6973 6,4077 7,5642 8,6718 10,0852 12,0023 12,7919 20,4887 21,6146 24,7690 27,5871 30,1910 33,4087 35,7184 17
18 6,2648 7,0149 8,2307 9,3904 10,8649 12,8570 13,6753 21,6049 22,7595 25,9894 28,8693 31,5264 34,8052 37,1564 18
19 6,8439 7,6327 8,9065 10,1170 11,6509 13,7158 14,5620 22,7178 23,9004 27,2036 30,1435 32,8523 36,1908 38,5821 19
20 7,4338 8,2604 9,5908 10,8508 12,4426 14,5784 15,4518 23,8277 25,0375 28,4120 31,4104 34,1696 37,5663 39,9969 20
21 8,0336 8,8972 10,2829 11,5913 13,2396 15,4446 16,3444 24,9348 26,1711 29,6151 32,6706 35,4789 38,9322 41,4009 21
22 8,6427 9,5425 10,9823 12,3380 14,0415 16,3140 17,2396 26,0393 27,3015 30,8133 33,9245 36,7807 40,2894 42,7957 22
23 9,2604 10,1957 11,6885 13,0905 14,8480 17,1865 18,1373 27,1413 28,4288 32,0069 35,1725 38,0756 41,6383 44,1814 23
24 9,8862 10,8563 12,4011 13,8484 15,6587 18,0618 19,0373 28,2412 29,5533 33,1962 36,4150 39,3641 42,9798 45,5584 24
25 10,5196 11,5240 13,1197 14,6114 16,4734 18,9397 19,9393 29,3388 30,6752 34,3816 37,6525 40,6465 44,3140 46,9280 25
26 11,1602 12,1982 13,8439 15,3792 17,2919 19,8202 20,8434 30,4346 31,7946 35,5632 38,8851 41,9231 45,6416 48,2898 26
27 11,8077 12,8785 14,5734 16,1514 18,1139 20,7030 21,7494 31,5284 32,9117 36,7412 40,1133 43,1945 46,9628 49,6450 27
28 12,4613 13,5647 15,3079 16,9279 18,9392 21,5880 22,6572 32,6205 34,0266 37,9159 41,3372 44,4608 48,2782 50,9936 28
29 13,1211 14,2564 16,0471 17,7084 19,7677 22,4751 23,5666 33,7109 35,1394 39,0875 42,5569 45,7223 49,5878 52,3355 29
30 13,7867 14,9535 16,7908 18,4927 20,5992 23,3641 24,4776 34,7997 36,2502 40,2560 43,7730 46,9792 50,8922 53,6719 30
35 17,1917 18,5089 20,5694 22,4650 24,7966 27,8359 29,0540 40,2228 41,7780 46,0588 49,8018 53,2033 57,3420 60,2746 35
40 20,7066 22,1642 24,4331 26,5093 29,0505 32,3449 33,6603 45,6160 47,2685 51,8050 55,7585 59,3417 63,6908 66,7660 40
Estatı́stica 205
1%
0 𝐹𝛼 𝐹
D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 4052,18 4999,34 5403,53 5624,26 5763,96 5858,95 5928,33 5980,95 6022,40 6055,93 6083,40 6106,68 6125,77 1
2 98,5019 99,0003 99,1640 99,2513 99,3023 99,3314 99,3568 99,3750 99,3896 99,3969 99,4078 99,4187 99,4223 2
3 34,1161 30,8164 29,4567 28,7100 28,2371 27,9106 27,6714 27,4895 27,3449 27,2285 27,1320 27,0520 26,9829 3
4 21,1976 17,9998 16,6942 15,9771 15,5219 15,2068 14,9757 14,7988 14,6592 14,5460 14,4523 14,3737 14,3064 4
5 16,2581 13,2741 12,0599 11,3919 10,9671 10,6722 10,4556 10,2893 10,1577 10,0511 9,9626
TA 9,8883 9,8248 5
6 13,7452 10,9249 9,7796 9,1484 8,7459 8,4660 8,2600 8,1017 7,9760 7,8742 7,7896 7,7183 7,6575 6
7 12,2463 9,5465 8,4513 7,8467 7,4604 7,1914 6,9929 6,8401 6,7188 6,6201 6,5381 6,4691 6,4100 7
8 11,2586 8,6491 7,5910 7,0061 6,6318 6,3707 6,1776 6,0288 5,9106 5,8143 5,7343 5,6667 5,6089 8
9 10,5615 8,0215 6,9920 6,4221 6,0569 5,8018 5,6128 5,4671 5,3511 5,2565 5,1779 5,1115 5,0545 9
U
10 10,0442 7,5595 6,5523 5,9944 5,6364 5,3858 5,2001 5,0567 4,9424 4,8491 4,7716 4,7058 4,6496 10
11 9,6461 7,2057 6,2167 5,6683 5,3160 5,0692 4,8860 4,7445 4,6315 4,5393 4,4624 4,3974 4,3416 11
IN
12 9,3303 6,9266 5,9525 5,4119 5,0644 4,8205 4,6395 4,4994 4,3875 4,2961 4,2198 4,1553 4,0998 12
13 9,0738 6,7009 5,7394 5,2053 4,8616 4,6203 4,4410 4,3021 4,1911 4,1003 4,0245 3,9603 3,9052 13
14 8,8617 6,5149 5,5639 5,0354 4,6950 4,4558 4,2779 4,1400 4,0297 3,9394 3,8640 3,8002 3,7452 14
M
15 8,6832 6,3588 5,4170 4,8932 4,5556 4,3183 4,1416 4,0044 3,8948 3,8049 3,7299 3,6662 3,6115 15
16 8,5309 6,2263 5,2922 4,7726 4,4374 4,2016 4,0259 3,8896 3,7804 3,6909 3,6162 3,5527 3,4981 16
17 8,3998 6,1121 5,1850 4,6689 4,3360 4,1015 3,9267 3,7909 3,6823 3,5931 3,5185 3,4552 3,4007 17
18 8,2855 6,0129 5,0919 4,5790 4,2479 4,0146 3,8406 3,7054 3,5971 3,5081 3,4338 3,3706 3,3162 18
19 8,1850 5,9259 5,0103 4,5002 4,1708 3,9386 3,7653 3,6305 3,5225 3,4338 3,3596 3,2965 3,2422 19
20 8,0960 5,8490 4,9382 4,4307 4,1027 3,8714 3,6987 3,5644 3,4567 3,3682 3,2941 3,2311 3,1769 20
21 8,0166 5,7804 4,8740 4,3688 4,0421 3,8117 3,6396 3,5056 3,3982 3,3098 3,2359 3,1729 3,1115 21
22 7,9453 5,7190 4,8166 4,3134 3,9880 3,7583 3,5866 3,4530 3,3458 3,2576 3,1837 3,1209 3,0667 22
23 7,8811 5,6637 4,7648 4,2635 3,9392 3,7102 3,5390 3,4057 3,2986 3,2106 3,1368 3,0740 3,0199 23
24 7,8229 5,6136 4,7181 4,2185 3,8951 3,6667 3,4959 3,3629 3,2560 3,1681 3,0944 3,0316 2,9775 24
25 7,7698 5,5680 4,6755 4,1774 3,8550 3,6272 3,4568 3,3239 3,2172 3,1294 3,0558 2,9931 2,9389 25
26 7,7213 5,5263 4,6365 4,1400 3,8183 3,5911 3,4210 3,2884 3,1818 3,0941 3,0205 2,9578 2,9038 26
27 7,6767 5,4881 4,6009 4,1056 3,7847 3,5580 3,3882 3,2558 3,1494 3,0618 2,9882 2,9256 2,8715 27
28 7,6357 5,4529 4,5681 4,0740 3,7539 3,5276 3,3581 3,2259 3,1195 3,0320 2,9585 2,8959 2,8418 28
29 7,5977 5,4205 4,5378 4,0449 3,7254 3,4995 3,3303 3,1982 3,0920 3,0045 2,9311 2,8685 2,8144 29
30 7,5624 5,3903 4,5097 4,0179 3,6990 3,4735 3,3045 3,1726 3,0665 2,9791 2,9057 2,8431 2,7890 30
40 7,3142 5,1785 4,3126 3,8283 3,5138 3,2910 3,1238 2,9930 2,8876 2,8005 2,7273 2,6648 2,6107 40
50 7,1706 5,0566 4,1994 3,7195 3,4077 3,1864 3,0202 2,8900 2,7850 2,6981 2,6250 2,5625 2,5083 50
100 6,8953 4,8239 3,9837 3,5127 3,2059 2,9877 2,8233 2,6943 2,5898 2,1793 2,4302 2,3676 2,3132 100
Estatı́stica 206
1%
0 𝐹𝛼 𝐹
12 4,0517 4,0096 3,9724 3,9392 3,9095 3,8827 3,8584 3,7647 3,7008 3,6192 3,5692 3,4668 12
13 3,8573 3,8154 3,7783 3,7452 3,7156 3,6889 3,6646 3,5710 3,5070 3,4253 3,3752 3,2723 13
14 3,6976 3,6557 3,6187 3,5857 3,5561 3,5294 3,5052 3,4116 3,3476 3,2657 3,2153 3,1118 14
M
15 3,5639 3,5222 3,4852 3,4523 3,4228 3,3961 3,3719 3,2782 3,2141 3,1319 3,0814 2,9772 15
18 3,4506 3,4090 3,3721 3,3392 3,3096 3,2829 3,2587 3,1650 3,1007 3,0182 2,9675 2,8627 16
17 3,3533 3,3117 3,2748 3,2419 3,2124 3,1857 3,1615 3,0676 3,0032 2,9204 2,8694 2,7639 17
18 3,2689 3,2273 3,1905 3,1575 3,1280 3,1013 3,0771 2,9831 2,9185 2,8354 2,7841 2,6779 18
19 3,1949 3,1533 3,1165 3,0836 3,0541 3,0274 3,0031 2,9089 2,8442 2,7608 2,7092 2,6023 19
20 3,1296 3,0880 3,0512 3,0183 2,9887 2,9620 2,9377 2,8434 2,7785 2,6947 2,6430 2,5353 20
21 3,0715 3,0300 2,9931 2,9602 2,9306 2,9038 2,8795 2,7850 2,7200 2,6359 2,5838 2,4755 21
22 3,0195 2,9779 2,9411 2,9082 2,8786 2,8518 2,8274 2,7328 2,6675 2,5831 2,5308 2,4218 22
23 2,9727 2,9311 2,8942 2,8613 2,8317 2,8049 2,7805 2,6857 2,6202 2,5355 2,4829 2,3732 23
24 2,9303 2,8887 2,8519 2,8189 2,7892 2,7624 2,7380 2,6430 2,5773 2,4923 2,4395 2,3291 24
25 2,8917 2,8502 2,8133 2,7803 2,7506 2,7238 2,6993 2,6041 2,5383 2,4530 2,3999 2,2888 25
26 2,8566 2,8150 2,7781 2,7451 2,7154 2,6885 2,6640 2,5686 2,5026 2,4170 2,3637 2,2519 26
27 2,8243 2,7827 2,7458 2,7127 2,6830 2,6561 2,6316 2,5360 2,4699 2,3840 2,3304 2,2180 27
28 2,7946 2,7530 2,7160 2,6830 2,6532 2,6263 2,6018 2,5060 2,4397 2,3535 2,2997 2,1867 28
29 2,7672 2,7256 2,6886 2,6555 2,6257 2,5987 2,5742 2,4783 2,4118 2,3253 2,2713 2,1577 29
30 2,7418 2,7002 2,6632 2,6301 2,6002 2,5732 2,5487 2,4526 2,3860 2,2992 2,2450 2,1307 30
40 2,5634 2,5216 2,4844 2,4511 2,4210 2,3937 2,3689 2,2714 2,2034 2,1142 2,0581 1,9383 40
50 2,4609 2,4190 2,3816 2,3481 2,3178 2,2903 2,2652 2,1667 2,0976 2,0066 1,9490 1,8248 50
100 2,2654 2,2230 2,1852 2,1511 2,1203 2,0923 2,0666 1,9651 1,8933 1,7972 1,7353 1,5977 100
Estatı́stica 207
2,5%
0 𝐹𝛼 𝐹
D/N 1 2 3 4 5 6 7 -8 9 10 11 12 13 N/D
1 647,79 799,48 864,15 899,60 921,83 937,11 948,20 956,64 963,28 968,63 973,03 976,72 979,84 1
2 38,5062 39,0000 39,1656 39,2483 39,2984 39,3311 39,3557 39,3729 39,3866 39,3984 39,4066 39,4148 39,4211 2
3 17,4434 16,0442 15,4391 15,1010 14,8848 14,7347 14,6244 14,5399 14,4730 14,4189 14,3741 14,3366 14,3045 3
4 12,2179 10,6490 9,9792 9,6045 9,3645 9,1973 9,0741 8,9796 8,9046 8,8439 8,7936 8,7512 8,7150 4
5 10,0069 8,4336 7,7636 7,3879 7,1464 6,9777TA 6,8530 6,7572 6,6810 6,6192 6,5678 6,5245 6,4876 5
6 8,8131 7,2599 6,5988 6,2271 5,9875 5,8197 5,6955 5,5996 5,5234 5,4613 5,4098 5,3662 5,3290 6
7 8,0727 6,5415 5,8898 5,5226 5,2852 5,1186 4,9949 4,8993 4,8232 4,7611 4,7095 4,6658 4,6285 7
8 7,5709 6,0595 5,4160 5,0526 4,8173 4,6517 4,5285 4,4333 4,3572 4,2951 4,2434 4,1997 4,1622 8
9 7,2093 5,7147 5,0781 4,7181 4,4844 4,3197 4,1970 4,1020 4,0260 3,9639 3,9121 3,8682 3,8306 9
U
10 6,9367 5,4564 4,8256 4,4683 4,2361 4,0721 3,9498 3,8549 3,7790 3,7168 3,6649 3,6210 3,5832 10
11 6,7241 5,2559 4,6300 4,2751 4,0440 3,8806 3,7586 3,6638 3,5879 3,5257 3,4737 3,4296 3,3917 11
IN
12 6,5538 5,0959 4,4742 4,1212 3,8911 3,7283 3,6065 3,5118 3,4358 3,3735 3,3215 3,2773 3,2393 12
13 6,4143 4,9653 4,3472 3,9959 3,7667 3,6043 3,4827 3,3880 3,3120 3,2497 3,1975 3,1532 3,1150 13
14 6,2979 4,8567 4,2417 3,8919 3,6634 3,5014 3,3799 3,2853 3,2093 3,1469 3,0946 3,0502 3,0119 14
M
15 6,1995 4,7650 4,1528 3,8043 3,5764 3,4147 3,2934 3,1987 3,1227 3,0602 3,0078 2,9633 2,9249 15
16 6,1151 4,6867 4,0768 3,7294 3,5021 3,3406 3,2194 3,1248 3,0488 2,9862 2,9337 2,8891 2,8506 16
17 6,0420 4,6189 4,0112 3,6648 3,4379 3,2767 3,1556 3,0610 2,9849 2,9222 2,8696 2,8249 2,7863 17
18 5,9781 4,5597 3,9539 3,6083 3,3820 3,2209 3,0999 3,0053 2,9291 2,8664 2,8137 2,7689 2,7302 18
19 5,9216 4,5075 3,9034 3,5587 3,3327 3,1718 3,0509 2,9563 2,8801 2,8172 2,7645 2,7196 2,6808 19
20 5,8715 4,4612 3,8587 3,5147 3,2891 3,1283 3,0074 2,9128 2,8365 2,7737 2,7209 2,6758 2,6369 20
21 5,8266 4,4199 3,8188 3,4754 3,2501 3,0895 2,9686 2,8740 2,7977 2,7348 2,6819 2,6368 2,5978 21
22 5,7863 4,3828 3,7829 3,4401 3,2151 3,0546 2,9338 2,8392 2,7628 2,6998 2,6469 2,6017 2,5626 22
23 5,7498 4,3492 3,7505 3,4083 3,1835 3,0232 2,9023 2,8077 2,7313 2,6682 2,6152 2,5699 2,5308 23
24 5,7166 4,3187 3,7211 3,3794 3,1548 2,9946 2,8738 2,7791 2,7027 2,6396 2,5865 2,5411 2,5019 24
25 5,6864 4,2909 3,6943 3,3530 3,1287 2,9685 2,8478 2,7531 2,6766 2,6135 2,5603 2,5149 2,4756 25
26 5,6586 4,2655 3,6697 3,3289 3,1048 2,9447 2,8240 2,7293 2,6528 2,5896 2,5363 2,4909 2,4515 26
27 5,6331 4,2421 3,6472 3,3067 3,0828 2,9228 2,8021 2,7074 2,6309 2,5676 2,5143 2,4688 2,4293 27
28 5,6096 4,2205 3,6264 3,2863 3,0626 2,9027 2,7820 2,6872 2,6106 2,5473 2,4940 2,4484 2,4089 28
29 5,5878 4,2006 3,6072 3,2674 3,0438 2,8840 2,7633 2,6686 2,5919 2,5286 2,4752 2,4295 2,3900 29
30 5,5675 4,1821 3,5893 3,2499 3,0265 2,8667 2,7460 2,6513 2,5746 2,5112 2,4578 2,4120 2,3727 30
40 5,4239 4,0510 3,4633 3,1261 2,9037 2,7444 2,6238 2,5289 2,4519 2,3882 2,3343 2,2882 2,2481 40
50 5,3403 3,9749 3,3902 3,0544 2,8326 2,6736 2,5530 2,4579 2,3808 2,3168 2,2627 2,2162 2,1758 50
100 5,1786 3,8284 3,2496 2,9166 2,6961 2,5374 2,4168 2,3215 2,2439 2,1793 2,1245 2,0773 2,0363 100
Estatı́stica 208
2,5%
0 𝐹𝛼 𝐹
12 3,2062 3,1772 3,1515 3,1286 3,1081 3,0896 3,0728 3,0077 2,9633 1,9861 2,8714 2,7996 12
13 3,0819 3,0527 3,0269 3,0039 2,9832 2,9646 2,9477 2,8821 2,8373 1,9315 2,7443 2,6715 13
14 2,9786 2,9493 2,9234 2,9003 2,8795 2,8607 2,8437 2,7777 2,7324 1,8852 2,6384 2,5646 14
M
15 2,8915 2,8621 2,8360 2,8128 2,7919 2,7730 2,7559 2,6894 2,6437 1,8454 2,5488 2,4739 15
16 2,8170 2,7875 2,7614 2,7380 2,7170 2,6980 2,6808 2,6138 2,5678 1,8108 2,4719 2,3961 16
17 2,7526 2,7230 2,6968 2,6733 2,6522 2,6331 2,6158 2,5484 2,5020 1,7805 2,4053 2,3285 17
18 2,6964 2,6667 2,6403 2,6168 2,5956 2,5764 2,5590 2,4912 2,4445 1,7537 2,3468 2,2692 18
19 2,6469 2,6171 2,5907 2,5670 2,5457 2,5264 2,5089 2,4408 2,3937 1,7298 2,2952 2,2167 19
20 2,6030 2,5731 2,5465 2,5228 2,5014 2,4821 2,4645 2,3959 2,3486 1,7083 2,2493 2,1699 20
21 2,5638 2,5338 2,5071 2,4833 2,4618 2,4424 2,4247 2,3558 2,3082 1,6890 2,2081 2,1280 21
22 2,5285 2,4984 2,4717 2,4478 2,4262 2,4067 2,3890 2,3198 2,2718 1,6714 2,1710 2,0901 22
23 2,4966 2,4665 2,4396 2,4156 2,3940 2,3745 2,3566 2,2871 2,2389 1,6554 2,1374 2,0556 23
24 2,4677 2,4374 2,4105 2,3865 2,3648 2,3452 2,3273 2,2574 2,2090 1,6407 2,1067 2,0243 24
25 2,4413 2,4110 2,3840 2,3599 2,3381 2,3184 2,3005 2,2303 2,1816 1,6272 2,0787 1,9955 25
26 2,4171 2,3867 2,3597 2,3355 2,3137 2,2939 2,2759 2,2054 2,1565 1,6147 2,0530 1,9691 26
27 2,3949 2,3644 2,3373 2,3131 2,2912 2,2713 2,2533 2,1826 2,1334 1,6032 2,0293 1,9447 27
28 2,3743 2,3438 2,3167 2,2924 2,2704 2,2505 2,2324 2,1614 2,1121 1,5925 2,0073 1,9221 28
29 2,3554 2,3248 2,2976 2,2732 2,2512 2,2313 2,2131 2,1419 2,0923 1,5825 1,9870 1,9011 29
30 2,3378 2,3072 2,2799 2,2554 2,2334 2,2134 2,1952 2,1237 2,0739 1,5732 1,9681 1,8816 30
40 2,2130 2,1819 2,1542 2,1293 2,1068 2,0864 2,0677 1,9943 1,9429 1,5056 1,8324 1,7405 40
50 2,1404 2,1090 2,0810 2,0558 2,0330 2,0122 1,9933 1,9186 1,8659 1,4648 1,7520 1,6558 50
100 2,0001 1,9679 1,9391 1,9132 1,8897 1,8682 1,8486 1,7705 1,7148 1,3817 1,5917 1,4833 100
Estatı́stica 209
5%
0 𝐹𝛼 𝐹
D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 161,4462 199,4995 215,7067 224,5833 230,1604 233,9875 236,7669 238,8842 240,5432 241,8819 242,9806 243,9047 244,6905 1
2 18,5128 19,0000 19,1642 19,2467 19,2963 19,3295 19,3531 19,3709 19,3847 19,3959 19,4050 19,4125 19,4188 2
3 10,1280 9,5521 9,2766 9,1172 9,0134 8,9407 8,8867 8,8452 8,8123 8,7855 8,7633 8,7447 8,7286 3
4 7,7086 6,9443 6,5914 6,3882 6,2561 6,1631 6,0942 6,0410 5,9988 5,9644 5,9358 5,9117 5,8911 4
5 6,6079 5,7861 5,4094 5,1922 5,0503 4,9503TA 4,8759 4,8183 4,7725 4,7351 4,7040 4,6777 4,6552 5
6 5,9874 5,1432 4,7571 4,5337 4,3874 4,2839 4,2067 4,1468 4,0990 4,0600 4,0274 3,9999 3,9764 6
7 5,5915 4,7374 4,3468 4,1203 3,9715 3,8660 3,7871 3,7257 3,6767 3,6365 3,6030 3,5747 3,5503 7
8 5,3176 4,4590 4,0662 3,8379 3,6875 3,5806 3,5005 3,4381 3,3881 3,3472 3,3129 3,2839 3,2590 8
9 5,1174 4,2565 3,8625 3,6331 3,4817 3,3738 3,2927 3,2296 3,1789 3,1373 3,1025 3,0729 3,0475 9
U
10 4,9646 4,1028 3,7083 3,4780 3,3258 3,2172 3,1355 3,0717 3,0204 2,9782 2,9430 2,9130 2,8872 10
11 4,8443 3,9823 3,5874 3,3567 3,2039 3,0946 3,0123 2,9480 2,8962 2,8536 2,8179 2,7876 2,7614 11
IN
12 4,7472 3,8853 3,4903 3,2592 3,1059 2,9961 2,9134 2,8486 2,7964 2,7534 2,7173 2,6866 2,6602 12
13 4,6672 3,8056 3,4105 3,1791 3,0254 2,9153 2,8321 2,7669 2,7144 2,6710 2,6346 2,6037 2,5769 13
14 4,6001 3,7389 3,3439 3,1122 2,9582 2,8477 2,7642 2,6987 2,6458 2,6022 2,5655 2,5342 2,5073 14
M
15 4,5431 3,6823 3,2874 3,0556 2,9013 2,7905 2,7066 2,6408 2,5876 2,5437 2,5068 2,4753 2,4481 15
16 4,4940 3,6337 3,2389 3,0069 2,8524 2,7413 2,6572 2,5911 2,5377 2,4935 2,4564 2,4247 2,3973 16
17 4,4513 3,5915 3,1968 2,9647 2,8100 2,6987 2,6143 2,5480 2,4943 2,4499 2,4126 2,3807 2,3531 17
18 4,4139 3,5546 3,1599 2,9277 2,7729 2,6613 2,5767 2,5102 2,4563 2,4117 2,3742 2,3421 2,3143 18
19 4,3808 3,5219 3,1274 2,8951 2,7401 2,6283 2,5435 2,4768 2,4227 2,3779 2,3402 2,3080 2,2800 19
20 4,3513 3,4928 3,0984 2,8661 2,7109 2,5990 2,5140 2,4471 2,3928 2,3479 2,3100 2,2776 2,2495 20
21 4,3248 3,4668 3,0725 2,8401 2,6848 2,5727 2,4876 2,4205 2,3661 2,3210 2,2829 2,2504 2,2222 21
22 4,3009 3,4434 3,0491 2,8167 2,6613 2,5491 2,4638 2,3965 2,3419 2,2967 2,2585 2,2258 2,1975 22
23 4,2793 3,4221 3,0280 2,7955 2,6400 2,5277 2,4422 2,3748 2,3201 2,2747 2,2364 2,2036 2,1752 23
24 4,2597 3,4028 3,0088 2,7763 2,6207 2,5082 2,4226 2,3551 2,3002 2,2547 2,2163 2,1834 2,1548 24
25 4,2417 3,3852 2,9912 2,7587 2,6030 2,4904 2,4047 2,3371 2,2821 2,2365 2,1979 2,1649 2,1362 25
26 4,2252 3,3690 2,9752 2,7426 2,5868 2,4741 2,3883 2,3205 2,2655 2,2197 2,1811 2,1479 2,1192 26
27 4,2100 3,3541 2,9603 2,7278 2,5719 2,4591 2,3732 2,3053 2,2501 2,2043 2,1655 2,1323 2,1034 27
28 4,1960 3,3404 2,9467 2,7141 2,5581 2,4453 2,3593 2,2913 2,2360 2,1900 2,1512 2,1179 2,0889 28
29 4,1830 3,3277 2,9340 2,7014 2,5454 2,4324 2,3463 2,2782 2,2229 2,1768 2,1379 2,1045 2,0755 29
30 4,1709 3,3158 2,9223 2,6896 2,5336 2,4205 2,3343 2,2662 2,2107 2,1646 2,1256 2,0921 2,0630 30
40 4,0847 3,2317 2,8387 2,6060 2,4495 2,3359 2,2490 2,1802 2,1240 2,0773 2,0376 2,0035 1,9738 40
50 4,0343 3,1826 2,7900 2,5572 2,4004 2,2864 2,1992 2,1299 2,0733 2,0261 1,9861 1,9515 1,9214 50
100 3,9362 3,0873 2,6955 2,4626 2,3053 2,1906 2,1025 2,0323 1,9748 1,9267 1,8857 1,8503 1,8193 100
Estatı́stica 210
5%
0 𝐹𝛼 𝐹
12 2,6371 2,6169 2,5989 2,5828 2,5684 2,5554 2,5436 2,4977 2,4663 2,4259 2,4010 2,3498 12
13 2,5536 2,5331 2,5149 2,4987 2,4841 2,4709 2,4589 2,4123 2,3803 2,3392 2,3138 2,2614 13
14 2,4837 2,4630 2,4446 2,4282 2,4134 2,4000 2,3879 2,3407 2,3082 2,2663 2,2405 2,1870 14
M
15 2,4244 2,4034 2,3849 2,3683 2,3533 2,3398 2,3275 2,2797 2,2468 2,2043 2,1780 2,1234 15
16 2,3733 2,3522 2,3335 2,3167 2,3016 2,2880 2,2756 2,2272 2,1938 2,1507 2,1240 2,0685 16
17 2,3290 2,3077 2,2888 2,2719 2,2567 2,2429 2,2304 2,1815 2,1477 2,1040 2,0769 2,0204 17
18 2,2900 2,2686 2,2496 2,2325 2,2172 2,2033 2,1906 2,1413 2,1071 2,0629 2,0354 1,9780 18
19 2,2556 2,2341 2,2149 2,1977 2,1823 2,1682 2,1555 2,1057 2,0712 2,0264 1,9986 1,9403 19
20 2,2250 2,2033 2,1840 2,1667 2,1511 2,1370 2,1242 2,0739 2,0391 1,9938 1,9656 1,9066 20
21 2,1975 2,1757 2,1563 2,1389 2,1232 2,1090 2,0960 2,0454 2,0102 1,9645 1,9360 1,8761 21
22 2,1727 2,1508 2,1313 2,1138 2,0980 2,0837 2,0707 2,0196 1,9842 1,9380 1,9092 1,8486 22
23 2,1502 2,1282 2,1086 2,0910 2,0751 2,0608 2,0476 1,9963 1,9605 1,9139 1,8848 1,8234 23
24 2,1298 2,1077 2,0880 2,0703 2,0543 2,0399 2,0267 1,9750 1,9390 1,8920 1,8625 1,8005 24
25 2,1111 2,0889 2,0691 2,0513 2,0353 2,0207 2,0075 1,9554 1,9192 1,8718 1,8421 1,7794 25
26 2,0939 2,0716 2,0518 2,0339 2,0178 2,0032 1,9898 1,9375 1,9010 1,8533 1,8233 1,7599 26
27 2,0781 2,0558 2,0358 2,0179 2,0017 1,9870 1,9736 1,9210 1,8842 1,8361 1,8059 1,7419 27
28 2,0635 2,0411 2,0210 2,0030 1,9868 1,9720 1,9586 1,9057 1,8687 1,8203 1,7898 1,7251 28
29 2,0500 2,0275 2,0073 1,9893 1,9730 1,9581 1,9446 1,8915 1,8543 1,8055 1,7748 1,7096 29
39 2,0374 2,0148 1,9946 1,9765 1,9601 1,9452 1,9317 1,8782 1,8409 1,7918 1,7609 1,6950 30
40 1,9476 1,9245 1,9038 1,8851 1,8682 1,8529 1,8389 1,7835 1,7444 1,6928 1,6600 1,5892 40
50 1,8949 1,8714 1,8503 1,8313 1,8141 1,7985 1,7841 1,7273 1,6872 1,6337 1,5995 1,5249 50
100 1,7919 1,7675 1,7456 1,7259 1,7079 1,6915 1,6764 1,6163 1,5733 1,5151 1,4772 1,3917 100
Estatı́stica 211
1%
0 𝐹𝛼 𝐹
D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 39,8636 49,5002 53,5933 55,8330 57,2400 58,2045 58,9062 59,4391 59,8575 60,1949 60,4728 60,7051 60,9025 1
2 8,5263 9,0000 9,1618 9,2434 9,2926 9,3255 9,3491 9,3668 9,3805 9,3916 9,4006 9,4082 9,4145 2
3 5,5383 5,4624 5,3908 5,3427 5,3091 5,2847 5,2662 5,2517 5,2400 5,2304 5,2224 5,2156 5,2098 3
4 4,5448 4,3246 4,1909 4,1072 4,0506 4,0097 3,9790 3,9549 3,9357 3,9199 3,9067 3,8955 3,8859 4
5 4,0604 3,7797 3,6195 3,5202 3,4530 3,4045TA 3,3679 3,3393 3,3163 3,2974 3,2816 3,2682 3,2567 5
6 3,7760 3,4633 3,2888 3,1808 3,1075 3,0546 3,0145 2,9830 2,9577 2,9369 2,9195 2,9047 2,8920 6
7 3,5894 3,2574 3,0741 2,9605 2,8833 2,8274 2,7849 2,7516 2,7247 2,7025 2,6839 2,6681 2,6545 7
8 3,4579 3,1131 2,9238 2,8064 2,7264 2,6683 2,6241 2,5893 2,5612 2,5380 2,5186 2,5020 2,4876 8
9 3,3603 3,0064 2,8129 2,6927 2,6106 2,5509 2,5053 2,4694 2,4403 2,4163 2,3961 2,3789 2,3640 9
U
10 3,2850 2,9245 2,7277 2,6053 2,5216 2,4606 2,4140 2,3771 2,3473 2,3226 2,3018 2,2841 2,2687 10
11 3,2252 2,8595 2,6602 2,5362 2,4512 2,3891 2,3416 2,3040 2,2735 2,2482 2,2269 2,2087 2,1930 11
IN
12 3,1766 2,8068 2,6055 2,4801 2,3940 2,3310 2,2828 2,2446 2,2135 2,1878 2,1660 2,1474 2,1313 12
13 3,1362 2,7632 2,5603 2,4337 2,3467 2,2830 2,2341 2,1953 2,1638 2,1376 2,1155 2,0966 2,0802 13
14 3,1022 2,7265 2,5222 2,3947 2,3069 2,2426 2,1931 2,1539 2,1220 2,0954 2,0730 2,0537 2,0370 14
M
15 3,0732 2,6952 2,4898 2,3614 12,2730 2,2081 2,1582 2,1185 2,0862 2,0593 2,0366 2,0171 2,0001 15
16 3,0481 2,6682 2,4618 2,3327 2,2438 2,1783 2,1280 2,0880 2,0553 2,0281 2,0051 1,9854 1,9682 16
17 3,0262 2,6446 2,4374 2,3077 2,2183 2,1524 2,1017 2,0613 2,0284 2,0009 1,9777 1,9577 1,9404 17
18 3,0070 2,6239 2,4160 2,2858 2,1958 2,1296 2,0785 2,0379 2,0047 1,9770 1,9535 1,9333 1,9158 18
19 2,9899 2,6056 2,3970 2,2663 2,1760 2,1094 2,0580 2,0171 1,9836 1,9557 1,9321 1,9117 1,8940 19
20 2,9747 2,5893 2,3801 2,2489 2,1582 2,0913 2,0397 1,9985 1,9649 1,9367 1,9129 1,8924 1,8745 20
21 2,9610 2,5746 2,3649 2,2333 2,1423 2,0751 2,0233 1,9819 1,9480 1,9197 1,8956 1,8750 1,8570 21
22 2,9486 2,5613 2,3512 2,2193 2,1279 2,0605 2,0084 1,9668 1,9327 1,9043 1,8801 1,8593 1,8411 22
23 2,9374 2,5493 2,3387 2,2065 2,1149 2,0472 1,9949 1,9531 1,9189 1,8903 1,8659 1,8450 1,8267 23
24 2,9271 2,5383 2,3274 2,1949 2,1030 2,0351 1,9826 1,9407 1,9063 1,8775 1,8530 1,8319 1,8136 24
25 2,9177 2,5283 2,3170 2,1842 2,0922 2,0241 1,9714 1,9292 1,8947 1,8658 1,8412 1,8200 1,8015 25
26 2,9091 2,5191 2,3075 2,1745 2,0822 2,0139 1,9610 1,9188 1,8841 1,8550 1,8303 1,8090 1,7904 26
27 2,9012 2,5106 2,2987 2,1655 2,0730 2,0045 1,9515 1,9091 1,8743 1,8451 1,8203 1,7989 1,7802 27
28 2,8938 2,5028 2,2906 2,1571 2,0645 1,9959 1,9427 1,9001 1,8652 1,8359 1,8110 1,7895 1,7706 28
29 2,8870 2,4955 2,2831 2,1494 2,0566 1,9878 1,9345 1,8918 1,8568 1,8274 1,8024 1,7808 1,7620 29
30 2,8807 2,4887 2,2761 2,1422 2,0492 1,9803 1,9269 1,8840 1,8490 1,8195 1,7944 1,7727 1,7538 30
40 2,8353 2,4404 2,2261 2,0909 1,9968 1,9269 1,8725 1,8280 1,7929 1,7627 1,7369 1,7146 1,6950 40
50 2,8087 2,4120 2,1967 2,0608 1,9660 1,8954 1,8405 1,7963 1,7598 1,7291 1,7029 1,6802 1,6602 50
100 2,7564 2,3564 2,1394 2,0019 1,9057 1,8339 1,7778 1,7324 1,6949 1,9267 1,6360 1,6124 1,5916 100
Estatı́stica 212
1%
0 𝐹𝛼 𝐹
12 2,1173 2,1049 2,0938 2,0839 2,0750 2,0670 2,0597 2,0312 2,0115 1,9861 1,9704 1,9379 12
13 2,0658 2,0532 2,0419 2,0318 2,0227 2,0145 2,0070 1,9778 1,9576 1,9315 1,9153 1,8817 13
14 2,0224 2,0095 1,9981 1,9878 1,9785 1,9701 1,9625 1,9326 1,9119 1,8852 1,8686 1,8340 14
M
15 1,9853 1,9722 1,9605 1,9501 1,9407 1,9321 1,9243 1,8939 1,8728 1,8454 1,8284 1,7929 15
16 1,9532 1,9399 1,9281 1,9175 1,9079 1,8992 1,8913 1,8603 1,8388 1,8108 1,7934 1,7570 16
17 1,9252 1,9117 1,8997 1,8889 1,8792 1,8704 1,8624 1,8309 1,8090 1,7805 1,7628 1,7255 17
18 1,9004 1,8868 1,8747 1,8638 1,8539 1,8450 1,8368 1,8049 1,7827 1,7537 1,7356 1,6976 18
19 1,8785 1,8647 1,8524 1,8414 1,8314 1,8224 1,8142 1,7818 1,7592 1,7298 1,7114 1,6726 19
20 1,8588 1,8449 1,8325 1,8214 1,8113 1,8022 1,7938 1,7611 1,7382 1,7083 1,6896 1,6501 20
21 1,8412 1,8271 1,8146 1,8034 1,7932 1,7840 1,7756 1,7424 1,7193 1,6890 1,6700 1,6298 21
22 1,8252 1,8111 1,7984 1,7871 1,7768 1,7675 1,7590 1,7255 1,7021 1,6714 1,6521 1,6113 22
23 1,8107 1,7964 1,7837 1,7723 1,7619 1,7525 1,7439 1,7101 1,6864 1,6554 1,6358 1,5944 23
24 1,7974 1,7831 1,7703 1,7587 1,7483 1,7388 1,7302 1,6960 1,6721 1,6407 1,6209 1,5788 24
25 1,7853 1,7708 1,7579 1,7463 1,7358 1,7263 1,7175 1,6831 1,6589 1,6272 1,6072 1,5645 25
26 1,7741 1,7596 1,7466 1,7349 1,7243 1,7147 1,7059 1,6712 1,6468 1,6147 1,5945 1,5513 26
27 1,7638 1,7492 1,7361 1,7243 1,7137 1,7040 1,6951 1,6602 1,6356 1,6032 1,5827 1,5390 27
28 1,7542 1,7395 1,7264 1,7146 1,7039 1,6941 1,6852 1,6500 1,6252 1,5925 1,5718 1,5276 28
29 1,7454 1,7306 1,7174 1,7055 1,6947 1,6849 1,6759 1,6405 1,6155 1,5825 1,5617 1,5169 29
30 1,7371 1,7223 1,7090 1,6970 1,6862 1,6763 1,6673 1,6316 1,6065 1,5732 1,5522 1,5069 30
40 1,6778 1,6624 1,6486 1,6362 1,6249 1,6146 1,6052 1,5677 1,5411 1,5056 1,4830 1,4336 40
50 1,6426 1,6269 1,6128 1,6000 1,5884 1,5778 1,5681 1,5294 1,5018 1,4648 1,4409 1,3885 50
100 1,5731 1,5566 1,5418 1,5283 1,5160 1,5047 1,4943 1,4528 1,4227 1,3817 1,3548 1,2934 100
Estatı́stica 213
Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 1% de probabilidade.
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos
GL\I 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19
1 90,03 135,0 164,3 185,6 202,2 215,8 227,2 237,0 245,6 253,2 260,0 266,2 271,8 277,0 281,8 286,3 290,4 294,3
2 14,04 19,02 22,29 24,72 26,63 28,20 29,53 30,68 31,69 32,59 33,40 34,13 34,81 35,43 36,00 36,53 37,03 37,50
3 8,26 10,62 12,17 13,33 14,24 15,00 15,64 16,20 16,69 17,13 17,53 17,89 18,22 18,52 18,81 19,07 19,32 19,55
4 6,51 8,12 9,17 9,96 10,58 11,10 11,55 11,93 12,27 12,57 12,84 13,09 13,32 13,53 13,73 13,91 14,08 14,24
5 5,70 6,98 7,80 8,42 8,91 9,32 9,70 9,97 10,24 10,48 10,70 10,89 11,08 11,24 11,40 11,55 11,68 11,81
6 5,24 6,33 7,03 7,56 7,97 8,32 8,61 8,87 9,10 9,30 9,48 9,65 9,81 9,95 10,08 10,21 10,32 10,43
7 4,95 5,92 6,54 7,00 7,37 7,68 7,94 8,17 8,37 8,55 8,71 8,86 9,00 9,12 9,24 9,35 9,46 9,55
8 4,75 5,64 6,20 6,62 6,96 7,24 7,47 7,68 7,86 8,03 8,18 8,31 8,44 8,55 8,66 8,76 8,85 8,94
9 4,60 5,43 5,96 6,35 6,66 6,92 7,13 7,32 7,50 7,65 7,78 7,91 8,02 8,13 8,23 8,32 8,41 8,50
10 4,48 5,27 5,77 6,14 6,43 6,67 6,88 7,06 7,21 7,36 7,48 7,60 7,71 7,81 7,91 7,99 8,08 8,15
11 4,39 5,15 5,62 5,97 6,25 6,48 6,67 6,84 6,99 7,13 7,25 7,36 7,46 7,56 7,65 7,73 7,81 7,88
12 4,32 5,05 5,50 5,84 6,10 6,32 6,51 6,67 6,81 6,94 7,06 7,17 7,26 7,36 7,44 7,52 7,59 7,66
13 4,26 4,96 5,40 5,73 5,98 6,19 6,37 6,53 6,67 6,79 6,90 7,01 7,10 7,19 7,27 7,34 7,42 7,48
14 4,21 4,90 5,32 5,63 5,88 6,08 6,26 6,41
TA 6,54 6,66 6,77 6,87 6,96 7,05 7,13 7,20 7,27 7,33
15 4,17 4,84 5,25 5,56 5,80 5,99 6,16 6,31 6,44 6,56 6,66 6,76 6,84 6,93 7,00 7,07 7,14 7,20
16 4,13 4,79 5,19 5,49 5,72 5,92 6,08 6,22 6,35 6,46 6,56 6,66 6,74 6,82 6,90 6,97 7,03 7,09
17 4,10 4,74 5,14 5,43 5,66 5,85 6,01 6,15 6,27 6,38 6,48 6,57 6,66 6,73 6,81 6,87 6,94 7,00
18 4,07 4,70 5,09 5,38 5,60 5,79 5,94 6,08 6,20 6,31 6,41 6,50 6,58 6,66 6,72 6,79 6,85 6,91
U
19 4,05 4,67 5,05 5,33 5,55 5,74 5,89 6,02 6,14 6,25 6,34 6,43 6,51 6,58 6,65 6,72 6,78 6,84
20 4,02 4,64 5,02 5,29 5,51 5,69 5,84 5,97 6,09 6,19 6,28 6,37 6,45 6,52 6,59 6,65 6,71 6,77
IN
24 3,96 4,55 4,91 5,17 5,37 5,54 5,68 5,81 5,92 6,02 6,11 6,19 6,26 6,33 6,39 6,45 6,51 6,56
30 3,89 4,46 4,80 5,05 5,24 5,40 5,54 5,65 5,76 5,85 5,93 6,01 6,08 6,14 6,20 6,26 6,31 6,36
40 3,82 4,37 4,70 4,93 5,11 5,26 5,39 5,50 5,60 5,69 5,76 5,84 5,90 5,96 6,02 6,07 6,12 6,16
60 3,76 4,28 4,60 4,82 4,99 5,13 5,25 5,36 5,45 5,53 5,60 5,67 5,73 5,78 5,84 5,89 5,93 5,97
M
120 3,70 4,20 4,50 4,71 4,87 5,00 5,12 5,21 5,30 5,38 5,44 5,50 5,56 5,61 5,66 5,71 5,75 5,79
Inf 3,64 4,12 4,40 4,60 4,76 4,88 4,99 5,08 5,16 5,23 5,29 5,35 5,40 5,45 5,49 5,54 5,57 5,61
Estatı́stica 214
Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 1% de probabilidade (continuação).
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos
GL\I 20 22 24 26 28 30 32 34 36 38 40 50 60 70 80 90 100
1 298,0 304,7 310,8 316,3 321,3 326,0 330,3 334,3 338,0 341,5 344,8 358,9 370,1 379,4 387,3 394,1 400,1
2 37,95 38,76 39,49 40,15 40,76 41,32 41,84 42,33 42,78 43,21 43,61 45,33 46,70 47,83 48,80 49,64 50,38
3 19,77 20,17 20,53 20,86 21,16 21,44 21,70 21,95 22,17 22,39 22,59 23,45 24,13 24,71 25,19 25,62 25,99
4 14,40 14,68 14,93 15,16 15,37 15,57 15,75 15,92 16,08 16,23 16,37 16,98 17,46 17,86 18,20 18,50 18,77
5 11,93 12,16 12,36 12,54 12,71 12,87 13,02 13,15 13,28 13,40 13,52 14,00 14,39 14,72 14,99 15,23 15,45
6 10,54 10,73 10,91 11,06 11,21 11,34 11,47 11,58 11,69 11,80 11,90 12,31 12,65 12,92 13,16 13,37 13,55
7 9,65 9,82 9,97 10,11 10,24 10,36 10,47 10,58 10,67 10,77 10,85 11,23 11,52 11,77 11,99 12,17 12,34
8 9,03 9,18 9,32 9,45 9,57 9,68 9,78 9,87 9,96 10,05 10,13 10,47 10,75 10,97 11,17 11,34 11,49
9 8,58 8,72 8,85 8,97 9,08 9,18 9,27 9,36 9,44 9,52 9,59 9,91 10,17 10,38 10,57 10,73 10,87
10 8,23 8,36 8,48 8,60 8,70 8,79 8,88 8,97 9,04 9,12 9,19 9,49 9,73 9,93 10,10 10,25 10,39
11 7,95 8,08 8,20 8,30 8,40 8,49 8, 58 8,65 8,73 8,80 8,86 9,15 9,38 9,57 9,73 9,88 10,00
12 7,73 7,85 7,96 8,07 8,16 8,25 8,33 8,40 8,47 8,54 8,60 8,88 9,09 9,28 9,43 9,57 9,69
13 7,55 7,66 7,77 7,87 7,96 8,04 8,12 8,19 8,26 8,33 8,39 8,65 8,86 9,04 9,19 9,32 9,44
14 7,40 7,51 7,61 7,70 7,79 7,87 7,95 8,02
TA 8,08 8,15 8,20 8,46 8,66 8,83 8,98 9,11 9,22
15 7,26 7,37 7,47 7,57 7,65 7,73 7,80 7,87 7,93 7,99 8,05 8,30 8,49 8,66 8,80 8,92 9,04
16 7,15 7,26 7,36 7,44 7,53 7,60 7,67 7,74 7,80 7,86 7,92 8,15 8,35 8,51 8,65 8,77 8,87
17 7,05 7,16 7,25 7,34 7,42 7,49 7,56 7,63 7,69 7,74 7,80 8,03 8,22 8,38 8,51 8,63 8,74
18 6,97 7,07 7,16 7,25 7,32 7,40 7,46 7,53 7,59 7,64 7,70 7,92 8,11 8,26 8,39 8,51 8,61
U
19 6,89 6,99 7,08 7,17 7,24 7,31 7,38 7,44 7,50 7,55 7,60 7,83 8,01 8,16 8,29 8,40 8,50
20 6,82 6,92 7,01 7,09 7,17 7,24 7,30 7,36 7,42 7,47 7,52 7,74 7,92 8,07 8,19 8,30 8,40
IN
24 6,61 6,70 6,79 6,86 6,94 7,00 7,06 7,12 7,17 7,22 7,27 7,48 7,64 7,78 7,90 8,00 8,10
30 6,41 6,49 6,57 6,64 6,71 6,77 6,83 6,88 6,93 6,98 7,02 7,22 7,37 7,50 7,61 7,71 7,80
40 6,21 6,29 6,36 6,43 6,49 6,55 6,60 6,65 6,70 6,74 6,78 6,96 7,10 7,22 7,33 7,42 7,50
60 6,02 6,09 6,16 6,22 6,28 6,33 6,38 6,42 6,47 6,51 6,55 6,71 6,84 6,95 7,05 7,13 7,21
M
120 5,83 5,90 5,96 6,02 6,07 6,12 6,16 6,20 6,24 6,28 6,32 6,47 6,59 6,69 6,78 6,85 6,92
Inf 5,64 5,71 5,77 5,82 5,87 5,91 5,95 5,99 6,03 6,06 6,09 6,23 6,34 6,43 6,51 6,58 6,64
Estatı́stica 215
Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 5% de probabilidade.
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos
GL\I 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20
1 17,97 26,98 32,82 37,08 40,41 43,12 45,40 47,36 49,07 50,59 51,96 53,20 54,33 55,36 56,32 57,22 58,04 58,83 59,56
2 6,09 8,33 9,80 10,88 11,74 12,44 13,03 13,54 13,99 14,39 14,75 15,08 15,38 16,65 15,91 16,14 16,37 16,57 16,77
3 4,50 5,91 6,83 7,50 8,04 8,48 8,85 9,18 9,46 9,72 9,95 10,15 10,35 10,53 10,69 10,84 10,98 11,11 11,24
4 3,93 5,04 5,76 6,29 6,71 7,05 7,35 7,60 7,83 8,03 8,21 8,37 8,53 8,66 8,79 8,91 9,03 9,13 9,23
5 3,64 4,60 5,22 5,67 6,03 6,33 6,58 6,80 7,00 7,17 7,32 7,47 7,60 7,72 7,83 7,93 8,03 8,12 8,21
6 3,46 4,34 4,90 5,31 5,63 5,90 6,12 6,32 6,49 6,65 6,79 6,92 7,03 7,14 7,24 7,34 7,43 7,51 7,59
7 3,34 4,17 4,68 5,06 5,36 5,61 5,82 6,00 6,16 6,30 6,43 6,55 6,66 6,76 6,85 6,94 7,02 7,10 7,17
8 3,26 4,04 4,53 4,89 5,17 5,40 5,60 5,77 5,92 6,05 6,18 6,29 6,39 6,48 6,57 6,65 6,73 6,80 6,87
9 3,20 3,95 4,42 4,76 5,02 5,24 5,43 5,60 5,74 5,87 5,98 6,09 6,19 6,28 6,36 6,44 6,51 6,58 6,64
10 3,15 3,88 4,33 4,65 4,91 5,12 5,31 5,46 5,60 5,72 5,83 5,94 6,03 6,11 6,19 6,27 6,34 6,41 6,47
11 3,11 3,82 4,26 4,57 4,82 5,03 5,20 5,35 5,49 5,61 5,71 5,81 5,90 5,98 6,06 6,13 6,20 6,27 6,33
12 3,08 3,77 4,20 4,51 4,75 4,95 5,12 5,27 5,40 5,51 5,62 5,71 5,80 5,88 5,95 6,02 6,09 6,15 6,21
13 3,06 3,74 4,15 4,45 4,69 4,89 5,05 5,19 5,32 5,43 5,53 5,63 5,71 5,79 5,86 5,93 6,00 6,06 6,11
14 3,03 3,70 4,11 4,41 4,64 4,83 4,99 5,13 5,25
TA 5,36 5,46 5,55 5,64 5,71 5,79 5,85 5,92 5,97 6,03
15 3,01 3,67 4,08 4,37 4,60 4,78 4,94 5,08 5,20 5,31 5,40 5,49 5,57 5,65 5,72 5,79 5,85 5,90 5,96
16 3,00 3,65 4,05 4,33 4,56 4,74 4,90 5,03 5,15 5,26 5,35 5,44 5,52 5,59 5,66 5,73 5,79 5,84 5,90
17 2,98 3,63 4,02 4,30 4,52 4,71 4,86 4,99 5,11 5,21 5,31 5,39 5,47 5,54 5,61 5,68 5,73 5,79 5,84
18 2,97 3,61 4,00 4,28 4,50 4,67 4,82 4,96 5,07 5,17 5,27 5,35 5,43 5,50 5,57 5,63 5,69 5,74 5,79
U
19 2,96 3,59 3,98 4,25 4,47 4,65 4,79 4,92 5,04 5,14 5,23 5,32 5,39 5,46 5,53 5,59 5,65 5,70 5,75
20 2,95 3,58 3,96 4,23 4,45 4,62 4,77 4,90 5,01 5,11 5,20 5,28 5,36 5,43 5,49 5,55 5,61 5,66 5,71
IN
24 2,92 3,53 3,90 4,17 4,37 4,54 4,68 4,81 4,92 5,01 5,10 5,18 5,25 5,32 5,38 5,44 5,49 5,55 5,59
30 2,89 3,49 3,85 4,10 4,30 4,46 4,60 4,72 4,82 4,92 5,00 5,08 5,15 5,21 5,27 5,33 5,38 5,43 5,48
40 2,86 3,44 3,79 4,04 4,23 4,39 4,52 4,64 4,74 4,82 4,90 4,98 5,04 5,11 5,16 5,22 5,27 5,31 5,36
60 2,83 3,40 3,74 3,98 4,16 4,31 4,44 4,55 4,65 4,73 4,81 4,88 4,94 5,00 5,06 5,11 5,15 5,20 5,24
M
120 2,80 3,36 3,69 3,92 4,10 4,24 4,36 4,47 4,56 4,64 4,71 4,78 4,84 4,90 4,95 5,00 5,04 5,09 5,13
Inf 2,77 3,31 3,63 3,86 4,03 4,17 4,29 4,39 4,47 4,55 4,62 4,69 4,74 4,80 4,85 4,89 4,93 4,97 5,01
Estatı́stica 216
Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 5% de probabilidade (continuação).
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos
GL\I 22 24 26 28 30 32 34 36 38 40 50 60 70 80 90 100
1 60,91 62,12 63,22 64,23 65,15 66,01 66,81 67,56 68,26 68,92 71,73 73,97 75,82 77,40 78,77 79,98
2 17,13 17,45 17,75 18,02 18,27 18,50 18,72 18,92 19,11 19,28 20,05 20,66 21,16 21,59 21,96 22,29
3 11,47 11,68 11,87 12,05 12,21 12,36 12,50 12,63 12,75 12,87 13,36 13,76 14,08 14,36 14,61 14,82
4 9,42 9,58 9,74 9,88 10,00 10,12 10,23 10,34 10,44 10,53 10,93 11,24 11,51 11,73 11,92 12,09
5 8,37 8,51 8,64 8,76 8,88 8,98 9,08 9,17 9,25 9,33 9,67 9,95 10,18 10,38 10,54 10,69
6 7,73 7,86 7,98 8,09 8,19 8,28 8,37 8,45 8,53 8,60 8,91 9,16 9,37 9,55 9,70 9,84
7 7,30 7,42 7,53 7,63 7,73 7,81 7,90 7,97 8,04 8,11 8,40 8,63 8,82 8,99 9,13 9,26
8 7,00 7,11 7,21 7,31 7,40 7,48 7,55 7,63 7,69 7,76 8,03 8,25 8,43 8,59 8,72 8,84
9 6,76 6,87 6,97 7,06 7,15 7,22 7,30 7,36 7,43 7,49 7,75 7,96 8,13 8,28 8,41 8,53
10 6,58 6,69 6,78 6,87 6,95 7,02 7,09 7,16 7,22 7,28 7,53 7,73 7,90 8,04 8,17 8,28
11 6,44 6,54 6,63 6,71 6,79 6,86 6,93 6,99 7,05 7,11 7,35 7,55 7,71 7,85 7,97 8,08
12 6,32 6,41 6,50 6,59 6,66 6,73 6,80 6,86 6,92 6,97 7,21 7,39 7,55 7,69 7,80 7,91
13 6,22 6,31 6,40 6,48 6,55 6,62 6,68 6,74 6,80 6,85 7,08 7,27 7,42 7,55 7,67 7,77
14 6,13 6,22 6,31 6,39 6,46 6,53 6,59
TA 6,65 6,70 6,75 6,98 7,16 7,31 7,44 7,55 7,65
15 6,06 6,15 6,23 6,31 6,38 6,45 6,51 6,56 6,62 6,67 6,89 7,07 7,21 7,34 7,45 7,55
16 6,00 6,08 6,17 6,24 6,31 6,37 6,43 6,49 6,54 6,59 6,81 6,98 7,13 7,25 7,36 7,46
17 5,94 6,03 6,11 6,18 6,25 6,31 6,37 6,43 6,48 6,53 6,74 6,91 7,05 7,18 7,28 7,38
18 5,89 5,98 6,06 6,13 6,20 6,26 6,32 6,37 6,42 6,47 6,68 6,85 6,99 7,11 7,21 7,31
U
19 5,85 5,93 6,01 6,08 6,15 6,21 6,27 6,32 6,37 6,42 6,63 6,79 6,93 7,05 7,15 7,24
20 5,81 5,89 5,97 6,04 6,10 6,17 6,22 6,28 6,33 6,37 6,58 6,74 6,88 6,99 7,10 7,19
IN
24 5,68 5,76 5,84 5,91 5,97 6,03 6,09 6,13 6,18 6,23 6,42 6,58 6,71 6,82 6,92 7,01
30 5,56 5,64 5,71 5,77 5,83 5,89 5,94 5,99 6,04 6,08 6,27 6,42 6,54 6,65 6,74 6,83
40 5,44 5,51 5,58 5,64 5,70 5,75 5,80 5,85 5,89 5,93 6,11 6,26 6,38 6,48 6,57 6,65
60 5,32 5,39 5,45 5,51 5,57 5,62 5,66 5,71 5,75 5,79 5,96 6,09 6,21 6,30 6,39 6,46
M
120 5,20 5,27 5,33 5,38 5,43 5,48 5,53 5,57 5,61 5,64 5,80 5,93 6,04 6,13 6,21 6,28
Inf 5,08 5,14 5,20 5,25 5,30 5,35 5,39 5,43 5,46 5,50 5,65 5,76 5,86 5,95 6,02 6,09
Estatı́stica 217
GL\k 2 3 4 5 6 7 8 9 10
5 5,70 5,89 5,99 6,04 6,06 6,07 6,07 6,07 6,07
6 5,24 5,44 5,55 5,61 5,66 5,68 5,69 5,70 5,70
7 4,95 5,14 5,26 5,33 5,38 5,42 5,44 5,45 5,46
8 4,75 4,94 5,06 5,13 5,19 5,23 5,26 5,28 5,29
9 4,60 4,79 4,90 4,99 5,04 5,08 5,12 5,14 5,16
10 4,48 4,67 4,79 4,87 4,93 4,97 5,01 5,03 5,06
11 4,39 4,58 4,69 4,78 4,84 4,89 4,92 4,95 4,97
12 4,32 4,50 4,62 4,70 4,76 4,81 4,85 4,88 4,90
13 4,26 4,44 4,56 4,64 4,70 4,75 4,79 4,82 4,85
14 4,21 4,39 4,51 4,59 4,65 4,70 4,74 4,77 4,80
15 4,17 4,35 4,46 4,55 4,61 4,66 4,70 4,73 4,76
16 4,13 4,31 4,43 4,51 4,57 4,62 4,66 4,70 4,72
17 4,10 4,28 4,39 4,47 4,54 4,59 4,63 4,66 4,69
18 4,07 4,25 4,36 4,45 4,51 4,56 4,60 4,64 4,66
19 4,05 4,22 4,33 4,42 4,48 4,53 4,58 4,61 4,64
20
25
4,02
3,94
4,20
4,11
4,31
4,22
TA
4,40
4,31
4,46
4,37
4,51
4,42
4,55
4,47
4,59
4,50
4,62
4,53
30 3,89 4,06 4,17 4,25 4,31 4,37 4,41 4,44 4,48
50 3,79 3,95 4,06 4,14 4,20 4,25 4,29 4,33 4,37
U
60 3,76 3,92 4,03 4,11 4,17 4,23 4,27 4,31 4,34
100 3,71 3,87 3,98 4,06 4,12 4,17 4,22 4,25 4,29
Tabela para o Teste de Duncan, com 5% de probabilidade.
IN
GL\k 2 3 4 5 6 7 8 9 10
5 3,64 3,75 3,80 3,81 3,81 3,81 3,81 3,81 3,81
M
Referências
[1] M ONTGOMERY, D. C., AND RUNGER , G. C. Estatı́stica Aplicada e Probabilidade para
Engenheiros. LTC, 2021.
TA
U
IN
M