0% acharam este documento útil (0 voto)
4 visualizações220 páginas

Estatística

O documento é um guia abrangente sobre Estatística, abordando tópicos como Estatística Descritiva, Amostragem e Probabilidade. Ele inclui definições, medidas de tendência central, dispersão e exercícios práticos. Além disso, explora variáveis aleatórias discretas e distribuições teóricas de probabilidade.

Enviado por

Edurdo Calos
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd
0% acharam este documento útil (0 voto)
4 visualizações220 páginas

Estatística

O documento é um guia abrangente sobre Estatística, abordando tópicos como Estatística Descritiva, Amostragem e Probabilidade. Ele inclui definições, medidas de tendência central, dispersão e exercícios práticos. Além disso, explora variáveis aleatórias discretas e distribuições teóricas de probabilidade.

Enviado por

Edurdo Calos
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd

Estatı́stica

TA
U
IN
M

Toledo, 2025
Versão: 0.5
Sumário
1 Introdução 5

2 Estatı́stica Descritiva 8
2.1 Conceitos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2 Medidas de Tendência Central . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.1 Média . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.2 Mediana . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 8
2.2.3 Moda . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 9
2.3 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 10
2.4 Medidas de Dispersão . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
2.4.1 Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 11
2.4.2 Desvio padrão . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 12
2.4.3 Coeficiente de Variação . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
2.4.4 Quartis . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 13
2.4.5 Boxplot . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 15
2.5 Assimetria e Curtose . . . . . . . . TA . . . . . . . . . . . . . . . . . . . . . . . . . 19
2.6 Tabelas e Gráficos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 22
2.7 Tabela de Distribuição de Frequência . . . . . . . . . . . . . . . . . . . . . . . . . 23
2.8 Representações Gráficas . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 39
U
2.9 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 71

3 Amostragem 74
IN

3.1 Conceitos . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 74
3.2 Tamanho da Amostra . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 74
3.3 Amostragem Casual Simples . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79
M

3.3.1 Método de Escolha . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 79


3.4 Amostragem por Estratato . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 80
3.4.1 Método de Escolha . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 81
3.5 Amostragem por Conglomerados . . . . . . . . . . . . . . . . . . . . . . . . . . . 82
3.6 Amostragem Sistemática . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 83
3.6.1 Método de Escolha . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 84
3.7 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 85

4 Probabilidade 87
4.1 Espaço Amostral . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 87
4.2 Classe dos Eventos Aleatórios . . . . . . . . . . . . . . . . . . . . . . . . . . . . 91
4.3 Operações com Eventos Aleatórios . . . . . . . . . . . . . . . . . . . . . . . . . . 91
4.4 Propriedades das Operações . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 92
4.5 Partição de um Espaço Amostral . . . . . . . . . . . . . . . . . . . . . . . . . . . 94
4.6 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 95
Estatı́stica 3

5 Probabilidade 97
5.1 Função de Probabilidade . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 97
5.2 Eventos Equiprováveis . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 98
5.3 Probabilidade Condicional . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 99
5.4 Eventos Independentes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 100
5.5 Teorema de Bayes . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 100
5.6 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 102

6 Variáveis Aleatórias Discretas 103


6.1 Definições . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 104
6.2 Esperança Matemática . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 108
6.2.1 Propriedades da Esperança Matemática . . . . . . . . . . . . . . . . . . . 109
6.3 Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 109
6.3.1 Propriedades da Variância . . . . . . . . . . . . . . . . . . . . . . . . . . 111
6.4 Correlação . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 111
6.5 Função de Distribuição F (x) . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 111
6.5.1 Propriedades de F (x) . . . . . . . . . . . . . . . . . . . . . . . . . . . . 113
6.6 Exercı́cios . . . . . . . . . . . . . . . . . . . .
TA . . . . . . . . . . . . . . . . . . . 114

7 Distribuições Teóricas de Probabilidade para Variáveis Aleatórias Discretas 115


7.1 Distribuição de Bernoulli . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 115
U
7.1.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 115
7.2 Distribuição Binomial . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 116
7.2.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 116
IN

7.3 Distribuição de Poisson . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 117


7.3.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 117
M

8 Variáveis Aleatórias Contı́nuas 119


8.1 Definições . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 120
8.2 Esperança Matemática . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 121
8.3 Função de Distribuição F (x) . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 121

9 Distribuições Teóricas de Probabilidade para Variáveis Aleatórias Contı́nuas 122


9.1 Distribuição Uniforme . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 122
9.1.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 122
9.1.2 Função de Distribuição . . . . . . . . . . . . . . . . . . . . . . . . . . . . 122
9.2 Distribuição Exponencial . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 123
9.2.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 124
9.2.2 Função de Distribuição . . . . . . . . . . . . . . . . . . . . . . . . . . . . 124
9.3 Distribuição Normal . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 125
9.3.1 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 127
9.3.2 Esperança e Variância . . . . . . . . . . . . . . . . . . . . . . . . . . . . 127
Estatı́stica 4

10 Análise de Regressão e Correlação 131


10.1 Diagrama de Dispersão . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 131
10.2 Modelo Linear Simples . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 133
10.2.1 Estimativas de Mı́nimos Quadrados para β0 e β1 . . . . . . . . . . . . . . 133
10.2.2 Coeficiente de Determinação . . . . . . . . . . . . . . . . . . . . . . . . . 137
10.3 Coeficiente de Correlação de Pearson . . . . . . . . . . . . . . . . . . . . . . . . 145
10.3.1 Sentido e Força da Correlação . . . . . . . . . . . . . . . . . . . . . . . . 146

11 Intervalos de Confiança - IC 152


11.1 IC para a Média Populacional - Variância Populacional Conhecida . . . . . . . . . 153
11.2 IC para a Média Populacional - Variância Populacional Desconhecida . . . . . . . 155
11.3 IC para a Proporção ou Probabilidade . . . . . . . . . . . . . . . . . . . . . . . . 157
11.4 IC para a Variância Populacional . . . . . . . . . . . . . . . . . . . . . . . . . . . 159
11.5 IC para o Desvio padrão Populacional . . . . . . . . . . . . . . . . . . . . . . . . 160
11.6 Exercı́cios . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 161

12 Testes de Hipóteses 163


12.1 Teste para a média populacional µ . . . . . . . . . . . . . . .
TA . . . . . . . . . . . 165
12.2 Teste para a diferença entre duas médias populacionais µ1 e µ2 . . . . . . . . . . . 169
12.2.1 Dados Emparelhados . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 169
12.2.2 Dados Não emparelhados . . . . . . . . . . . . . . . . . . . . . . . . . . 170
12.3 Teste para a variância populacional σ 2 . . . . . . . . . . . . .
U
. . . . . . . . . . . 177
12.4 Teste para a igualdade de duas variâncias populacionais σ12 e σ22 . . . . . . . . . . . 179
12.5 Teste para a proporção populacional p . . . . . . . . . . . . . . . . . . . . . . . . 180
IN

12.6 Delineamento Inteiramente Casualizado - DIC . . . . . . . . . . . . . . . . . . . . 181


12.6.1 Modelo Estatı́stico . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 182
12.6.2 Teste F . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 184
M

12.7 Teste de Tukey . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 191


12.8 Teste de Fisher . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 193
12.9 Teste de Duncan . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 196
12.10Teste de Dunnet . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 199

13 Tabelas de Distribuições 202


Estatı́stica 5

1 Introdução
O material a seguir são notas de aulas de Estatı́stica para alunos do curso de graduação. Os
livros textos utilizados para a elaboração dessas notas são [2] e [1]. As análises foram realizadas
com o software .
A Estatı́stica é um processo para estudo de problemas associados a fenômenos aleatórios. Para
o estudo destes problems são realizados experimentos aleatórios para obter leituras sobre uma
variável de interesse. Por meio da Estatı́stica é possı́vel realizar a análise e interpretação dos dados
populacionais ou amostrais obtidos e também inferir caracterı́sticas de populações. É aplicável em
ramos do conhecimento que se utilizam de dados experimentais. Do ponto de vista histórico o
crescimento e o desenvolvimento da estatı́stica moderna está associado a três fenômenos isolados:
a necessidade do governo de coletar dados sobre os cidadãos; o desenvolvimento da teoria da pro-
babilidade e o advento da informática.
Nas civilizações antigas como Egı́pcias, Grega e Romana, dados primários eram coletados
com propósito de taxações e finalidades militares. Já na Idade Média, igrejas registravam dados e
informações sobre nascimentos, mortes e casamentos. Os dados atualmente são necessários para
diversas atividades antrópicas sendo relacionadas a questões como saúde, economia, agricultura,
educação e outras. TA
A Estatı́stica pode ser dividida em duas partes: Estatı́stica Descritiva e a Estatı́stica Inferencial.
A Estatı́stica Descritiva está associada a organização, sumarização e descrição de um conjunto de
dados coletados. Esta análise fornece as primeira informações para o pesquisador sobre o pro-
U
blema em estudo e permite tornar mais fácil a leitura dos dados, já que fornece informações sobre
a qualidade de seus dados e, em alguns, casos indicando tendências. Geralmente a função descri-
IN

tiva da estatı́stica não tem um fim em si própria, exceto o caso do censo. Já a Estatı́stica Inferencial
é uma etapa da estatı́stica que trata da coleta, redução, análise, modelagem e interpretação dos
dados. O objetivo da estatı́stica inferencial, também chamada de indutiva, é o de tirar conclusões
M

com base nos resultados observados em amostras extraı́das dessas populações. O próprio termo
indutiva decorre da existência de um processo de indução, isto é, um processo de raciocı́nio e que
partindo-se do conhecimento de uma parte, procura-se tirar conclusões sobre a realidade no todo.
A Estatı́stica Descritiva e Inferencial são utilizadas no contexto da Pesquisa Estatı́stica que é
um conjunto de atividades orientadas para a busca de um determinado conhecimento. Uma pes-
quisa para ser qualificada como cientı́fica deve ser feita de modo sistematizada, utilizando para
isto métodos próprios e técnicas especı́ficas. A pesquisa cientı́fica se distingue de outras modali-
dades quaisquer de pesquisa pelo método, pela técnica, por estar voltada para a realidade empı́rica
e pela forma de comunicar o conhecimento. A pesquisa tem o objetivo de descobrir respostas para
questões, mediante aplicações de métodos cientı́ficos e tentar conhecer e explicar fenômenos que
ocorrem no mundo existente.
Há diversos tipos de pesquisa associadas a certos objetivos como a Pesquisa de Reconheci-
mento ou “Survery”, que pode ser utilizada em estudos de opinião, mercado e diagnóstico; Pes-
quisa Bibliográfica em que se procura material já elaborado; pesquisa documental nas quais se
coletam de informações a partir de documentos quantitativos tais como arquivos públicos e pri-
vados, imprensa, revistas, etc; Pesquisa Experimental empregada em experiências realizadas em
laboratórios, fábricas, parcelas de terras. Em uma pesquisa experimental é comum a utilização de
delineamentos experimentais e também o Controle de Qualidade. Cada etapa indicada possui suas
caracterı́stica, sendo necessário estudo aprofundado.
Estatı́stica 6

Planejamento
Definição do Tema Instrumento de Coleta
Início Determinar os Objetivos
População
Coleta de Dados
Para que?

Tratamento dos dados


Análise e Interpretação Organização dos dados em Amostra
tabelas e gráficos

Inferência sobre a Divulgação dos Resultados


População Publicação Fim

Figura 1.1: Etapas de Pesquisa Estatı́stica

Em estatı́stica os termos a seguir são utilizados com frequência. Serão apresentadas alguns
conceitos e definições comumente empregados em estatı́stica: População é o conjunto de interesse
TA
final para a pesquisa, em geral, é o conjunto do qual a amostra é retirada; Amostra é qualquer sub-
conjunto da população de interesse, desses subconjuntos os dados observacionais ou experimentais
são obtidos; Unidade experimental ou de Análise é o objeto ou indivı́duo que será estudado na
população dos quais se obtêm os dados; Dados é o valor ou resposta que toma a variável em cada
U
unidade experimental, sendo o resultado de uma observação.
Variável é uma caracterı́stica observável, susceptı́vel de adotar distintos valores ou ser ex-
IN

presso em várias categorias, por exemplo, Idades, Gênero, Série, Horas de estudo, Horas de treino,
etc. As variáveis podem ser classificas como Qualitativas, podendo ser Nominais ou Ordinais ou
Quantitativas podendo ser Discretas ou Contı́nuas, conforme a Figura 1.2.
M

Qualitativas Quantitativas

Nominais Ordinais Discretas Contínuas

Exemplos Exemplos Exemplos Exemplos


 Profissão  Escolaridade  Nº filhos  Altura
 Sexo  Estágio de doença  Nº acessos plataforma  Peso
 Religião  Classe social  Nº peças  Salário

Figura 1.2: Classificação das Variáveis

Uma vez que os dados das variáveis de interesse estão disponı́veis, é possı́vel realizar a etapa
de Tratamento dos Dados em que um conjunto de técnicas usadas para descrever os dados obser-
vados. Nessa etapa é comum a aplicação de Estatı́sticas que são funções dos dados observados
Estatı́stica 7

(amostra) de uma variável e são usados para fins descritivos ou analı́ticos. Uma estatı́stica como
uma função dos dados da amostra é também chamada de medida resumo dos dados. Uma es-
tatı́stica pode ser calculada com a amostra.
Em estatı́stica Inferência pode ser entendido como um onjunto de métodos que permitem in-
ferir o comportamento de uma população a partir do conhecimento da amostra. Neste contexto é
aplicado o Cálculo de Probabilidade que está associado a teoria matemática que deduz a partir
de um modelo as propriedades de um fenômeno aleatório. Nesses modelos é comum a busca por
estimar Parâmetros que são caracterı́sticas importantes da população, comumente são desconhe-
cidas. Um parâmetro pode ser estimado com a amostra. A Informação é o resultado dos dados
processados (ou organizados) alinhado com os objetivos de uma certa pesquisa.

TA
U
IN
M
Estatı́stica 8

2 Estatı́stica Descritiva
2.1 Conceitos
2.2 Medidas de Tendência Central
2.2.1 Média
A média é uma das medidas de tendência central (ou medidas de posição) que são muito uti-
lizadas em estatı́stica descritiva. As principais vantagens dessa medida são: faz uso de todos os
dados para seu cálculo, pode ser determinada com precisão matemática e pode ser determinada
somente o valor total e o número de elementos forem conhecidos. As desvantagens são: não pode
ser empregada para dados qualitativos, e é influenciada por valores extremos, podendo, em alguns
casos, não representar a série. Notação: média populacional é denotada por µ e média amostral
por x.
Definição 2.2.1. A média x é definida por:
n
x1 + x2 + · · · + xn X xi
x= =
n n
TA i=1

Exemplo 2.2.1. Calcular a média dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
U
1.
105 + 221 + 181 + 186 + 121 + 181 + 180 + 143 1318
IN

x= = = 164, 75
8 8
2.
M

x = 164, 75
Exemplo 2.2.2. No Software

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


x_med <- mean(x)
x_med

## [1] 164.75

2.2.2 Mediana
A mediana é uma das medidas de tendência central (ou medidas de posição). Corresponde ao
valor que está no meio quando os dados estão em ordem crescente ou decrescente. As principais
vantagens da mediana são: a mediana não é influenciada por valores extremos e pode ser obtida
para variáveis qualitativas ordinais ou para as quantitativas. As desvantagens da mediana são: a
mediana exige uma ordenação de categorias, da mais baixa a mais alta; não pode ser obtida para
variáveis qualitativas nominais e não inclui todos os valores da distribuição. Notação: a mediana
será denotada por xe ou por Md .
Estatı́stica 9

Definição 2.2.2. No cálculo da mediana deve ser considerado se o tamanho da amostra n é impar
ou par.

a. Se n for ı́mpar o elemento que corresponderá a mediana x


e será identificado, no conjunto de
dados ordenados, por:
n+1
xi =
2
b. Se n for par deverá ser identificado os elementos:

xi = x n2 e xi+1 = x n2 +1

sendo que a mediana x


e será a media aritmética entre os valores das posições xi e xi+1 .

Exemplo 2.2.3. Calcular a mediana dos valores 105, 221, 181, 186, 121, 181, 180, 143.

Solução

1. Como n = 8 é par, então TA


x 8 = x4 = 180 e x 8 +1 = x5 = 181
2 2

2. Logo, a mediana x
e
180 + 181
U
x
e= = 180, 5
2
IN

Exemplo 2.2.4. No Software

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


M

x_mediana <- median(x)


x_mediana

## [1] 180.5

2.2.3 Moda
A moda é uma das medidas de tendência central (ou medidas de posição). Corresponde ao
valor mais frequente nos dados. As principais vantagens da moda são: a moda é uma medida que
requer apenas o conhecimento da frequência absoluta; pode ser utilizada para qualquer tipo de
variáveis, tanto qualitativas, quanto quantitativas; é de uso prático. Como desvantagens se tem que
a moda não inclui todos os valores da distribuição e mostra-se ineficiente quando a distribuição é
amplamente dispersa.

Exemplo 2.2.5. Determinar a moda dos valores 105, 221, 181, 186, 121, 181, 180, 143.

Solução
Estatı́stica 10

1. Como 181 ocorre 2 vezes no conjunto, segue que a moda é unimodal sendo

M0 = 181

Observação. Se o conjunto de dados possui dois valores com a mesma frequência se diz que é
bimodal, no caso de três ou mais valores com a mesma frequência se diz que é trimodal e no caso
de mais de três valores com a mesma frequência se diz que é multimodal. Se nenhum valor se
repetir no conjunto de dados se diz que o conjunto é amodal

Exemplo 2.2.6. No Software

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


x_tab <- [Link](table(x))
x_mod <- subset(x_tab, x_tab[ , 1] == max(x_tab[ , 1]))
x_mod

## [,1]
## 181 2 TA
2.3 Exercı́cios
U
1. Calcular a média dos dados da tabela abaixo:
IN

Tabela 2.1: Dados do exercı́cio.

4 40 24 23
M

37 44 25 39
38 25 33 49
30 2 17 24

2. Determinar a mediana dos dados da tabela abaixo:

Tabela 2.2: Dados do exercı́cio.

13 18 50 11
38 43 44 13
41 12 29 50
23 10 49 25
35 38 20 30

3. Considera os dados da tabela abaixo e determine média, a mediana e a moda.


Estatı́stica 11

Tabela 2.3: Dados do exercı́cio.

3.4 6.0 4.7 4.9


-2.5 2.6 4.8 1.0
3.1 7.8 1.3 -1.2
-0.1 -5.9 0.6 -3.1
-4.4 5.2 4.7 1.3
2.3 3.2 2.4 6.4
4.6 2.1 -6.3 -3.3
2.5 -1.8 3.5 2.5

2.4 Medidas de Dispersão


2.4.1 Variância
A variância é uma medida utilizada para é verificar a dispersão dos dados. A variância mede
o quanto os valores em uma amostra variam. É uma medida que avalia o grau de dispersão dos
valores da variável em torno da média. Notação: a variância populacional será denotada por σ 2 e a
amostral por s2 .
TA
Definição 2.4.1. A variância amostral s2 é definida como:
Pn
(xi − x)2
U
2
s = i=1
n−1
IN

e pode também ser obtida por:


Pn 2
x2i − n1 ( ni=1 xi )
P
2 i=1
s =
M

n−1
Definição 2.4.2. A variância populacional σ 2 é definida como:
PN
(xi − x)2
σ 2 = i=1
N
e pode também ser obtida por:
PN 2 1
Pn 2
2 i=1 xi − N ( i=1 xi )
σ =
N
Exemplo 2.4.1. Determinar a variância dos valores 105, 221, 181, 186, 121, 181, 180, 143.
Solução
Pn 2
P8
2 i=1 (xi − x) (xi − 164, 75)2
1. s = = i=1
n−1 8−1
= (105 − 164, 75) + (221 − 164, 75)2 + (181 − 164, 75)2 + (186 − 164, 75)2
2

+(121 − 164, 75)2 + (181 − 164, 75)2 + (180 − 164, 75)2 + (143 − 164, 75)2
7
= 1476, 21
Estatı́stica 12

2. ∴ s2 = 1476, 21

Exemplo 2.4.2. No Software

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


x_var <- var(x)
x_var

## [1] 1476.214

2.4.2 Desvio padrão


O desvio padrão é a maneira mais comum de se medir a variação de um conjunto de observações,
pois preserva a unidade de medida dos dados. Quanto maior o valor do desvio padrão de um con-
junto de dados, maior será a dispersão. Quanto menor o desvio padrão, mais os valores da variável
se aproximam de sua média. Notação: o desvio padrão populacional será denotado por σ e o
amostral por s. TA
Definição 2.4.3. O desvio padrão é obtido da variância extraindo a raiz quadrada. No caso
amostral √
s = s2
U
e no populacional, √
σ= σ2
IN

Quanto maior a variância e desvio padrão, maiores são os indı́cios de heterogeneidade entre os
elementos do conjunto.
M

Exemplo 2.4.3. Determinar o desvio padrão dos valores 105, 221, 181, 186, 121, 181, 180, 143.

Solução

1. Como s2 = 1476, 21

2. s = 1476, 21 = 38, 42

Exemplo 2.4.4. No Software

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


x_sd <- sd(x)
x_sd

## [1] 38.42153
Estatı́stica 13

2.4.3 Coeficiente de Variação


Coeficiente de Variação (CV ) é uma medida de homogeneidade dos dados em relação à média.
O CV é obtido com o desvio padrão e a média de um conjunto de dados.

Definição 2.4.4. O CV populacional é expresso em porcentagem e definido como:


σ
CV = · 100
µ
Definição 2.4.5. O CV amostral é expresso em porcentagem e definido como:
s
CV = · 100
x
Exemplo 2.4.5. Determinar o coeficiente de variação dos valores 105, 221, 181, 186, 121, 181,
180, 143.

Solução

1. Como s = 34, 43 e x = 164, 75


s 38, 42
TA
2. CV = · 100 = = 23, 32%
x 164, 75
U
Exemplo 2.4.6. No Software
IN

x <- c(105, 221, 181, 186, 121, 181, 180, 143)


x_cv <- sd(x)/mean(x)*100
x_cv
M

## [1] 23.32111

Em um conjunto de dados quanto maior o desvio padrão, maior será o coeficiente de variação
e os indı́cios de heterogeneidade entre os elementos do conjunto. Pimentel-Gomes (1985) propos
a seguinte classificação para a intrepreteção do CV: CV < 10% baixo; 10% ≤ CV < 20% médio;
20% ≤ CV < 30 alto e CV ≥ 30% muito alto. A figura (2.1) a seguir ilustra um grupo homogênio
e um heterogênio.

2.4.4 Quartis
Os quartis são medidas usadas no âmbito da dispersão e dividem um conjunto de dados orde-
nados em quatro partes iguais, por meio de três quartis. A Figura a seguir ilustra essa divisão para
um conjunto de dados.
Estatı́stica 14

Homogeneidade  Heterogeneidade

1 2 3

4 5

Figura 2.1: Grupo homogênio e heterogênio.


TA
x1 x2 x3 x4 x5 x6 x7 x8 x9 x10 x11 x12
U

3 4 6 8 11 14 16 17 20 21 23 24
IN

25% dos valores 25% dos valores 25% dos valores 25% dos valores
M

Q1 Q2 Q3
(Mediana)
Figura 2.2: Ilustração da divisão em quartis

Quando um conjunto ordenado de dados é dividido em quatro partes iguais, os pontos de di-
visão são chamados de quartis. Os quartis também são denominados de medidas separatrizes. O
primeiro quartil ou quartil inferior, Q1 , é um valor que tem aproximadamente, um quarto ou 25%
das observações abaixo dele e aproximadamente três- quartos ou 75% das observações acima dele.
O segundo quartil Q2 , tem, aproximadamente, metade 50% das observações abaixo de seu valor.
O segundo quartil é exatamente igual à mediana. O terceiro quartil ou quartil superior, Q3 , tem
aproximadamente três-quartos ou 75% das observações abaixo de seu valor. Como no caso da
mediana os quartis podem não ser únicos.
A posição do primeiro quartil com os dados ordenados pode ser obtida como (n + 1)/4. O valor
de Q1 é obtido por interpolação, média dos valores.
De forma análoga, a posição do terceiro quartil com os dados ordenados pode ser obtida como
3(n + 1)/4. O valor de Q3 é obtido por interpolação, média dos valores.
Estatı́stica 15

Uma outra forma de determinar os quartis é apresentado na definição a seguir:


Definição 2.4.6. Uma definição para os quartis Q1 , Q2 e Q3 é dada por:

Q1 = x n4 + 0, 75 · x n4 +1 − x n4


 x n + 1 , se n for ı́mpar ou

2



Q2 =

 xn + xn
 +1
 2 2 , se n for par


2
 
Q3 = x 3n + 0, 25 · x 3n +1 − x 3n
4 4 4

Exemplo 2.4.7. Calcular os quartis Q1 , Q2 e Q3 para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21,
23, 24.

Solução
  
TA
1. Q1 = x n4 + 0, 75 · x n4 +1 − x n4 = x 12 + 0, 75 · x 12 +1 − x 12
4 4 4

= x3 + 0, 75 · (x4 − x3 ) = 6 + 0, 75 · (8 − 6) = 7, 5
2. Como n = 12 é par,
U
xn + xn x 12 + x 12
+1 +1
x 6 + x7 14 + 16 30
Q2 = 2 2 = 2 2
IN

= = = = 15
2 2 2 2 2
   
3. Q3 = x 3n + 0, 25 · x 3n +1 − x 3n = x 3·12 + 0, 25 · x 3·12 +1 − x 3·12
M

4 4 4 4 4 4

= x9 + 0, 25 · (x10 − x9 ) = 20 + 0, 25 · (21 − 20) = 20, 25

Exemplo 2.4.8. No Software

x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
x_qua <- quantile(x)
x_qua

## 0% 25% 50% 75% 100%


## 3.00 7.50 15.00 20.25 24.00

2.4.5 Boxplot
O boxplot (gráfico de caixa) é utilizado para verificar a dispersão dos dados, desvio de simetria
e identificar observações longe do “núcleo” dos dados (essas observações são denominadas “outli-
ers”). Para a sua construção são utilizados os quartis. A partir dos quartis determina-se a amplitude
interquartı́lica (Q3 −Q1 ) que é utilizada para determinar o Limite Inferior (LI) e o Limite Superior
(LS) do boxplot.
Estatı́stica 16

Definição 2.4.7. Os Limite Inferior (LI) e o Limite Superior (LS) são definidos por:

LI = Q1 − 1, 5 · (Q3 − Q1 )

LS = Q3 + 1, 5 · (Q3 − Q1 )
valores abaixo de LI ou acima de LS são “outliers”

Exemplo 2.4.9. Calcular os limites LI e LS para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23,
24.

Solução

1. LI = Q1 − 1, 5 · (Q3 − Q1 ) = 7, 5 − 1, 5 · (2, 25 − 7, 5) = −11, 62

2. LS = Q3 + 1, 5 · (Q3 − Q1 ) = 20, 25 + 1, 5 · (2, 25 − 7, 5) = 39, 37

Exemplo 2.4.10. No Software

TA
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
x_LI <- quantile(x)[2] - 1.5*(quantile(x)[4] - quantile(x)[2])
x_LI <- [Link](x_LI)
x_LI
U
## [1] -11.625
IN

x_LS <- quantile(x)[4] + 1.5*(quantile(x)[4] - quantile(x)[2])


x_LS <- [Link](x_LS)
M

x_LS

## [1] 39.375

Exemplo 2.4.11. Construir o gráfico boxplot para o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23,
24.

Solução

1. Utilizando os valores mı́nimo e máximo, os quartis, os limites superior, é possı́vel construir


o boxplot ilustrado na Figura (2.3) a seguir:
Estatı́stica 17

39,37 Limite Superior (LS)

24 Máximo (Desconsiderando “Outliers”)


Terceiro Quartil (Q3)
20,25
20
15 Segundo Quartil (Q2)
15
(Mediana)
10
7,5 Primeiro Quartil (Q1)
5
3 Mínimo (Desconsiderando “Outliers”)

-11,62 Limite Inferior (LI)

Figura 2.3: Gráfico boxplot

Exemplo 2.4.12. No Software


TA
x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
par(mar = c(3,2,1,1))
U
boxplot(x)
IN
M
Estatı́stica 18

20
15
10

TA
5

U
IN

Definição 2.4.8. Seja X uma variável aleatória, define-se:


M

Momento de ordem k:
1 P k
(1) mk = xi é o k−ésimo momento populacional, e
N
1P k
(2) mk = xi é o k−ésimo momento amostral.
n
Observação. O momento de ordem 1 (k = 1) corresponde a média.

Momento de ordem k centrado na média:


1 P
(1) mk = (xi − µ)k é o k−ésimo momento central (ou momento centrado na média) para
N
os dados de uma população, e
1P
(2) mk = (xi − x)k é o k−ésimo momento central para os dados de uma amostra.
n
Observação. O momento centrado na média de ordem 2 (k = 2) corresponde a variância.
Estatı́stica 19

2.5 Assimetria e Curtose


Coeficientes de assimetria de Pearson permitem identificar se um conjunto de dados possui
uma distribuição assimétrica positiva, negativa ou se é simétrica.

Definição 2.5.1. O coeficiente de assimetria pode ser estimado por meio das seguintes expressões:

• Coeficiente de Assimetria de Pearson

X − M0
As1 =
σ

• Coeficiente de Assimetria de Pearson

3 · (X − Md )
As2 =
σ

• Coeficiente Quartı́lico de Assimetria


Q1 + Q3 − 2 · Md
As =
TA Q3 − Q1

• Coeficiente de Momento de Assimetria


U
1
Pn 3
n i=1 (xi − x) m3
As1 = Pn 3/2 = 3/2
1 2 m2
i=1 (xi − x)
IN

em que
M

1 P
(1) m3 = (xi − µ)3 é o terceiro momento central (ou momento centrado na média)
N
para os dados de uma população, e
1P
(2) m2 = (xi − x)2 é o segundo momento central para os dados de uma amostra.
n
• Coeficiente de Momento de Assimetria

n × m3
As2 =
(n − 1) × (n − 2) × σ 3
′ Pn
em que m3 = i=1 (xi − x)3 .

Com base no coeficiente calculado, por qualquer uma das expressões acima, podemos fazer a
seguinte interpretação:

• Se As > 0, a distribuição é assimétrica positiva (à direita);

• Se As < 0, a distribuição é assimétrica negativa (à esquerda);

• Se As = 0, a distribuição é simétrica.
Estatı́stica 20

Exemplo 2.5.1. Considere o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24. Calcule e interprete
o coeficiente de assimetria de Pearson.

Solução
Q1 + Q3 − 2 · Md 7, 5 + 20, 25 − 2 · 15 −2, 25
1. As = = As = = = −0, 177
Q3 − Q1 20, 25 − 7, 5 12, 7
2. Como As = −0, 177 < 0, segue que a distribuição é assimétrica negativa (à esquerda).

Exemplo 2.5.2. No Software

x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
library(moments)
x_as <- skewness(x)
x_as

## [1] -0.140808
TA
A medida de curtose mede o grau de achatamento da distribuição em relação a curva normal.

• Uma distribuição achatada denomina-se: platicúrtica


U
• Uma distribuição nem chata, nem delgada, chama-se: mesocúrtica
IN

• Uma distribuição delgada chama-se: leptocúrtica

Definição 2.5.2. Os percentis dividem os dados em centésimas partes, sendo que cada parte com
M

1% dos dados. Um conjunto de dados pode ser dividido 100 partes iguais por meio de 99 percentis.
Os percentis são denotados por: P1 , P2 , . . . , P99 .
A posição do percentil Pi , com os dados ordenados de forma crescente, pode ser obtido como:

i × (n + 1)
Posto do Pi =
100
em que i = 1, 2, . . . 100 e n é o tamanho do conjunto de dados. O valor do percentil pode ser:

• Determinado como o valor que ocupada a posição (Posto do Pi ) arredondado para o interiro
mais próximo.

• Se a posição (posto) for entre dois valores, o percentil poderá ser determinado por interpolação
entre esses dois valores, com o uso, por exemplo, da média aritmética.

Definição 2.5.3. O coeficiente de de curtose K1 para o grau de achatamento da distribuição, pode


ser definido como:
Q3 − Q1
K1 =
2 · (P90 − P10 )
Com base no coeficiente calculado, podemos seguir a seguinte interpretação:
Estatı́stica 21

• Se K1 > 0, 263, diz-se que a curva correspondente à distribuição de frequência é platicúrtica.

• Se K1 = 0, 263, diz-se que a curva correspondente à distribuição de frequência é me-


socúrtica.

• Se K1 < 0, 263, diz-se que a curva correspondente à distribuição de frequência é lep-


tocúrtica.
Definição 2.5.4. O coeficiente de de curtose K2 para o grau de achatamento da distribuição, pode,
também ser definido como:
1
Pn 4
n i=1 (xi − x) m4
K2 = 2 −3= −3
1 n (m2 )2
P 
(x − x) 2
n i=1 i

Com base no coeficiente calculado, podemos seguir a seguinte interpretação:


• Se K2 < 3, diz-se que a curva correspondente à distribuição de frequência é platicúrtica.

• Se K2 = 3, diz-se que a curva correspondente à distribuição de frequência é mesocúrtica.

• Se K2 > 3, diz-se que a curva correspondente à distribuição de frequência é leptocúrtica.


TA
Definição 2.5.5. O coeficiente de de curtose K3 para o grau de achatamento da distribuição, pode,
também ser definido como:
U
′ ′ ′
n × (n + 1) × m4 − 3 × m2 × m2 × (n − 1)
K3 =
(n − 1) × (n − 2) × (n − 3) × σ 4
IN

′ ′
em que m2 = (xi − x)2 e m4 = (xi − x)4 .
P P
M

Com base no coeficiente calculado, podemos seguir a seguinte interpretação:


• Se K3 < 0, diz-se que a curva correspondente à distribuição de frequência é platicúrtica.

• Se K3 = 0, diz-se que a curva correspondente à distribuição de frequência é mesocúrtica.

• Se K3 > 0, diz-se que a curva correspondente à distribuição de frequência é leptocúrtica.


Exemplo 2.5.3. Considere o conjunto 3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24. Calcule e interprete
o coeficiente de curtose K1 .

Solução

1. Como P90 = 22, 8 − P10 = 4, 2


Q3 − Q1 20, 25 − 7, 5 12, 75 12, 75
2. K1 = = = = ≈ 0, 319
2 · (P90 − P10 ) 2(23, 5 − 3, 5) 2 · (20) 40
3. Como K1 ≈ 0, 343 > 0, 263 segue que a distribuição é platicúrtica.

Exemplo 2.5.4. No Software


Estatı́stica 22

x <- c(3, 4, 6, 8, 11, 14, 16, 17, 20, 21, 23, 24)
library(moments)
x_k <- kurtosis(x)
x_k

## [1] 1.625981

2.6 Tabelas e Gráficos


A Estatı́stica Descritiva é a fase na qual os dados de um experimento ou pesquisa, são or-
ganizados, resumidos, descritos, apresentados e interpretados. Nessa fase é possı́vel perceber as
tendências do nosso conjunto de dados. Após a coleta dos dados experimentais, devemos orga-
nizá-los e apresentá-los; esta apresentação, pode ser feita através de tabelas e gráficos.
As Tabelas são formas não discursiva de apresentação informações, das quais o dado numérico
se destaca como informação central. As apresentações em tabelas deverão ser realizadas em uma
pesquisa, segundo a convenção ou norma que depende da instituição, congresso ou órgão na qual
será apresentada.
TA
Exemplo 2.6.1. Em uma tabela não há linhas verticais laterais, ponto final em cada linha e linhas
horizontais no corpo da tabela separando as linhas.
U
Tabela 2.4: Exemplo para construção de uma de tabela.
IN

Tı́tulo da Coluna 1 Tı́tulo da Coluna 2 ··· Tı́tulo da Coluna n


Tı́tulo Linha 1 Dado numérico ··· Dado numérico
M

Tı́tulo Linha 2 Dado numérico ··· Dado numérico


.. .. .. ..
. . . .
Tı́tulo Linha m Dado numérico ··· Dado numérico
Fonte: espaço para a fonte da tabela.

Exemplo 2.6.2. Em uma tabela não há linhas verticais laterais, ponto final em cada linha e linhas
horizontais no corpo da tabela separando as linhas.
Estatı́stica 23

Tabela 2.5: População por região do Brasil.

Região População (Habitantes)


Centro-Oeste 14.058.094
Nordeste 53.081.950
Norte 5.864.454
Sudeste 80.364.410
Sul 27.368.891
Fonte: IBGE, Censo Demográfico 2010.

2.7 Tabela de Distribuição de Frequência


Em estatı́stica uma tabela de distribuição de frequência é constituı́da, além dos itens já menci-
onados, pelos seguintes elementos:
TA
• Frequência absoluta (fa ): é o número de vezes em que cada elemento da amostra ou população
aparece no conjunto de dados.

• Frequência absoluta acumulada (Fa ): é a soma das frequências dos dados anteriores.
U
• Frequência relativa (fr ): é a razão entre o valor de cada frequência e o número total de dados
IN

observados, ou seja, fri = fai /n.

• Frequência relativa acumulada (Fr ): é a soma das frequências relativas dos dados anteriores.
M

• Frequência percentual (fp ): é a frequência relativa multiplicada por 100, ou seja, fp = fai /n·
100.

• Frequência percentual acumulada (Fp ): é a soma das frequência percentuais dos dados ante-
riores.

As tabela de distribuição de frequências podem ser utilizadas em variáveis quantitativas e qua-


litativas. No caso de um número grande de dados ou de variáveis quantitativas contı́nuas para a
construção da tabela de distribuição de frequências, é comum utilizar intervalos (ou classes).
Os intervalos pode ser de igual tamanho ou de tamanhos diferentes, podendo ser abertos ou
fechados. A escolha dos intervalos depende do conhecimento que se tem dos dados em estudo
(Bussab e Morettin, 2002). Um número pequeno de intervalos pode perder informações, e um
número grande de intervalo pode prejudicar o resumo dos dados.
Segundo Fonseca (ANO) considerando um número de elementos igual a n, se tem que o número
de classes k pode ser obtido como:

1. Considerando n

(a) Para n menor que 25 o número k é igual 5;


Estatı́stica 24

(b) Para n maior que 25 o número k é aproximadamente igual a raiz quadrada de n.


(c) (a) e (b) podem ser escritos como:

5√ se n ≤ 25
k=
n se n > 25

2. Fórmula de Sturges:
k = 1 + 3, 33 · log(n)

Quando os intervalos são utilizados para a construção de uma tabela de distribuição de frequência,
geralmente é importante determinar:

• Amplitude total ou range (At ): é a diferença entre o maior e o menor valor observado no
conjunto de dados.

• Amplitude dos intervalos ou classes (Ac ): é a divisão da amplitude total (At ) pelo número
de intervalos (k), ou seja,
At
Ac =
TA k

Tabela 2.6: Exemplo de uma tabela de distribuição de frequência - (dados discretos).


U
Valor fa Fa fr Fr fp Fp
IN
M

Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
Estatı́stica 25

Tabela 2.7: Exemplo de uma tabela de distribuição de frequência (dados contı́nuos).

Classe Ponto Médio fa Fa fr Fr fp Fp

Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa
(fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percen-
tual acumulada (Fp )
Exemplo 2.7.1. Considere os valores 5, 9, 18, 5, 9, 18, 5, 9, 18, 5, 9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9. Construir a tabela de distribuição de frequências.

Solução
TA
1. Incluindo os valores na tabela
U
Tabela 2.8: Tabela de distribuição de frequência.

Valor fa Fa fr Fr fp Fp
IN

1
2
M

5
9
13
18
22
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
2. Frquência absoluta
Estatı́stica 26

Tabela 2.9: Tabela de distribuição de frequência.

Valor fa Fa fr Fr fp Fp
1 2
2 3
5 4
9 7
13 3
18 5
22 3
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
3. Frquência absoluta acumulada
TA
Tabela 2.10: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN

1 2 2
2 3 5
M

5 4 9
9 7 16
13 3 19
18 5 24
22 3 27
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
4. Frquência relativa
Estatı́stica 27

Tabela 2.11: Tabela de distribuição de frequência.

Valor fa Fa fr Fr fp Fp
1 2 2 0,07
2 3 5 0,11
5 4 9 0,15
9 7 16 0,26
13 3 19 0,11
18 5 24 0,19
22 3 27 0,11
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
5. Frquência relativa acumulada
TA
Tabela 2.12: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN

1 2 2 0,07 0,07
2 3 5 0,11 0,19
M

5 4 9 0,15 0,33
9 7 16 0,26 0,59
13 3 19 0,11 0,70
18 5 24 0,19 0,89
22 3 27 0,11 1
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
6. Frquência percentual
Estatı́stica 28

Tabela 2.13: Tabela de distribuição de frequência.

Valor fa Fa fr Fr fp Fp
1 2 2 0,07 0,07 7,41
2 3 5 0,11 0,19 11,11
5 4 9 0,15 0,33 14,81
9 7 16 0,26 0,59 25,93
13 3 19 0,11 0,70 11,11
18 5 24 0,19 0,89 18,52
22 3 27 0,11 1 11,11
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )
7. Frquência percentual acumulada
TA
Tabela 2.14: Tabela de distribuição de frequência.
U
Valor fa Fa fr Fr fp Fp
IN

1 2 2 0,07 0,07 7,41 7,41


2 3 5 0,11 0,19 11,11 18,52
M

5 4 9 0,15 0,33 14,81 33,33


9 7 16 0,26 0,59 25,93 59,26
13 3 19 0,11 0,70 11,11 70,37
18 5 24 0,19 0,89 18,52 88,89
22 3 27 0,11 1 11,11 100,00
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência re-
lativa (fr ), Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência
Percentual acumulada (Fp )

A tabela de distribuição de frequências pode ser utilizada para determinar os quartis. Para isso,
basta que os valores sejam ordenados de forma crescente, considerando suas frequências absolutas.
Com os dados ordenados a determinação dos quartis é realizada conforme a subseção 2.4.4. De
forma análoga, é possı́vel também determinar os percentis com a definição 2.5.2.

Exemplo 2.7.2. Considere os valores no quadro abaixo e construa a tabela de distribuição de


frequências.
Estatı́stica 29

Quadro: Valores para a tabela de distribuição de frequências.


13,9 27,3 16,5 21,0 21,9 15,2 7,7 12,4 19,3 15,3
18,6 26,5 16,3 16,5 16,8 12,6 16,1 19,5 19,1 18,1
20,9 18,1 11,9 16,0 17,3 12,3 13,1 15,0 20,2 15,4

Solução

1. Determinar o número de classes

(a) Conforme a expressão: 


5√ se n ≤ 25
k=
n se n > 25

como n > 25, segue que k = 30 ≈ 5, 477 ≈ 5
(b) Já pela Fórmula de Sturges:

k = 1 + 3, 33 · log(n)

se tem que k = 1 + 3, 33 · log(30) ≈ 5, 918 ≈ 6


TA
2. Decisão: será utilizado k = 5!

3. Determinar a amplitude total ou range At :


U
At = maior valor - menor valor = 27, 3 − 7, 7 = 19, 6
IN

4. Determinar a amplitude das classes Ac


At 19, 6
M

Ac = = = 3, 92
k 5

5. Incluir os limites das classes

Tabela 2.15: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62
11,62 ⊢ 15, 54
15,54 ⊢ 19, 46
19,46 ⊢ 23, 38
23,38 ⊢ 27, 30
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
Estatı́stica 30

6. Ponto médio

Tabela 2.16: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62 9,66
11,62 ⊢ 15, 54 13,58
15,54 ⊢ 19, 46 17,5
19,46 ⊢ 23, 38 21,42
23,38 ⊢ 27, 30 25,34
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
7. Frequência absoluta TA
Tabela 2.17: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


U
7,70 ⊢ 11, 62 9,66 1
IN

11,62 ⊢ 15, 54 13,58 10


15,54 ⊢ 19, 46 17,5 12
M

19,46 ⊢ 23, 38 21,42 5


23,38 ⊢ 27, 30 25,34 2
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
8. Frequência absoluta acumulada
Estatı́stica 31

Tabela 2.18: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62 9,66 1 1
11,62 ⊢ 15, 54 13,58 10 11
15,54 ⊢ 19, 46 17,5 12 23
19,46 ⊢ 23, 38 21,42 5 28
23,38 ⊢ 27, 30 25,34 2 30
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
9. Frequência relativa

Tabela 2.19: Tabela de distribuição de frequência.


TA
Classe Ponto Médio fa Fa fr Fr fp Fp
7,70 ⊢ 11, 62 9,66 1 1 0,03
U
11,62 ⊢ 15, 54 13,58 10 11 0,33
15,54 ⊢ 19, 46 17,5 12 23 0,40
IN

19,46 ⊢ 23, 38 21,42 5 28 0,16


23,38 ⊢ 27, 30 25,34 2 30 0,06
M

Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
10. Frequência relativa acumulada

Tabela 2.20: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62 9,66 1 1 0,03 0,03
11,62 ⊢ 15, 54 13,58 10 11 0,33 0,36
15,54 ⊢ 19, 46 17,5 12 23 0,40 0,76
19,46 ⊢ 23, 38 21,42 5 28 0,16 0,92
23,38 ⊢ 27, 30 25,34 2 30 0,06 0,98
Estatı́stica 32

Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
11. Frequência percentual

Tabela 2.21: Tabela de distribuição de frequência.

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62 9,66 1 1 0,03 0,03 3,33
11,62 ⊢ 15, 54 13,58 10 11 0,33 0,36 33,33
15,54 ⊢ 19, 46 17,5 12 23 0,40 0,76 40,00
19,46 ⊢ 23, 38 21,42 5 28 0,16 0,92 16,66
23,38 ⊢ 27, 30 25,34 2 30 0,06 0,98 6,00
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )
TA
12. Frequência percentual acumulada
U
Tabela 2.22: Tabela de distribuição de frequência.
IN

Classe Ponto Médio fa Fa fr Fr fp Fp


7,70 ⊢ 11, 62 9,66 1 1 0,03 0,03 3,33 3,33
M

11,62 ⊢ 15, 54 13,58 10 11 0,33 0,36 33,33 36,66


15,54 ⊢ 19, 46 17,5 12 23 0,40 0,76 40,00 76,66
19,46 ⊢ 23, 38 21,42 5 28 0,16 0,92 16,66 93,32
23,38 ⊢ 27, 30 25,34 2 30 0,06 0,98 6,00 99,32
Nota: Frequência absoluta (fa ), Frequência absoluta acumulada (Fa ), Frequência relativa (fr ),
Frequência relativa acumulada (Fr ), Frequência percentual(fp ), Frequência Percentual acu-
mulada (Fp )

A tabela de distribuição de frequências para dados agrupados pode ser utilizada para determinar
os quartis. Nesse caso pode ser utilizada a definição a seguir.

Definição 2.7.1. Uma definição para a determinação dos quartis Q1 , Q2 e Q3 com o uso da tabela
de distribuição de frequência para dados agrupados é dada por:
P
r fa − Fac(i−1)
Q = Lci + × Ac
fac(i)
em que:
Estatı́stica 33
P
• r fa para determinar o valor da posição (posto) do quartil a razão r será:

(1) r = 1/4 (25%) para Q1


(2) r = 1/2 (50%) para Q2
(3) r = 3/4 (75%) para Q3
P
o quartil estará na posição r fa observada na coluna da Fa .

• Lci é o limite inferior da classe que contém o quartil;

• Fac(i−1) frequência absoluta acumulada da classe anterior;

• fac(i) frequência absoluta da classe que contém o quartil;

• Ac amplitude de classe.

Com os quartis determinados é possı́vel construir o gráfico boxplot conforme a subseção 2.4.5.
De forma análoga, com o uso da tabela de distribuição de frequências para dados agrupados pode
ser determinados os percentis com a definição a seguir.
TA
Definição 2.7.2. Uma definição para a determinação dos percentis P1 , P2 , . . . , P100 com o uso da
tabela de distribuição de frequência para dados agrupados é dada por:
P
r fa − Fac(i−1)
U
P = Lci + × Ac
fac(i)
IN

em que:
P
• r fa para determinar o valor da posição (posto) do percentil a razão r será:
M

(1) r = 1/100 (1%) para P1


(2) r = 2/100 (2%) para P2
..
.
(10) r = 10/100 (10%) para P10
..
.
(90) r = 90/100 (90%) para P90
..
.
(99) r = 99/100 (99%) para P99
(100) r = 1 (100%) para P100
P
o percentil estará na posição r fa observada na coluna da Fa .

• Lci é o limite inferior da classe que contém o percentil;

• Fac(i−1) frequência absoluta acumulada da classe anterior;


Estatı́stica 34

• fac(i) frequência absoluta da classe que contém o percentil;


• Ac amplitude de classe.
Exemplo 2.7.3. No Software . Tabela de distribuição de frequência com valores discretos.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)

d_ordenado <- sort(d)

#Frequência Absoluta

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13]) TA
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
c(fa_1, fa_2, fa_3, fa_4, fa_5, fa_6, fa_7)
U
## [1] 2 3 4 7 3 5 3
IN

#Frequência Absoluta Acumulada


Fa_1 <- fa_1
Fa_2 <- fa_1 + fa_2
M

Fa_3 <- fa_1 + fa_2 + fa_3


Fa_4 <- fa_1 + fa_2 + fa_3 + fa_4
Fa_5 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5
Fa_6 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6
Fa_7 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6 + fa_7
c(Fa_1, Fa_2, Fa_3, Fa_4, Fa_5, Fa_6, Fa_7)

## [1] 2 5 9 16 19 24 27

#Frequência Relativa
options(digits=3)
fr_1 <- fa_1/(length(d))
fr_2 <- fa_2/(length(d))
fr_3 <- fa_3/(length(d))
fr_4 <- fa_4/(length(d))
fr_5 <- fa_5/(length(d))
fr_6 <- fa_6/(length(d))
fr_7 <- fa_7/(length(d))
c(fr_1, fr_2, fr_3, fr_4, fr_5, fr_6, fr_7)
Estatı́stica 35

## [1] 0.0741 0.1111 0.1481 0.2593 0.1111 0.1852 0.1111

#Frequência Relativa Acumulada


Fr_1 <- Fa_1/(length(d))
Fr_2 <- Fa_2/(length(d))
Fr_3 <- Fa_3/(length(d))
Fr_4 <- Fa_4/(length(d))
Fr_5 <- Fa_5/(length(d))
Fr_6 <- Fa_6/(length(d))
Fr_7 <- Fa_7/(length(d))
c(Fr_1, Fr_2, Fr_3, Fr_4, Fr_4, Fr_6, Fr_7)

## [1] 0.0741 0.1852 0.3333 0.5926 0.5926 0.8889 1.0000

#Frequência Percentual
fp_1 <- fa_1/(length(d))*100
fp_2 <- fa_2/(length(d))*100
fp_3 <- fa_3/(length(d))*100
fp_4 <- fa_4/(length(d))*100
TA
fp_5 <- fa_5/(length(d))*100
fp_6 <- fa_6/(length(d))*100
U
fp_7 <- fa_7/(length(d))*100
c(fp_1, fp_2, fp_3, fp_4, fp_5, fp_6, fp_7)
IN

## [1] 7.41 11.11 14.81 25.93 11.11 18.52 11.11


M

#Frequência Percentual Acumulada


Fp_1 <- fp_1
Fp_2 <- fp_1 + fp_2
Fp_3 <- fp_1 + fp_2 + fp_3
Fp_4 <- fp_1 + fp_2 + fp_3 + fp_4
Fp_5 <- fp_1 + fp_2 + fp_3 + fp_4 + fp_5
Fp_6 <- fp_1 + fp_2 + fp_3 + fp_4 + fp_5 + fp_6
Fp_7 <- fp_1 + fp_2 + fp_3 + fp_4 + fp_5 + fp_6 + fp_7
c(Fp_1, Fp_2, Fp_3, Fp_4, Fp_5, Fp_6, Fp_7)

## [1] 7.41 18.52 33.33 59.26 70.37 88.89 100.00

col_1 <- c(fa_1, fa_2, fa_3, fa_3, fa_4, fa_5, fa_7)


col_2 <- c(Fa_1, Fa_2, Fa_3, Fa_4, Fa_5, Fa_6, Fa_7)
col_3 <- c(fr_1, fr_2, fr_3, fr_4, fr_5, fr_6, fr_7)
col_4 <- c(Fr_1, Fr_2, Fr_3, Fr_4, Fr_4, Fr_6, Fr_7)
col_5 <- c(fp_1, fp_2, fp_3, fp_4, fp_5, fp_6, fp_7)
col_6 <- c(Fp_1, Fp_2, Fp_3, Fp_4, Fp_5, Fp_6, Fp_7)
Estatı́stica 36

tabela <- [Link](col_1, col_2, col_3, col_4, col_5, col_6)

colnames(tabela) <- c("fa", "Fa", "fr", "Fr", "fp", "Fp")

tabela

## fa Fa fr Fr fp Fp
## 1 2 2 0.0741 0.0741 7.41 7.41
## 2 3 5 0.1111 0.1852 11.11 18.52
## 3 4 9 0.1481 0.3333 14.81 33.33
## 4 4 16 0.2593 0.5926 25.93 59.26
## 5 7 19 0.1111 0.5926 11.11 70.37
## 6 3 24 0.1852 0.8889 18.52 88.89
## 7 3 27 0.1111 1.0000 11.11 100.00

Exemplo 2.7.4. No Software . Tabela de distribuição de frequência com valores em classes.

d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
TA
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
U
d_ordenado <- sort(d)
IN

A_t <- max(d) - min(d)


A_t
M

## [1] 19.6

k <- round(sqrt(length(d)))
k

## [1] 5

A_c <- A_t/k

#Limites Inferior e Superior das Classes


C1_inf <- min(d)
C1_sup <- C1_inf + A_c
c(C1_inf, C1_sup)

## [1] 7.7 11.6

C2_inf <- C1_sup


C2_sup <- C2_inf + A_c
c(C2_inf, C2_sup)
Estatı́stica 37

## [1] 11.6 15.5

C3_inf <- C2_sup


C3_sup <- C3_inf + A_c
c(C3_inf, C3_sup)

## [1] 15.5 19.5

C4_inf <- C3_sup


C4_sup <- C4_inf + A_c
c(C4_inf, C4_sup)

## [1] 19.5 23.4

C5_inf <- C4_sup


C5_sup <- C5_inf + A_c
c(C5_inf, C5_sup)

## [1] 23.4 27.3


TA
#Ponto Médio das Classes
C1_Medio <- (C1_inf + C1_sup)/2
C2_Medio <- (C2_inf + C2_sup)/2
U
C3_Medio <- (C3_inf + C3_sup)/2
C4_Medio <- (C4_inf + C4_sup)/2
IN

C5_Medio <- (C5_inf + C5_sup)/2


c(C1_Medio, C2_Medio, C3_Medio, C4_Medio, C5_Medio)
M

## [1] 9.66 13.58 17.50 21.42 25.34

#Frequência Absoluta
C1_fa <- length(d[d >= C1_inf & d < C1_sup])
C2_fa <- length(d[d >= C2_inf & d < C2_sup])
C3_fa <- length(d[d >= C3_inf & d < C3_sup])
C4_fa <- length(d[d >= C4_inf & d < C4_sup])
C5_fa <- length(d[d >= C5_inf & d < C5_sup])
c(C1_fa, C2_fa, C3_fa, C4_fa, C5_fa)

## [1] 1 10 12 5 2

#Frequência Absoluta Acumulada


C1_Fa <- C1_fa
C2_Fa <- C1_fa + C2_fa
C3_Fa <- C1_fa + C2_fa + C3_fa
C4_Fa <- C1_fa + C2_fa + C3_fa + C4_fa
C5_Fa <- C1_fa + C2_fa + C3_fa + C4_fa + C5_fa
c(C1_Fa, C2_Fa, C3_Fa, C4_Fa, C5_Fa)
Estatı́stica 38

## [1] 1 11 23 28 30

#Frequência Relativa
options(digits=3)
C1_fr <- C1_fa/(length(d))
C2_fr <- C2_fa/(length(d))
C3_fr <- C3_fa/(length(d))
C4_fr <- C4_fa/(length(d))
C5_fr <- C5_fa/(length(d))
c(C1_fr, C2_fr, C3_fr, C4_fr, C5_fr)

## [1] 0.0333 0.3333 0.4000 0.1667 0.0667

#Frequência Relativa Acumulada


C1_Fr <- C1_Fa/(length(d))
C2_Fr <- C2_Fa/(length(d))
C3_Fr <- C3_Fa/(length(d))
C4_Fr <- C4_Fa/(length(d))
C5_Fr <- C5_Fa/(length(d))
TA
c(C1_Fr, C2_Fr, C3_Fr, C4_Fr, C5_Fr)

## [1] 0.0333 0.3667 0.7667 0.9333 1.0000


U
#Frequência Percentual
IN

C1_fp <- C1_fa/(length(d))*100


C2_fp <- C2_fa/(length(d))*100
C3_fp <- C3_fa/(length(d))*100
M

C4_fp <- C4_fa/(length(d))*100


C5_fp <- C5_fa/(length(d))*100
c(C1_fp, C2_fp, C3_fp, C4_fp, C5_fp)

## [1] 3.33 33.33 40.00 16.67 6.67

#Frequência Percentual Acumulada


C1_Fp <- C1_fp
C2_Fp <- C1_fp + C2_fp
C3_Fp <- C1_fp + C2_fp + C3_fp
C4_Fp <- C1_fp + C2_fp + C3_fp + C4_fp
C5_Fp <- C1_fp + C2_fp + C3_fp + C4_fp + C5_fp
c(C1_Fp, C2_Fp, C3_Fp, C4_Fp, C5_Fp)

## [1] 3.33 36.67 76.67 93.33 100.00

col_1 <- c(C1_inf, C2_inf, C3_inf, C4_inf, C5_inf)


col_2 <- c(C1_sup, C2_sup, C3_sup, C4_sup, C5_sup)
col_3 <- c(C1_Medio, C2_Medio, C3_Medio, C4_Medio, C5_Medio)
Estatı́stica 39

col_4 <- c(C1_fa, C2_fa, C3_fa, C4_fa, C5_fa)


col_5 <- c(C1_Fa, C2_Fa, C3_Fa, C4_Fa, C5_Fa)
col_6 <- c(C1_fr, C2_fr, C3_fr, C4_fr, C5_fr)
col_7 <- c(C1_Fr, C2_Fr, C3_Fr, C4_Fr, C5_Fr)
col_8 <- c(C1_fp, C2_fp, C3_fp, C4_fp, C5_fp)
col_9 <- c(C1_Fp, C2_Fp, C3_Fp, C4_Fp, C5_Fp)

tabela <- [Link](col_1, col_2, col_3, col_4, col_5,


col_6, col_7, col_8, col_9)

colnames(tabela) <- c("Clas_Min", "Clas_Max", "Médio", "fa", "Fa",


"fr", "Fr", "fp", "Fp")

tabela

## Clas_Min Clas_Max Médio fa Fa fr Fr fp Fp


## 1 7.7 11.6 9.66 1 1 0.0333 0.0333 3.33 3.33
## 2 11.6 15.5 13.58 10 11 0.3333 0.3667 33.33 36.67
## 3 15.5
TA
19.5 17.50 12 23 0.4000 0.7667 40.00 76.67
## 4 19.5 23.4 21.42 5 28 0.1667 0.9333 16.67 93.33
## 5 23.4 27.3 25.34 2 30 0.0667 1.0000 6.67 100.00
U
IN

2.8 Representações Gráficas


Há diversos tipos de gráficos que podem ser utilizados para representar uma série de dados.
M

Alguns desses dados são: Histograma; Polı́gono de frequência absoluta; Polı́gono de frequência
acumulada; Dispersão; Dotplot; Séries temporais; Barras; Pizza (ou Setores); Pictograma entre
outros.

Exemplo 2.8.1. No Software . Gráfico histograma com a função hist.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
hist(d, main = "Histograma")
Estatı́stica 40

Histograma

8
6
4
2

TA
0

0 5 10 15 20 25
IN

Exemplo 2.8.2. No Software . Gráfico histograma com a função hist, exemplo de edição dos
M

eixos.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))

hist(d, breaks = 30, main="Histograma", axes=F, xlab="", ylab="")


axis(side=1, at=seq(1, 22, by=3))
axis(side=2, at=seq(0, 7, by=1))
Estatı́stica 41

Histograma

7
6
5
4
3
2

TA
1
0

1 4 7 10 13 16 19 22
IN

Exemplo 2.8.3. No Software . Gráfico do polı́gono de frequência.


M

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
#Frequência Absoluta

valor <- unique(sort(d))

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13])
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
fa <- c(fa_1, fa_2, fa_3, fa_4, fa_5, fa_6, fa_7)
freq <- cbind(valor, fa)
Estatı́stica 42

plot(freq, axes=T, type="b", xlab="", ylab="")

7
6
5
4

TA
3

U
2

IN

5 10 15 20
M

Exemplo 2.8.4. No Software . Gráfico de histograma com polı́gono de frequência.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
#Frequência Absoluta

valor <- unique(sort(d))

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13])
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
Estatı́stica 43

fa <- c(fa_1, fa_2, fa_3, fa_4, fa_5, fa_6, fa_7)


freq <- cbind(valor, fa)

hist(d, breaks = 30, main="Histograma", axes=F, xlab="", ylab="")


axis(side=1, at=seq(1, 22, by=3))
axis(side=2, at=seq(0, 7, by=1))
lines(freq, type="b")

Histograma
7
6
5

TA
4

U
3

IN
2

M
1
0

1 4 7 10 13 16 19 22

Exemplo 2.8.5. No Software . Gráfico de histograma com polı́gono de frequência, exemplo com
a função [Link] do pacote arm.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
#Frequência Absoluta

valor <- unique(sort(d))


Estatı́stica 44

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13])
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
fa <- c(fa_1, fa_2, fa_3, fa_4, fa_5, fa_6, fa_7)
freq <- cbind(valor, fa)
suppressWarnings(suppressMessages(library("arm")))
[Link](d, freq=TRUE, xlab="", [Link]=0.8)
lines(freq, type="b", lwd=3)
7

TA
6

U
5

IN
4
Count

M
3 2
1
0

1 5 9 13 18 22

Exemplo 2.8.6. No Software . Gráfico distribuição de frequência acumulada.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
Estatı́stica 45

par(mar = c(3,2,1,1))

#Distribuição frequência Acumulada


hist_info <- hist(d, main="Histograma", xlab="", ylab="")

Histograma
8
6
4

TA
U
2

IN
0

0 5 10 15 20 25

hist_info$counts <- cumsum(hist_info$counts)


plot(hist_info, col="gray", main="F. Acumulada", xlab="", ylab="")
Estatı́stica 46

F. Acumulada

25
20
15
10
5

TA
0

0 5 10 15 20 25
IN

Exemplo 2.8.7. No Software . Gráfico polı́gono de frequência acumulada.


M

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
#Frequência Absoluta

valor <- unique(sort(d))

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13])
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
#Frequencia Absoluta Acumulada
Fa_1 <- fa_1
Estatı́stica 47

Fa_2 <- fa_1 + fa_2


Fa_3 <- fa_1 + fa_2 + fa_3
Fa_4 <- fa_1 + fa_2 + fa_3 + fa_4
Fa_5 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5
Fa_6 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6
Fa_7 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6 + fa_7
Fa <- c(Fa_1, Fa_2, Fa_3, Fa_4, Fa_5, Fa_6, Fa_7)

freq_acum <- cbind(valor, Fa)


plot(freq_acum, type="b", xlab="", ylab="")
25
20

TA
U
15

IN
10

M
5

5 10 15 20

Exemplo 2.8.8. No Software . Gráfico de distribuição de frequência acumulada com polı́gono


de frequência acumulada, exemplo com a função [Link] do pacote arm.

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
par(mar = c(3,2,1,1))
#Frequência Absoluta
Estatı́stica 48

valor <- unique(sort(d))

fa_1 <- length(d[d == 1])


fa_2 <- length(d[d == 2])
fa_3 <- length(d[d == 5])
fa_4 <- length(d[d == 9])
fa_5 <- length(d[d == 13])
fa_6 <- length(d[d == 18])
fa_7 <- length(d[d == 22])
#Frequencia Absoluta Acumulada
Fa_1 <- fa_1
Fa_2 <- fa_1 + fa_2
Fa_3 <- fa_1 + fa_2 + fa_3
Fa_4 <- fa_1 + fa_2 + fa_3 + fa_4
Fa_5 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5
Fa_6 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6
Fa_7 <- fa_1 + fa_2 + fa_3 + fa_4 + fa_5 + fa_6 + fa_7
TA
Fa <- c(Fa_1, Fa_2, Fa_3, Fa_4, Fa_5, Fa_6, Fa_7)

freq <- cbind(valor, Fa)


suppressWarnings(suppressMessages(library("arm")))
U
[Link](valor, Fa, freq=TRUE, xlab="", [Link]=0.8)
lines(freq, type="b", lwd=3)
IN
M
Estatı́stica 49

25
2015
Count
10

TA
5

U
0

1 5 9 13 18 22
IN

Exemplo 2.8.9. No Software . Gráfico histograma com a função hist sem e com ajuste de classes
M

d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))

info_hist <- hist(d, main = "Histograma")


Estatı́stica 50

Histograma

15
10
5

TA
0

5 10 15 20 25 30
IN
M

info_hist$breaks <- c(7.7, 11.62, 15.54, 19.46, 23.38, 27.30)


info_hist$counts <- c(1, 10, 12, 5, 2)
plot(info_hist, axes=F, main="Histograma - Ajuste", col="gray")
axis(side=1, at=seq(min(d), max(d), [Link]=6))
axis(side=2, at=seq(0, 12, by=2))
Estatı́stica 51

Histograma − Ajuste

12
10
8
6
4
2

TA
0

7.70 11.62 15.54 19.46 23.38 27.30


IN

Exemplo 2.8.10. No Software . Gráfico histograma com polı́gono de frequência.


M

d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))
info_hist <- hist(d, main = "Histograma")
lines(info_hist$mids, info_hist$counts, type="b")
Estatı́stica 52

Histograma

15
10
5

TA
0

5 10 15 20 25 30
IN
M

info_hist$breaks <- c(7.7, 11.62, 15.54, 19.46, 23.38, 27.30)


info_hist$counts <- c(1, 10, 12, 5, 2)
info_hist$mids <- c(9.66, 13.58, 17.5, 21.42, 25.34)

plot(info_hist, axes=F, main="", col="gray")


axis(side=1, at=seq(min(d), max(d), [Link]=6))
axis(side=2, at=seq(0, max(info_hist$counts), by=2))
lines(info_hist$mids, info_hist$counts, type="b")
Estatı́stica 53

12
10
8
6
4
2

TA
0

7.70 11.62 15.54 19.46 23.38 27.30


IN

Exemplo 2.8.11. No Software . Gráfico distribuição de frequência acumulada com polı́gono de


M

frequência, sem e com ajuste de classes.

d <- c(13.9, 27.3, 16.5, 21.0, 21.9, 15.2, 7.7, 12.4, 19.3,
15.3, 18.6, 26.5, 16.3, 16.5, 16.8, 12.6, 16.1, 19.5,
19.1, 18.1, 20.9, 18.1, 11.9, 16.0, 17.3, 12.3, 13.1,
15.0, 20.2, 15.4)
par(mar = c(3,2,1,1))

#Distribuição frequência Acumulada


info_hist <- hist(d, main="Histograma", xlab="", ylab="")
Estatı́stica 54

Histograma

15
10
5

TA
0

5 10 15 20 25 30
IN
M

info_hist$counts <- cumsum(info_hist$counts)


plot(info_hist, col="gray", main="F. Acumulada", xlab="", ylab="")

lines(info_hist$mids, info_hist$counts, type="b")


Estatı́stica 55

F. Acumulada

30
25
20
15
10
5

TA
0

5 10 15 20 25 30
IN
M

info_hist$breaks <- c(7.7, 11.62, 15.54, 19.46, 23.38, 27.30)


info_hist$counts <- cumsum(c(1, 10, 12, 5, 2))
info_hist$mids <- c(9.66, 13.58, 17.5, 21.42, 25.34)
plot(info_hist, axes=F, main="F. Acumulada - Ajuste", col="gray")
axis(side=1, at=seq(min(d), max(d), [Link]=6))
axis(side=2, at=seq(0, 30, by=3))

lines(info_hist$mids, info_hist$counts, type="b")


Estatı́stica 56

F. Acumulada − Ajuste

30
27
24
21
18
15
12
9
6

TA
3
0

7.70 11.62 15.54 19.46 23.38 27.30


IN
M

Exemplo 2.8.12. No Software . Gráfico de barras verticais para os dados de produção mensal.

d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")

# Grafico de Barras Vertical


barplot(d,[Link]=meses, ylim=c(0,60), xlab="Mês",
ylab="Produção",col="darkgreen",main="Grafico de Barras",
border="black")
Estatı́stica 57

Grafico de Barras
60
50
40
Produção

30
20
10

TA
0

Jan Fev Mar Abr Mai Jun Jul Ago Set Out Nov Dez
U
Mês
IN

Exemplo 2.8.13. No Software . Gráfico de barras horizontais para os dados de produção


mensal.
M

d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")

# Grafico de Barras Horizontal


barplot(d,[Link]=meses, xlim=c(0,60), xlab="Produção",
ylab="Mês",col="darkgreen",main="Grafico de Barras",
border="black", horiz = TRUE)
Estatı́stica 58

Grafico de Barras
Dez
Nov
Out
Set
Ago
Jul

TA
Mês

Jun

U
Mai

IN
Abr

M
Mar
Fev
Jan

0 10 20 30 40 50 60

Produção

Exemplo 2.8.14. No Software . Gráfico de barras verticais para os dados de produção mensal,
considerando 4 regiões.
Estatı́stica 59

d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)

meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",


"Ago","Set","Out","Nov", "Dez")
cores <- c("blue", "orange", "darkgreen", "brown")
regioes <- c("A", "B", "C", "D")

barplot(d_matriz,[Link]=meses, xlab="Mês",
ylab="Produção",col=cores,main="Grafico de Barras",
border="black")
#Legenda
legend("topleft", regioes, cex = 1.3, fill = cores)
TA
Grafico de Barras
U
200

A
B
IN

C
D
150

M
Produção

100
50
0

Jan Fev Mar Abr Mai Jun Jul Ago Set Out Nov Dez

Mês
Estatı́stica 60

Exemplo 2.8.15. No Software . Gráfico de barras verticais para os dados de produção mensal,
considerando 4 regiões.

d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)

meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",


"Ago","Set","Out","Nov", "Dez")
cores <- c("blue", "orange", "darkgreen", "brown")
regioes <- c("A", "B", "C", "D")

barplot(d_matriz,[Link]=meses, xlab="Produção",
ylab="Mês",col=cores,main="Grafico de Barras",
border="black", horiz=TRUE)
#Legenda
TA
legend("topright", regioes, cex = 1.3, fill = cores)
U
IN
M
Estatı́stica 61

Grafico de Barras

A
Dez

B
C
Nov

D
Out
Set
Ago
Jul

TA
Mês

Jun

U
Mai

IN
Abr

M
Mar
Fev
Jan

0 50 100 150 200

Produção

Exemplo 2.8.16. No Software . Gráfico de pizza (ou setores) para os dados de produção mensal.
Estatı́stica 62

d <- c(8,10,18,7,29,47,55,38,27,15,11,21)
meses <- c("Jan","Fev","Mar","Abr","Mai","Jun","Jul",
"Ago","Set","Out","Nov", "Dez")
par(mar = c(0,0,2,0))
# Grafico de Pizza (ou Setores) - Rótulo
pie(d, labels = meses, main="Gráfico de Setores",
col=rainbow(12))

Gráfico de Setores

Mai
Jun
Abr

Mar
TA
Fev

Jan
U
Jul
IN

Dez
M

Nov

Out
Ago
Set

# Grafico de Pizza (ou Setores) - Rótulo Porcentagem


pie(d, labels = paste0(signif(d*100/sum(d), digits=3), "%"),
main="Gráfico de Setores", col=rainbow(12))
Estatı́stica 63

Gráfico de Setores

10.1%
16.4%
2.45%

6.29%

3.5%

2.8%
19.2%
7.34%
TA 3.85%

5.24%
U
13.3%
9.44%
IN
M

# Grafico de Pizza (ou Setores) 3D - Rótulo


suppressWarnings(suppressMessages(library("plotrix")))
pie3D(d,labels=meses,explode=0.1, main="Gráfico de Setores 3D")
Estatı́stica 64

Gráfico de Setores 3D

Jun Mai
Abr
Mar
Fev
Jul Jan
Dez
Nov
Ago Out
TA Set
U
IN
M

# Grafico de Pizza (ou Setores) 3D - Rótulo Porcentagem


pie3D(d,labels=paste0(signif(d*100/sum(d), digits=3), "%"),explode=0.1,
main="Gráfico de Setores 3D")
Estatı́stica 65

Gráfico de Setores 3D

16.4% 10.1%
2.45%
6.29%
3.5%
19.2% 2.8%
7.34%
3.85%
13.3% 5.24%
TA 9.44%
U
IN

Exemplo 2.8.17. No Software . Gráfico dotplot.


M

d <- c(5, 9, 18, 5, 9, 18, 5, 9, 18, 5,


9, 18, 2, 9, 22, 2, 9, 22, 2, 13,
22, 1, 13, 18, 1, 13, 9)
dotchart(d, xlim=c(0,25), main="Gráfico dotplot",)
Estatı́stica 66

Gráfico dotplot

TA
0 5 10 15 20 25
U
IN
M

#Ajuste nos eixos - quando necessário


#dotchart(d, xlim=c(0,25), xaxt="n")
#axis(side=1, at=seq(0, 25, by=1))

Exemplo 2.8.18. No Software . Gráfico dotplot.

d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")
dotchart(t(d_matriz)[,1:2], main="Gráfico dotplot",
cex=0.8, xlim=c(0,65))
Estatı́stica 67

Gráfico dotplot

A
12
11
10
9
8
7
6
5
4
3
2
1
B
12
11
10
9
8
7
6
5
4
3
TA
2
1
U
0 10 20 30 40 50 60
IN

Exemplo 2.8.19. No Software . Gráfico de séries temporais.


M

d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")
plot(d_matriz[1,], type="b", col="blue",
xlim=c(0,13), ylim=c(0,60), xlab="Meses", ylab="Valores")
Estatı́stica 68

60
50
40
Valores

30
20
10

TA
0

0 2 4 6 8 10 12
U

Meses
IN

Exemplo 2.8.20. No Software . Gráfico de séries temporais.


M

d <- c(8,10,18,7,29,47,55,38,27,15,11,21,
7,8,13,8,22,36,45,37,26,17,14,23,
15,11,12,21,29,33,60,31,22,16,11,17,
2,3,8,7,31,41,51,34,25,15,13,24)
d_matriz <- matrix(d, nrow=4, ncol=12, byrow=TRUE)
rownames(d_matriz) <- c("A", "B", "C", "D")

plot(d_matriz[1,], type="b", col="blue",


xlim=c(0,13), ylim=c(0,60), xlab="Meses", ylab="Valores")
lines(d_matriz[2,], type="b", col="red")
lines(d_matriz[3,], type="b", col="darkgreen")
lines(d_matriz[4,], type="b", col="orange")
regioes <- c("A", "B", "C", "D")
legend("topright", regioes, cex = 1.3, fill = cores)
Estatı́stica 69

60
A
50
B
C
D
40
Valores

30
20
10

TA
0

0 2 4 6 8 10 12
U

Meses
IN

Exemplo 2.8.21. No Software . Gráfico de dispersão.


M

library(MASS)
data(ChickWeight)

x1 <- ChickWeight[1:12, 2]
y1 <- ChickWeight[1:12, 1]

plot(x1, y1, xlab = "Tempo", ylab = "Peso", col="blue")


Estatı́stica 70

200
150
Peso

100

TA
50

0 5 10 15 20
U

Tempo
IN

Exemplo 2.8.22. No Software . Gráfico de dispersão.


M

library(MASS)
data(ChickWeight)

x1 <- ChickWeight[1:12, 2]
y1 <- ChickWeight[1:12, 1]

x2 <- ChickWeight[13:24, 2]
y2 <- ChickWeight[13:24, 1]

plot(x1, y1, xlab = "Tempo", ylab = "Peso", col="blue")


points(x2, y2, xlab = "Tempo", ylab = "Peso", col="red")
regioes <- c("Unidade 1", "Unidade 2")
cores <- c("blue", "red")
legend("topleft", regioes, cex = 1.3, fill = cores)
Estatı́stica 71

200
Unidade 1
150
Unidade 2
Peso

100

TA
50

U
0 5 10 15 20
IN

Tempo
M

2.9 Exercı́cios
1. Considera os dados da tabela abaixo:

Tabela 2.23: Dados do exercı́cio.

2.6 2.3 8.0 10.4


15.4 5.8 -0.3 -2.5
1.6 4.4 -3.3 2.7
8.8 1.7 5.7 -1.5
5.4 4.6 3.9 1.3
-1.0 1.6 3.6 4.1
2.6 -3.7 3.4 1.5
0.5 2.7 6.8 3.5

1. Determine a variância, desvio padrão.


2. Determine e interprete o coeficiente de variação.
Estatı́stica 72

3. Calcular os quartis Q1 , Q2 e Q3 .
4. Construir o gráfico de boxplot.

2. Considere os dados da tabela abaixo:

Tabela 2.24: Dados do exercı́cio.

26 49 36 14
24 6 49 22
46 10 16 25
28 31 26 14
18 14 29 42

1. Determine o coeficiente de assimetria de Pearson As2 .


2. Determine o coeficiente quartı́lico de assimetria.
3. Determine o coeficiente de momento de assimetria As1 .
TA
4. Interprete os coeficientes de assimetria obtidos.

3. Considere os dados da tabela abaixo:


U
Tabela 2.25: Dados do exercı́cio.
IN

5 8 13 16
19 9 13 9
M

12 33 29 42
27 30 31 4
37 2 48 30

1. Determine o coeficiente quartı́lico de assimetria.


2. Determine os percentis P10 e P90 .
3. Calcule e interprete o coeficiente curtose K1 .
4. Determine os momentos centrados na média de ordem 2 (m2 ) e de ordem 4 (m4 ).
5. Calcule e interprete o coeficiente curtose K2 .

4. Considere os dados da tabela abaixo:


Estatı́stica 73

Tabela 2.26: Dados do exercı́cio.

-0.9 -2.7 -0.8 3.9


2.0 -0.5 3.5 0.4
-0.1 6.3 6.8 4.4
1.3 0.8 0.9 -2.0
6.9 5.3 4.1 5.0
-2.9 6.5 2.6 1.5
5.1 0.7 6.9 4.1
4.1 2.2 10.9 9.9

1. Construir a tabela de distribuição de frequências para dados agrupados.


2. Construir o gráfico de histograma.
3. Construir o gráfico de distribuição acumulada.
TA
U
IN
M
Estatı́stica 74

3 Amostragem
3.1 Conceitos
O número de objetos (ou indivı́duos) em uma população será indicado por N , e o número de
objetos (ou indivı́duos) de uma amostra será indicado por n. Em amostragem é comum surgir os
seguinte problemas: Como coletar a amostra? Quanto vale n? Qual técnica de amostragem a ser
utilizada?
A estimativa é fundamental em Estatı́stica, isto é, em uma pesquisa muitas vezes há a necessi-
dade de se fazer previsões. Em quase todos os casos, a estimativa está associada a uma pesquisa
ou a uma verificação de caracterı́sticas, realizada em uma parte da população (amostra), pois os
custos podem ser proibitivos de se realizar em toda a população (censo). Assim, um dos objetivos
da estatı́stica é tirar conclusões sobre o “todo” (população) a partir das informações fornecidas por
“parte representativa” do todo (amostra).
A maneira de se escolher os elementos para compor uma amostra é denominada Amostragem.
Como as conclusões relativas à população vão estar baseadas nos resultados obtidos nas amostras
dessa população, vemos o quão importante é a fase de coleta dos dados (amostragem). Se erros
forem cometidos no momento de selecionarmos os elementos da amostra o trabalho fica compro-
TA
metido e os resultados finais serão provavelmente incorretos.
Dessa forma, é necessário garantir que a amostra seja representativa da população. Exceto por
discrepâncias inerentes a aleatoriedade a amostra deve possuir as mesmas caracterı́sticas básicas
da população no que diz respeito à(s) variável(eis) que desejamos pesquisar. Algums vantagens da
U
amostragem são: menor custo, menor tempo, logı́stica, maior amplitude do universo, menor erro
da medida.
IN

3.2 Tamanho da Amostra


M

No caso de não conhecer o comportamento do ponto de vista da distribuição de probabilidade


da população, o tamanho da amostra pode ser obtido pela fórmula de Slovin:
N
n=
1 + N · e2
em que n é o tamanho da amostra, N é o tamanho da população, e é o erro amostral que pode ser
tolerado.

Exemplo 3.2.1. Considere uma população com N = 340. Determine o tamanho da amostra para
um erro amostral e = 5%.

Solução

1. Como N = 340 e e = 5% = 0, 05, se tem que:


N 340
n= 2
= ≈ 183, 78 ≈ 184
1+N ·e 1 + 340 · 0, 052

2. ∴ n = 184
Estatı́stica 75

Exemplo 3.2.2. No Software .

options(digits=6)
N <- 340
e <- 5/100
n <- N/(1 + N * eˆ2)
n

## [1] 183.784

round(n)

## [1] 184

#Com uma função


n_slovin <- function(N, e){
n <- N/(1 + N * (e/100)ˆ2)
round(n)
}
n_slovin(340, 5)
TA
## [1] 184
U

Se for possı́vel supor que a população possui distribuição normal de probabilidade com média
IN

µ e desvio padrão σ, o tamanho da amostra pode ser obtida como:

σ 2 · Zα/2
2
n=
M

e2
em que Zα/2 é o valor da tabela normal padronizada Z com nı́vel de significância α e nı́vel de
confiança (1 − α), σ é o desvio padrão da população e e é o erro amostral máximo tolerado.
Exemplo 3.2.3. Considere uma população com desvio padrão σ = 0, 4 Determine o tamanho da
amostra, com significância α = 5% e um erro amostral e = 10%.
Solução
1. Como σ = 0, 4 ⇒ σ 2 = 0, 16, sendo e = 10% = 0, 1.
2. Zα/2 são valores obtidos da tabela normal padronizada Z (Seção 13).
3. Como α = 5% de significância corresponde a
(1 − 5%) = (1 − 0, 05) = 0, 95
de confiança. O valor 0,95 corresponde a uma área, delimitada pelo eixo x, pela curva
normal e pelas retas x = 0 e x = Zα/2 . Como a curva da distribuição normal é simétrica,
se tem que essa área é dividida em duas, ou seja, 0, 95/2 = 0, 475. Logo,
Zα/2 = Z5%/2 = ±1, 96
Estatı́stica 76

dessa forma se obtém a área de 0,475 que corresponde a probabilidade P (0 < Z < Zα/2 ),
que será abordada com mais detalhes nas seções a seguir.
4. Assim, o valor de n pode ser obtido como:
σ 2 · Zα2 0, 42 · 1, 962
n= = ≈ 61, 465 ≈ 61
e2 0, 12

5. ∴ n = 615
Exemplo 3.2.4. No Software .

options(digits=6)
sigma <- 0.4
e <- 0.1
alpha <- 5/100
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
n <- (sigmaˆ2 * Z_alphaˆ2)/eˆ2
n TA
## [1] 61.4633

round(n)
U
## [1] 61
IN

#Com uma função


n_normal <- function(sigma, e, alpha){
M

alpha <- 5/100


Z_alpha <- qnorm(alpha/2,
mean = 0, sd = 1,
[Link] = FALSE)
n <- (sigmaˆ2 * Z_alphaˆ2)/eˆ2
round(n)
}

n_normal(0.4, 0.1, 5/100)

## [1] 61

No caso de proporção, a variância da população pode ser estimada por σ 2 = p · (1 − p), e o


tamanho da amostra pode se obtida por:
2
p · (1 − p) · Zα/2
n=
e2
cf casos favoráveis
em que p = = .
ct casos totais
Estatı́stica 77

Exemplo 3.2.5. Em uma pesquisa se tem 300 pessoas favoráveis a escolha do produto A e 152
contrárias. Determinar a proporção p e o tamanho da amostra n com significância α = 5% e um
erro amostral e = 2%.

Solução

1. Como x = 300 e t = 300 + 152 = 452, segue que


300
p= ≈ 0, 664
452

2. De forma que q = 1 − p = 1 − 0, 664 = 0, 336

3. Como e = 2% = 0, 02 e Zα/2 = 1, 96, se tem:

2
p · (1 − p) · Zα/2 0, 664 · 0, 336 · 1, 962
n= = = 2.142, 690 ≈ 2.143
e2 0, 022
4. ∴ n = 2.143 TA
Exemplo 3.2.6. No Software .

options(digits=6)
U
cf <- 300
cc <- 152
IN

ct <- cf + cc

p <- cf/ct
M

q <- 1- p
e <- 0.02
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)

n <- (p * q * Z_alphaˆ2)/eˆ2
n

## [1] 2143.5

round(n)

## [1] 2144

#Com uma função

n_propor <- function(cf, ct, e, alpha){


p <- cf/ct
q <- 1 - p
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
Estatı́stica 78

n <- (p * q * Z_alphaˆ2)/eˆ2
round(n)

n_propor(300, 452, 2/100, 5/100)

## [1] 2144

No caso de uma população pequena (finita) e a amostragem for sem reposição é necessário
corrigir o tamanho da amostra, que pode ser feito com a expressão:
1
n= 2
e 1
2
+
Zα/2 · σ2 N

Exemplo 3.2.7. Considere uma população finita (N = 60), sendo realizada uma amostragem sem
reposição. Determine o tamanho da amostra, com significância α = 5%, erro amostral e = 10%
TA
e com desvio padrão σ = 0, 4.

Solução
U
1. Como σ = 0, 4 ⇒ σ 2 = 0, 16, sendo e = 10% = 0, 1.
IN

2. Para α = 5%, se tem que:


Zα/2 = Z5%/2 = ±1, 96
M

3. Assim, o valor de n pode ser obtido como:


1 1
n= 2 = 2 = 30, 361 ≈ 30
e 1 0, 1 1
2 2
+ 2 2
+
Zα/2 · σ N 1, 96 · 0, 4 60

4. ∴ n = 30

Exemplo 3.2.8. No Software .

options(digits=6)
N <- 60
sigma <- 0.4
e <- 0.1
alpha <- 5/100
Z_alpha <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
n <- 1/(eˆ2/(Z_alphaˆ2 * sigmaˆ2) + 1/N)
n
Estatı́stica 79

## [1] 30.3614

round(n)

## [1] 30

#Com uma função


n_normal_finita <- function(N, sigma, e, alpha){
Z_alpha <- qnorm(alpha/2,
mean = 0, sd = 1,
[Link] = FALSE)
n <- 1/(eˆ2/(Z_alphaˆ2 * sigmaˆ2) + 1/N)
n
round(n)
}

n_normal_finita(60, 0.4, 0.1, 5/100) TA


## [1] 30
U
3.3 Amostragem Casual Simples
É a amostragem em que se pressupõe que todo o elemento da população tem a mesma proba-
IN

bilidade de ser incluı́do na amostra extraı́da.


Uma das formas pelas quais se pode executar este tipo de amostragem é atribuindo a cada ele-
mento da população um número distinto e efetuando sucessivos sorteios ate completar o tamanho
M

da amostra.
Algumas caracterı́sticas da amostragem simples aleatória são: é equivalente a um sorteio de
loteria, considera a população homogênea, cada elemento da população (unidade experimental)
tem a mesma chance de ser escolhida, utilizam-se números aleatórios, programas computacionais,
calculadoras, bolinhas numeradas, etc.

3.3.1 Método de Escolha


1. Enumeramos a população 1, 2, . . . , N ;

2. Determinamos o tamanho da amostra n;

3. Sorteamos os elementos da amostra.

Exemplo 3.3.1. Considere a população com 60 objetos. Determine duas amostras de 10 objetos
cada pela técnica de amostragem simples aleatória.

Solução
Estatı́stica 80

1. A população deve ser enumerada com cada objeto recebendo um número de 1 a 60.
2. Como n = 10, basta sortear dois grupos de 10 números para compor a amostra.
3. Grupo 1: 2, 5, 20, 19, 52, 31, 45, 29, 11, 48.
4. Grupo 2: 55, 2, 4, 7, 8, 14, 25, 33, 28, 51.
Exemplo 3.3.2. No Software .

options(digits=6)
N <- 60
n <- 10
simples_casual_1 <- round(runif(n, min=1, max=N))
simples_casual_1

## [1] 19 6 7 58 10 9 15 39 38 23

simples_casual_2 <- round(runif(n, min=1, max=N))


simples_casual_2 TA
## [1] 53 31 9 3 13 6 49 1 29 40

#Com uma função


U
simples_casual <- function(N, n){
IN

round(runif(n, min=1, max=N))


}
simples_casual(60, 10)
M

## [1] 60 53 30 12 54 1 51 47 17 21

3.4 Amostragem por Estratato


Muitas vezes a população se divide, em subpopulações ou estratos, nesse caso podemos, supor
que, de estrato para estrato, a variável de interesse apresente um comportamento substancialmente
diverso, tendo, porém, comportamento razoavelmente homogêneo dentro de cada estrato.
A amostragem estratificada consiste em especificar quantos elementos da amostra serão reti-
rados em cada estrato. É costume considerar três tipos de amostragem estratificada: uniforme,
proporcional e ótima.
Na amostragem estratificada uniforme: sorteia-se igualmente o número de elementos em cada
estrato. Na proporcional o número de elementos sorteados em cada estrato é proporcional ao
número de elementos existentes no estrato. A Amostragem estratificada ótima por sua vez toma
em cada estrato: um número de elementos proporcional ao número de elementos do estrato e; a
variação da variável de interesse no estrato, medida pelo seu desvio padrão.
Assim, essa amostragem é utilizada quando existir diferenças (população heterogênea) entre
diversas partes da população. Essas diferenças denominarão os estratos.
Estatı́stica 81

3.4.1 Método de Escolha


1. Determinamos o tamanho da população N ;

2. Definimos:
Ne
We =
N
em que N é o tamanho da população; Ne é o tamanho do estrato; We é a proporção de cada
estrato.

3. Definimos
ne = n · We
em que: e = 1, 2, . . . , E com E número de estratos; n é o tamanho da amostra; PEne é o
tamanho da amostra por estrato; We é a proporção da população por estrato; N = e=1 Ne .

Exemplo 3.4.1. Determine o tamanho da amostra por estrato, para uma amostra n = 60. Nessa
população se tem que o número de casados é 210, solteiro é 50 e outro é 40.

Solução
TA
1. Os tamanhos dos estratos são: Ne1 = 210, Ne2 = 50 e Ne3 = 40 informados no enunciado.

2. População N = Ne1 + Ne2 + Ne3 = 210 + 50 + 40 = 300


U
3. O tamanho da amostra n = 60 informado no enunciado.
IN

4. A proporção dos estratos são:


Ne1 210 21
(a) W1 = = =
M

N 300 30
Ne2 50 5
(b) W2 = = =
N 300 30
Ne3 40 4
(c) W3 = = =
N 300 30
5. O tamanho da amostra por estrato são:
21
(a) n1 = W1 · n = · 60 = 42
30
5
(b) n2 = W2 · n = · 60 = 10
30
4
(c) n3 = W3 · n = · 60 = 8
30
Exemplo 3.4.2. No Software .
Estatı́stica 82

options(digits=6)
Ne1 <- 210
Ne2 <- 50
Ne3 <- 40
N <- Ne1 + Ne2 + Ne3
n <- 60
#Proporção dos estratos
W1 <- Ne1/N
W2 <- Ne2/N
W3 <- Ne3/N
#Tamanho da amostra por estrato
n1 <- W1 * n
n2 <- W2 * n
n3 <- W3 * n
c(n1, n2, n3)

## [1] 42 10 8

#Com uma função - para 3 estratos


TA
amostra3estratos <- function(n, Ne1, Ne2, Ne3){
#Tamanho da população e amostra
U
N <- Ne1 + Ne2 + Ne3
n <- 60
IN

#Proporção dos estratos


W1 <- Ne1/N; W2 <- Ne2/N; W3 <- Ne3/N
#Tamanho da amostra por estrato
M

n1 <- W1 * n; n2 <- W2 * n; n3 <- W3 * n


round(c(n1, n2, n3))
}
amostra3estratos(60, 210, 50, 40)

## [1] 42 10 8

amostra3estratos(60, 20, 50, 40)

## [1] 11 27 22

3.5 Amostragem por Conglomerados


Quando a população apresenta uma subdivisão em pequenos grupos, chamados de conglo-
merados é possı́vel e muitas vezes conveniente fazer-se a amostragem por meio de conglomerado.
Consiste em sortear um número suficiente de conglomerados, cujos elementos constituirão a amos-
tra.
As unidades de amostragem, sobre as quais é feito o sorteio, passam a ser os conglomerados e
Estatı́stica 83

não mais os elementos individuais da população. É utilizada quando a população pode ser dividida
em pequenos grupos, chamados conglomerados. Essa amostragem é de fácil escolha da amostra.

Exemplo 3.5.1. Considere a população dividida em 80 grupos homogêneos. Determine uma


amostra com 15 grupos pela técnica de amostragem por conglomerados.

Solução

1. Os grupos devem ser enumerados, sendo que cada grupo recebe um número de 1 a 80.

2. Como n = 15, basta sortear 15 grupos para compor a amostra.

3. Grupo 1: 8, 14, 25, 33, 28, 52, 31, 45, 29, 11, 48, 55, 2, 4, 7

Exemplo 3.5.2. No Software .

options(digits=6)
N <- 80
n <- 15 TA
amostra_cong <- round(runif(n, min=1, max=N))
amostra_cong

## [1] 23 65 40 55 45 18 49 53 54 68 68 3 15 18 78
U
#Com uma função
IN

amostra_cong <- function(N, n){


round(runif(n, min=1, max=N))
}
M

amostra_cong(80, 15)

## [1] 31 24 54 78 68 18 36 31 5 15 40 27 71 66 11

3.6 Amostragem Sistemática


Quando os elementos da população se apresentam ordenados e a retirada dos elementos da
amostra é feita periodicamente, temos uma amostragem sistemática.
Assim por exemplo em uma linha de produção, podemos a cada dez itens produzidos, retirar
um para pertencer a uma amostra da produção diária.
A principal vantagem da amostragem sistemática está na grande facilidade na determinação
dos elementos da amostra.
Se a ordem dos elementos na população não tiver qualquer relacionamento com a variável de
interesse, então a amostragem sistemática terá efeitos equivalentes a casual simples, podendo ser
utilizada sem restrições.
Algumas das vantagens da amostragem sistemática são: fácil escolha da amostra, mais precisa
que a Amostragem Simples Aleatória, é tão preciso quanto a amostragem estratificada.
Estatı́stica 84

3.6.1 Método de Escolha


1. Define-se o tamanho da população e o tamanho da amostra

2. Determina-se a proporção K entre população e amostra:


N
k=
n

3. Escolhe-se um número aleatoriamente menor ou igual a K, suponhamos a ≤ K. A amostra


sistemática será:
a, a + k, a + 2k, . . . , a + (n − 1)k

Exemplo 3.6.1. Considere uma população com N = 90. Determine uma amostra com 25 elemen-
tos pela técnica de amostragem sistemática.

Solução

1. Como N = 90 e n = 25, se tem que: TAN 90


K= = = 3, 6 ≈ 3
n 25

2. Devemos tomar a ≤ K. Seja a = 2.


U

3. A amostra será formada pelos elementos do conjunto:


IN

{a, a + k, a + 2k, . . . , a + (n − 1)k}


M

{2, 2 + 3, 2 + 2 · 3, . . . , 2 + (25 − 1) · 3} = {2, 5, 8, . . . , 74}

Exemplo 3.6.2. No Software .

options(digits=6)
N <- 90
n <- 25
k <- floor(N/n)
a <- 2

amostra_sis <- seq(from = a, to = a + (n-1)*k, by = k)


amostra_sis[1:15]

## [1] 2 5 8 11 14 17 20 23 26 29 32 35 38 41 44

amostra_sis[16:25]

## [1] 47 50 53 56 59 62 65 68 71 74
Estatı́stica 85

#Com uma função


amostra_sistematica <- function(N, n, a){
k <- floor(N/n)
seq(from = a, to = a + (n-1)*k, by = k)
}

amostra_sistematica(90, 25, 2)[1:15]

## [1] 2 5 8 11 14 17 20 23 26 29 32 35 38 41 44

amostra_sistematica(90, 25, 2)[16:25]

## [1] 47 50 53 56 59 62 65 68 71 74

No contexto da amostragem figuram também amostragens não probabilı́sticas, algumas des-


sas amostragens são:
TA
1. Amostragem Intencional É uma amostragem não probabilı́stica e consiste em selecionar
um subgrupo de população que, com base nas informações disponı́veis, possa ser conside-
rado representativo, de toda a população.
A amostragem intencional não é considerada um bom método, pois os dados podem ser fa-
U
cilmente manipulados, direcionados aos interesses do pesquisador ou de quem encomendou
a pesquisa.
IN

2. Amostragem a Esmo É a amostragem em que o “amostrador”, para simplificar o processo,


procura ser aleatório sem, no entanto realizar propriamente o sorteio usando algum disposi-
M

tivo aleatório confiável. Os resultados da amostragem a esmo são em geral equivalentes aos
de uma amostragem probabilı́stica se a população é homogênea e se não existe a possibi-
lidade de o “amostrador” ser inconscientemente influenciado por alguma caracterı́stica dos
elementos da população.

3.7 Exercı́cios
1. Considere uma população com N = 650. Determine o tamanho da amostra para um erro
amostral e = 10%.
2. Considere uma população com desvio padrão σ = 0, 7 Determine o tamanho da amostra, com
significância α = 5% e um erro amostral e = 13%.
3. Em uma pesquisa se tem 630 pessoas favoráveis a escolha do produto A e 352 contrárias.
Determinar a proporção p e o tamanho da amostra n com significância α = 5% e um erro
amostral e = 6%.
4. Considere uma população finita (N = 90), sendo realizada uma amostragem sem reposição.
Determine o tamanho da amostra, com significância α = 5%, erro amostral e = 8% e com
desvio padrão σ = 1, 2.
Estatı́stica 86

5. Considere a população com 42 objetos. Determine uma amostra de 12 objetos pela técnica de
amostragem simples aleatória.

6. Determine o tamanho da amostra por estrato, para uma amostra n = 80. Nessa população se
tem que o número de casados é 420, solteiro é 120 e outro é 85.

7. Considere uma população com N = 36. Determine uma amostra com 11 elementos pela
técnica de amostragem sistemática.

TA
U
IN
M
Estatı́stica 87

4 Probabilidade
4.1 Espaço Amostral
Na natureza há dois tipos de fenômenos os Determinı́sticos, cujo resultados são os mesmos não
importando quantas vezes se repete o experimento e os Aleatórios, cujos resultados são, em geral,
distintos a cada repetição do experimento. Os Experimentos Aleatórios são conduzidos pelo ho-
mem com o intuito de estudar um fenômeno. O resultado de um experimento aleatório é chamado
de Evento Aleatório, sendo que o conjunto de todos os resultados do experimento aleatório será
denominado de Espaço Amostral do experimento aleatório. Os elementos do espaço amostral são
também chamados de pontos amostrais. O espaço amostral é representado pela letra Ω.

Exemplo 4.1.1. Enumerar os espaços amostrais dos seguintes Experimentos Aleatórios:


1. Lançamento de uma moeda honesta.
2. Lançamento de um dado.
3. Retirada de uma carta de um baralho.
TA
4. Lançamento de duas moedas.
5. Determinação da vida útil de um componente eletrônico.
U
Solução
IN

1. Ω = {c, r}
2. Ω = {1, 2, 3, 4, 5, 6}
M

3. Ω = {Ao , . . . , Ro , Ap , . . . , Rp , Ac , . . . , Ac , Ae , . . . , Re }
4. Ω = {(c, c), (c, r), (r, c), (r, r)}
5. Ω = {t ∈ R/t ≥ 0}

Exemplo 4.1.2. No lançamento de dois dados, enumerar os seguintes eventos:


1. A: saı́da de faces iguais.
2. B: saı́da de faces cuja soma seja 10.
3. C: saı́da de faces cuja soma seja menor que 2.
4. D: saı́da de faces cuja soma seja menor que 15.

Solução
Inicialmente, é necessário criar uma tabela de dupla entrada com o espaço amostral do
lançamento de dois dados. Esse espaço amostral pode também se representado por meio de
um Diagrama de Árvore.
Estatı́stica 88

D1\D2 1 2 3 4 5 6
1 (1,1) (1,2) (1,3) (1,4) (1,5) (1,6)
2 (2,1) (2,2) (2,3) (2,4) (2,5) (2,6)
3 (3,1) (3,2) (3,3) (3,4) (3,5) (3,6)
4 (4,1) (4,2) (4,3) (4,4) (4,5) (4,6)
5 (5,1) (5,2) (5,3) (5,4) (5,5) (5,6)
6 (6,1) (6,2) (6,3) (6,4) (6,5) (6,6)
Tabela 4.1: Tabela de dupla entrada com o espaço amostral do lançamento de dois dados.

1. A = {(1, 1), (2, 2), (3, 3), (4, 4), (5, 5), (6, 6)}

2. A = {(4, 6), (5, 5), (6, 4)}

3. C = { } ou ϕ evento impossı́vel.

4. D = Ω ou D = espaço amostral evento certo

Exemplo 4.1.3. No Software .


TA
options(digits=6)
U
x<- c(1:6)
y<- c(1:6)
[Link](x, y)
IN

## Var1 Var2
## 1 1 1
M

## 2 2 1
## 3 3 1
## 4 4 1
## 5 5 1
## 6 6 1
## 7 1 2
## 8 2 2
## 9 3 2
## 10 4 2
## 11 5 2
## 12 6 2
## 13 1 3
## 14 2 3
## 15 3 3
## 16 4 3
## 17 5 3
## 18 6 3
## 19 1 4
Estatı́stica 89

## 20 2 4
## 21 3 4
## 22 4 4
## 23 5 4
## 24 6 4
## 25 1 5
## 26 2 5
## 27 3 5
## 28 4 5
## 29 5 5
## 30 6 5
## 31 1 6
## 32 2 6
## 33 3 6
## 34 4 6
## 35 5 6
## 36 6 6 TA
#Solucao 1
subset([Link](x, y),
[Link](x, y)[,1] == [Link](x, y)[,2])
U
## Var1 Var2
IN

## 1 1 1
## 8 2 2
## 15 3 3
M

## 22 4 4
## 29 5 5
## 36 6 6

#Solucao 2
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2])==10)

## Var1 Var2
## 24 6 4
## 29 5 5
## 34 4 6

#Solucao 3
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2]) < 2)

## [1] Var1 Var2


## <0 rows> (or 0-length [Link])
Estatı́stica 90

#Solucao 4
subset([Link](x, y),
([Link](x, y)[,1] + [Link](x, y)[,2]) < 15)

## Var1 Var2
## 1 1 1
## 2 2 1
## 3 3 1
## 4 4 1
## 5 5 1
## 6 6 1
## 7 1 2
## 8 2 2
## 9 3 2
## 10 4 2
## 11 5 2
## 12 6 2
##
##
13
14
1
2
3
3
TA
## 15 3 3
## 16 4 3
U
## 17 5 3
## 18 6 3
IN

## 19 1 4
## 20 2 4
## 21 3 4
M

## 22 4 4
## 23 5 4
## 24 6 4
## 25 1 5
## 26 2 5
## 27 3 5
## 28 4 5
## 29 5 5
## 30 6 5
## 31 1 6
## 32 2 6
## 33 3 6
## 34 4 6
## 35 5 6
## 36 6 6
Estatı́stica 91

4.2 Classe dos Eventos Aleatórios


Definição 4.2.1. Classe dos eventos aleatórios é o conjunto formado por todos os eventos (sub-
conjuntos) do espaço amostral.
 o espaço amostral finito: Ω = {e1 , e2 , e3 , e4 }. A classe
Considerando  dos eventos aleatórios é:

 ϕ 

{e }, {e }, {e }, {e }
 
 1
 2 3 4


F (Ω) = {e1 , e2 }, {e1 , e3 }, {e1 , e4 }, {e2 , e3 }, {e2 , e4 }, {e3 , e4 }
{e1 , e2 , e3 }, {e1 , e2 , e4 }, {e1 , e3 , e4 }, {e2 , e3 , e4 }

 


 

{e1 , e2 , e3 , e4 }
 
Se um espaço amostral finito possui n pontos amostrais, o número de elementos (eventos) de
F (Ω) será indicado por n(F ) e obtido por n(F ) = 2n .
Exemplo 4.2.1. No Software .

suppressWarnings(suppressMessages(library("sets")))
library("sets")
#Conjunto com dois eventos.
eventos <- paste0("E", 1:2)
eventos
TA
## [1] "E1" "E2"
U
classe_eventos <- set_power(eventos)
classe_eventos
IN

## {{}, {"E1"}, {"E2"}, {"E1", "E2"}}


M

4.3 Operações com Eventos Aleatórios


Considerando o espaço amostral finito {e1 , e2 , e3 , . . . , en }. Sejam A e B dois eventos de F (Ω).
As seguintes operações são definidas:
Definição 4.3.1. A ∪ B = {ei ∈ Ω|ei ∈ A ou ei ∈ B}, i = 1, 2, . . . , n. O evento reunião é
formado pelos pontos amostrais que pertencem a pelo menos um dos eventos.

A B

Figura 4.1: Operação de União.

Definição 4.3.2. A ∩ B = {ei ∈ Ω|ei ∈ A e ei ∈ B}, i = 1, 2, . . . , n. O evento interseção é


formado pelos pontos amostrais que pertencem simultaneamente aos eventos A e B.
Se A ∩ B = ϕ, A e B são eventos mutuamente exclusivos.
Estatı́stica 92

A B

Figura 4.2: Operação de Interseção.

Definição 4.3.3. Ω − A = A = {ei ∈ Ω|ei ̸= A, }, i = 1, 2, . . . , n. O evento complementar é


formado pelos pontos amostrais do espaço amostral que não pertencem evento A.

TA
Figura 4.3: Operação de Complementação.

4.4 Propriedades das Operações


U
Sejam A, B e C eventos associados a um espaço amostral Ω. As seguinte propriedades das
operações são válidas:
IN

1. Idempotentes

(a) A ∩ A = A
M

(b) A ∪ A = A

2. Comutativas

(a) A ∪ B = B ∪ A
(b) A ∩ B = B ∩ A

3. Associativas

(a) A ∩ (B ∩ C) = (A ∩ B) ∩ C
(b) A ∪ (B ∪ C) = (A ∪ B) ∪ C

4. Distributivas

(a) A ∪ (B ∩ C) = (A ∪ B) ∩ (A ∪ C)
(b) A ∩ (B ∪ C) = (A ∩ B) ∪ (A ∩ C)

5. Absorções

(a) A ∪ (B ∩ B) = A
Estatı́stica 93

(b) A ∩ (B ∪ B) = A

6. Identidades

(a) A ∩ Ω = A
(b) A ∪ Ω = Ω
(c) A ∩ ϕ = ϕ
(d) A ∪ ϕ = A

7. Complementares

(a) Ω = ϕ
(b) ϕ = Ω
(c) A ∩ A = ϕ
(d) A ∪ A = Ω
(e) (A) = A TA
8. Leis das Dualidades (ou Leis de Morgan)

(a) (A ∩ B) = A ∪ B
(b) (A ∪ B) = A ∩ B
U

Exemplo 4.4.1. Lança-se um dado. Sejam A, saı́da de uma face par e B, saı́da de uma face menor
IN

que 4. Determinar os eventos:

1. A ∪ B
M

2. A ∩ B

3. A

4. B

5. A ∪ B

6. A ∩ B

Solução

O espaço amostral Ω = {1, 2, 3, 4, 5, 6}. O evento A = {2, 4, 6} e o evento B = {1, 2, 3}.

1. A ∪ B = {1, 2, 3, 4, 6}

2. A ∩ B = {2}

3. A = Ω − A = {ei ∈ Ω|ei ̸= A}, i = 1, . . . , n. Logo, A = {1, 3, 5}

4. B = {4, 5, 6}
Estatı́stica 94

5. A ∪ B = Ω − (A ∪ B) = {5}

6. A ∩ B = Ω − (A ∩ B) = {1, 3, 4, 5, 6}.

Exemplo 4.4.2. No Software .

#Saidas possiveis
eventos <- c(1:6)
eventos

## [1] 1 2 3 4 5 6

#Evento A
A <- eventos[eventos %% 2 == 0]
B <- eventos[eventos < 4]

#Solucao 1
sort(union(A, B)) TA
## [1] 1 2 3 4 6

#Solucao 2
U
intersect(A,B)
IN

## [1] 2

#Solucao 3
M

setdiff(eventos, A)

## [1] 1 3 5

#Solucao 4
setdiff(eventos, B)

## [1] 4 5 6

4.5 Partição de um Espaço Amostral


Definição 4.5.1. Os eventos A1 , A2 , . . . , An formam uma partição do espaço amostral Ω se:

i. Ai ̸= ϕ, para i = 1, . . . , n

ii. Ai ∩ Aj = ϕ, para i ̸= j

iii. ni=1 Ai = Ω
S
Estatı́stica 95

A1 A4
A3

A2
An

Figura 4.4: Partição de um espaço amostral.

4.6 Exercı́cios
1. Lançam-se três moedas. Enumerar o espaço amostral e os eventos:

a. Faces iguais
b. cara na 1a moeda
c. coroa na 2a e 3a moedas. TA
2. Considere a experiência que consiste em pesquisar famı́lias com três ciranças, em relação ao
sexo delas, segundo a ordem de nascimento. Enumerar os eventos:
U
a. ocorrência de dois filhos do sexo masculine;
b. ocorrência de pelo menos um filho do sexo masculino;
IN

c. ocorrência de no máximo duas crianças do sexo feminino.

3. Um lote contém peças de 5, 10, 15, . . . , 50 mm de diâmetro. Suponha que duas peças seja
M

selecionadas no lote. Se x e y indicam respectivamente os diâmetros da 1a e 2a peças sele-


cionadas, o par (x, y) representa um ponto amostral. Usando o plano cartesiano, indicar os
seguintes eventos:

a. A = {x = y}
b. B = {y < x}
c. C = {x = y − 10}
d. D = {(x + y)/2 < 10}

4. Sejam A, B e C três eventos de um espaço amostral. Expressar os eventos abaixo usando as


operações de reunião, interseção e complementação:

a. somente A ocorre;
b. A e C ocorrem, mas B não;
c. A, B e C ocorrem;
d. pelo menos um evento ocorre;
e. exatamente um ocorre;
Estatı́stica 96

f. nenhum ocorre;
g. exatamente dois ocorrem;
h. pelo menos dois ocorrem;
i. no máximo dois ocorrem.

TA
U
IN
M
Estatı́stica 97

5 Probabilidade
5.1 Função de Probabilidade
Definição 5.1.1. Função de probabilidade é uma função P que associa a cada evento de F um
único número real pertencente ao intervalo [0, 1], satisfazendo aos axiomas:
1. P (Ω) = 1

2. P (A ∪ B) = P (A) + P (B), se A e B forem mutuamente exclusivo.

3. P ( ni=1 Ai ) = ni=1 P (Ai ), se A1 , A2 , . . . , An forem dois a dois eventos mutuamente ex-


S P
clusivos.
Observação. 0 ≤ P (A) ≤ 1 para todos evento A ⊂ Ω.
Teorema 5.1.1. Se os eventos A1 , A2 , . . . , An forma uma partição do espaço amostral, então
n
X
P (Ai ) = 1
i=1
TA
Teorema 5.1.2. Se ϕ é o evento impossı́vel, então P (ϕ) = 0.
Observação. A recı́proca não é verdadeira, pois P (A) = 0, não implica que A seja evento im-
U
possı́vel.
Teorema 5.1.3. Teorema do evento complementar: Para todo evento A ⊂ Ω, P (A) + P (A) = 1.
IN

Teorema 5.1.4. Teorama da soma: Sejam A ⊂ Ω e B ⊂ Ω, então


M

P (A ∪ B) = P (A) + P (B) − P (A ∩ B)

Teorema 5.1.5. Sejam A ⊂ Ω e B ⊂ Ω, então

P (A ∪ B) ≤ P (A) + P (B)

Teorema 5.1.6. Dado o espaço amostral Ω e os eventos A1 , A2 , . . . , An , então:


n
! n n
[ X X
P Ai = P (Ai ) − P (Ai ∩ Aj )
i=1 i=1 i̸=j
Xn
+ P (Ai ∩ Aj ∩ Ak ) − · · ·
i̸=j̸=k
n−1
+ (−1) · P (A1 ∩ A2 ∩ . . . ∩ An )

Teorema 5.1.7. Dado o espaço amostral Ω e os eventos A1 , A2 , . . . , An , então:


n
! n
[ X
P Ai ≤ P (Ai )
i=1 i=1
Estatı́stica 98

Exemplo 5.1.1. Sendo P (A) = x, P (B) = y e P (A ∩ B) = z. Expressar as seguinte probabili-


dades, em função de x, y e z:
1. P (A ∪ B)
2. P (A ∩ B)
3. P (A ∩ B)
4. P (A ∪ B)

Solução
(a) (b)
1. P (A ∪ B) = P (A ∩ B) = 1 − P (A ∩ B) = 1 − z
(a) Leis de Morgan
(b) P (A) = 1 − P (A)
(a) (b)
2. P (A∩B) = P (A ∪ B) = 1−P (A∪B) = 1−{P (A)+P (B)−P (A∩B)} = 1−x−y −z
TA
(a) Leis de Morgan
(b) P (A) = 1 − P (A)
(a)
U
3. P (A ∩ B) = P (B) − P (A ∩ B) = y − z
(a) P (A ∩ B) = P (B) − P (A ∩ B), diagrama de Venn-Euler.
IN

4. P (A ∪ B) = P (A) + P (B) − P (A ∩ B) = 1 − P (A) + P (B) − (y − z)


=1−x+y−y+z =1−x+z
M

5.2 Eventos Equiprováveis


Seja o espaço amostral Ω = {e1 , e2 , . . . , en } associado a um experimento aleatório. ChamemosP (e1 ) =
pi para i = 1, , n
Definição 5.2.1. Os eventos e1 , i = 1, , n são equiprováveis quando

P (e1 ) = P (e2 ) = · · · = P (en ) = p


Pn Pn 1
Como i=1 P (ei ) = i=1 pi = 1, temos que n · p = 1 ⇒ p =
.
n
Definição 5.2.2. Seja A ⊂ Ω um evento composto por k, 1 ≤ k ≤ n, pontos amostrais:
A = {e1 , e2 , . . . , ek }, 1 ≤ k ≤ n
k k
X X 1
P (A) = P (ei ) = p=k·p=k
i=1 i=1
n

k
∴ P (A) =
n
Estatı́stica 99

Exemplo 5.2.1. Retira-se uma carta de um baralho completo de 52 cartas. Qual a probabilidade
de sair um rei ou uma carta de espadas?

Solução

1. Seja A : saı́da de um rei; B : saı́da de uma carta de espada.

2. P (A ∪ B) = P (A) + P (B) − P (A ∩ B)
4
3. Como A = {Ro , Re , Rc, Rp } =⇒ P (A) = .
52
13
4. Como B = {Ae , 2e , . . . , Re } =⇒ P (B) =
52
1
5. Como A ∩ B = {Re } =⇒ P (A ∩ B) =
52
4 13 1 16
6. P (A ∪ B) = P (A) + P (B) − P (A ∩ B) = + − =
TA 52 52 52 52

5.3 Probabilidade Condicional


Definição 5.3.1. Sejam A ⊂ Ω e B ⊂ Ω. A probabilidade condicional de A, dado que B ocorre
A/B é definida por:
U
P (A ∩ B)
P (A/B) = , se P (B) ̸= 0
P (B)
IN

e
P (B ∩ A)
P (B/A) = , se P (A) ̸= 0
M

P (A)
Exemplo 5.3.1. Exemplo: Consideremos 250 alunos que cursam o primeiro ciclo de uma facul-
dade. Destes alunos, 100 são homes (H) e 150 são mulheres (M); 110 cursam fı́sica (F) e 140
cursam quı́mica (Q). Distribuição dos alunos é a seguinte: Exemplo: Um aluno é sorteado ao

Sexo\Disciplina F Q Total
H 40 60 100
M 70 80 150
Total 110 140 250

caso. Qual a probabilidade de que esteja cursando quı́mica, dado que é mulher?

Solução

1. P (Q/M ) =?
80 150
2. P (M ∩ Q) = e P (M ) =
250 250
Estatı́stica 100

80
P (M ∩ Q) 80
3. P (Q/M ) = = 250 =
P (M ) 150 150
250
1 3 11
Exemplo 5.3.2. Sendo P (A) = , P (B) = e P (A ∪ B) = . Calcular P (A/B).
3 4 12
Solução
P (A ∩ B)
1. P (A/B) = , seP (B) ̸= 0
P (B)
2. Devemos obter P (A ∩ B)
3. P (A ∪ B) = P (A) + P (B) − P (A ∩ B) =⇒ P (A ∩ B) = P (A) + P (B) − P (A ∪ B)
1 3 11 2 1
=⇒ P (A ∩ B) = + − = =
3 4 12 12 6
1
P (A ∩ B) 2
4. P (A/B) = = 6 =
3
P (B) 9
TA
4

5.4 Eventos Independentes


U
Teorema 5.4.1. Teorema do produto: Sejam A ⊂ Ω e B ⊂ Ω. A probabilidade condicional de A,
IN

dado que B ocorre A/B é definida por:


P (A ∩ B) = P (B) · P (A/B)
M

e
P (B ∩ A) = P (A) · P (B/A)
Sejam A ⊂ Ω e B ⊂ Ω. Se A e B são independentes:
P (A/B) = P (A) e P (B/A) = P (B)
Definição 5.4.1. A e B são eventos independentes se
P (A ∩ B) = P (A) · P (B)

5.5 Teorema de Bayes


Teorema 5.5.1. Teorema da probabilidade total: Sejam A1 , A2 , . . . , An eventos que formam uma
partição do espaço amostral Ω. Seja B um evento desse espaço.
n
X
P (B) = P (Ai ) · P (B/Ai )
i=1
Estatı́stica 101

A1 A4
A3

A2 B
An

Figura 5.1: Teorema da probabilidade total.

Teorema 5.5.2. Teorema de Bayes: Sejam A1 , A2 , . . . , An eventos que formam uma partição
do espaço amostral Ω. Seja B ⊂ Ω e conhecidas as probabilidades P (Ai ) e P (B/Ai ) para
i = 1, . . . , n.
P (Aj ) · P (B/Aj )
P (Aj /B) = Pn
i=1 P (Ai ) · P (B/Ai )
para j = 1, . . . , n.

Exemplo 5.5.1. A urna A contém 3 fichas vermelhas e 2 azuis, e a urna B contém 2 vermelhas e 8
TA
azuis. Joga-se uma moeda ”honesta”. Se a moeda der cara (C), extrai-se uma ficha da urna A; se
der coroa (r) extrai-se uma ficha da urna B. Uma ficha vermelha é extraı́da. Qual a probabilidade
de ter saı́do cara (C) no lançamento?
U
IN

3V 2V
2A 8A
M

A B
Figura 5.2: Ilustração das urnas

Solução
P (V ∩ C)
1. P (C/V ) =
P (V )
1 1
2. P (C) = e P (r) =
2 2
3 2
3. P (V /C) = e P (V /r) =
5 10
4. P (V ) = P (C ∩ V ) + P (r ∩ V ) = P (C) · P (V /C) + P (r) · P (V /r)
1 3 1 2 3 2 4
= · + · = + =
2 5 2 10 10 20 10
Estatı́stica 102

3
P (r ∩ C) 3
5. P (C/V ) = = 10 =
P (V ) 4 4
10

5.6 Exercı́cios
1. Uma urna contém 5 bolas brancas, 4 vermelhas e 3 azuis. Extraem-se simultaneamente 3
bolas. Achar a probabilidade de que:
a. nenhuma seja vermelha;
b. extamente uma seja vermelha;
c. todas sejam da mesma cor.
2. As probabilidades de três jogadores A , B e C marcarem um gol quando cobram um pênalti
são 2/3, 4/5 e 7/10, respectivamente. Se cada um cobrar uma única vez, qual a probabilidade
de que pelo menos um marque um gol?
3. Em uma indústria há 10 pessoas que ganham mais de 20 salários mı́nimos (s. m.), 20 ganham
TA
entre 10 e 20 s.m. e 70 ganham menos de 10 s.m. Três pessoas desta indústria são selecionadas.
Determinar a probabilidade de que pelo menos uma ganhei menos de 10 s.m.
4. A e B jogam 120 partidas de xadrez, quais A ganha 60, B ganha 40 e 20 terminam empatadas.
U
A e B concordam em jogar 3 partidas. Determinar a probabilidade de que:
IN

a. A ganhar todas as três;


b. duas partidas terminarem empatadas;
c. A e B ganharem alternatdamente.
M

5. Um lote de 120 peças é entregue ao controle de qualidade de uma firma. O responsável pelo
setor seleciona 5 peças. O lote será aceito se forem observadas 0 ou 1 defeituosas. Há 20
defeituosas no lote.
a. Qual a probabilidade de o lote ser aceito?
b. Admitindo-se que o lote seja aceito, qual a probabilidade de ter sido observado só um
defeito?
6. Uma urna contém 5 bolas brancas, 4 vermelhas e 3 azuis. Extraem-se simultaneamente 3
bolas. Achar a probabilidade de que:
a. nenhuma seja vermelha;
b. exatamente uma seja vermelha;
c. todas sejam da mesma cor.
7. As probabilidades de três jogadorese A, B e C marcarem um gol quando cobram um pênalt
2 4 7
são , e , respectivamente. Se cada um cobrar uma única vez, qual a probabilidade d que
3 5 10
pelo menos um marque um gol?
Estatı́stica 103

6 Variáveis Aleatórias Discretas


Muitas vezes é mais interessante associarmos um número a um evento aleatório e calcularmos
a probabilidade da ocorrência desse número do que a probabilidade do evento.
Exemplo 6.0.1. Lançam-se três moedas. Seja X o número de ocorrências da face cara (c). Deter-
minar a distribuição de probabilidade de X. O espaço amostral é

Ω = {(c, c, c), (c, c, r), (c, r, c), (c, r, r), (r, c, c), (r, c, r), (r, r, c), (r, r, r)}

Se X é o número de caras (c), X assume os valores 0, 1, 2 e 3. Podemos associar a esses números


eventos que correspondam à ocorrência de nenhuma, uma duas ou três caras, respectivamente.

X Evento correspondente
0 A0 = {(r, r, r)}
1 A1 = {(c, r, r), (r, c, r), (r, r, c)}
2 A3 = {(c, c, r), (c, r, c), (r, c, c)}
3 A4 = {(c, c, c)}

Logo, temos a seguinte associação


TA
Associação
U
𝐴1
IN

0
𝐴2 1
𝐴3
M

2
𝐴4 3
 ℝ

Figura 6.1: Associação dos eventos com números.

As probabilidades de X assumir um dos valores pode ser associada as probabilidades dos


eventos correspondentes:

1
P (X = 0) = P (A1 ) =
8
3
P (X = 1) = P (A2 ) =
8
3
P (X = 2) = P (A3 ) =
8
1
P (X = 3) = P (A4 ) =
8
Estatı́stica 104

As probabilidades podem ser representadas em um quadro da seguinte forma:

X P (X)
0 1/8
1 3/8
2 3/8
3 1/8
Tabela 6.1: Representação em Quadro
3/8
Probabilidade

TA
2/8

U
IN
1/8
M

0 1 2 3

Valor da Variável X

Figura 6.2: Representação Gráfica

6.1 Definições
Definição 6.1.1. Variável aleatória é a função que associa a todo evento pertencente a uma
partição do espaço amostral um único número real.
Variável aleatória discreta deve assumir valores em um conjunto finito ou infinito, porém enu-
merável. No caso finito será indicado por: x1 , x2 , . . . , xn .
Definição 6.1.2. Função de probabilidade é a função que associa a cada valor assumido pela
variável aletatória a probabilidade do evento correspondente, isto é:

P (X = xi ) = P (Ai ), para i = 1, 2, . . . , n
Estatı́stica 105

O conjunto {(xi , p(xi )), i = 1, 2, , n} é denominado de distribuição de probabilidades da


variável aleatória X.

Observação.
n
X
p(xi ) = 1
i=1

Exemplo 6.1.1. Lançam-se 2 dados. Seja X a soma das faces, determinar a distribução de proba-
bilidades de X.

Solução

1. Representação em quadro:

X P (X)
2 1/36
3 2/36
4 3/36
5 4/36
TA
6 5/36
7 6/36
8 5/36
U
9 4/36
10 3/36
IN

11 2/36
12 1/36
1
M

Tabela 6.2: Quadro da distribuição de probabilidades de X

2. Representação gráfica
Estatı́stica 106

6/36
5/36
4/36
Probabilidade

3/36

TA
2/36

U
1/36

IN

2 3 4 5 6 7 8 9 10 11 12
M

Valor da Variável X

Figura 6.3: Representação Gráfica

Exemplo 6.1.2. No Software .

x <- seq(from=2, to = 12, by=1)


y <- c((1:6)/36, (5:1)/36)
plot(x,y, axes=T, xlab="Valor da Variável X",
ylab="Probabilidade", pch = 19, cex = 1.2)
Estatı́stica 107

0.16
0.12
Probabilidade

0.08
0.04

TA
2 4 6 8 10 12
U

Valor da Variável X
IN

Figura 6.4: Representação Gráfica


M

Exemplo 6.1.3. Suponhamos que a variável X tenha função de probabilidade dada por:
1
P (X = j) = para j = 1, 2, , n, . . .
2j
1. P (X ser par);

2. P (X ≥ 3);

3. P (Xser múltiplo de 3)

Solução

1. P (X ser par) = P (X = 2) + P (X = 4) + P (X = 6) + · · · =
1 1 1 (a) 1/4 1
= + + + ··· = =
4 16 64 1 − 1/4 3
a1 an+1
(a) Sn = em que q =
1−q an
Estatı́stica 108

1/16 4 1
(b) q = = =
1/4 16 4

2. P (X ≥ 3) = P (X = 3) + P (X = 4) + P (X = 5) + · · · =
1 1 1 (a) 1/8 1
= + + + ··· = =
8 16 32 1 − 1/2 4
a1 an+1
(a) Sn = em que q =
1−q an
1/16 8 1
(b) q = = =
1/8 16 2
3. P (Xser múltiplo de 3) = P (X = 3) + P (X = 6) + P (X = 9) + · · · =
1 1 1 (a) 1/8 1
= + + + ··· = =
8 64 512 1 − 1/8 7
a1 an+1
(a) Sn = em que q =
1−q an
1/64 8 1
(b) q = = =
TA
1/8 64 8

6.2 Esperança Matemática


U
Na distribuição de probabilidades de uma variável aleatória existem caracterı́sticas numéricas
IN

muito importantes. Essas caracterı́sticas são os parâmetros das distribuições. A seguir serão de-
findos os parâmetros de uma distribuição denominados de Esperança matemática (ou média) e
variância.
M

Definição 6.2.1. Seja a variável aleatória X : x1 , x2 , . . . , xn e as probabilidades P (X = xi ) para


i = 1, 2, . . . , n. A esperança matemática E(X) será definida por:
n
X
E(X) = xi · p(xi )
i=1

Observação. A esperança matemática E(X) também poderá ser denotada por µ(x), µx ou apenas
por µ, quando não houver ambiguidade. A esperança matemática é um número real, e também
uma média aritmética ponderada.
Exemplo 6.2.1. Uma Seguradora paga R$ 30.000,00 em caso de acidente de carro e cobra uma
taxa de R$ 1.000,00. Sabe-se que a probabilidade de que um carro sofra acidente é de 3%. Quanto
espera a seguradora ganhar por carro segurado?

Solução
n
X
1. E(X) = xi · p(xi ) = x1 · p(x1 ) − x2 · p(x2 )
i=1
= 1.000 · 0, 97 − 29.000 · 0, 03 = 10.000
Estatı́stica 109

2. Lucro médio por carro (LMC) será:

LM C = 10.000/100 = R$100

6.2.1 Propriedades da Esperança Matemática


A esperança matemática (E(X)) possui as seguintes propriedaes:

a. E(k) = k, sendo k constante;

b. E(k · X) = k · E(X);

c. E(X ± Y ) = E(X) ± E(Y );

d. E{ ni=1 Xi } = ni=1 {E(Xi )};


P P

e. E(aX ± b) = aE(X) ± b, sendo a e b constantes;

f. E(X − µx ) = 0.

6.3 Variância
TA
A variância é a medida que fornece o grau de dispersão de probabilidade em torno da média.
U
Definição 6.3.1. A variância de uma variável aleatório X é definida como:

V AR(X) = E{[X − E(X)]2 }


IN

ou,
V AR(X) = E(X 2 ) − {E(X)}2
M

Observação. E(X 2 ) = ni=1 x2i · p(xi ). A variância V AR(X) também poderá ser denotada por
P
V (X), σ 2 (X), σX
2
ou apenas por σ 2 , quando não houver ambiguidade.

Definição 6.3.2. Seja a variável aleatória X : x1 , x2 , . . . , xn e as probabilidades P (X = xi ) para


i = 1, 2, . . . , n. A variância V AR(X) será definida por:
n
X
V AR(X) = (xi − µx )2 · p(xi )
i=1

Exemplo 6.3.1. Consideremos a distribuição da variável aleatória X e sua média.

X P (X) X · P (X)
0 1/8 0
1 6/8 6/8
2 1/8 2/8
µX = 1
Tabela 6.3: Distribuição da variável X
Estatı́stica 110

X P (X) X · P (X) X − µx (x − µx )2 (x − µx )2 · P (X)


0 1/8 0 -1 1 1/8
1 6/8 6/8 0 0 0
2 1/8 2/8 1 1 1/8
µx = 1 V AR(X) = 0, 25

Solução
1. O quadro a seguir, apresenta os cálculos para determinar a variância de X:
2. ∴ V AR(X) = 0, 25
Exemplo 6.3.2. Consideremos a distribuição da variável aleatória Y e sua média.

Y P (Y ) Y · P (Y )
-2 1/5 -2/5
-1 1/5 -1/5
0 1/5 0
3 1/5
TA 3/5
5 1/5 5/5
1 µy = 1
Tabela 6.4: Distribuição da variável Y
U
IN

Solução
1. O quadro a seguir, apresenta os cálculos para determinar a variância de Y:
M

Y P (Y ) Y · P (Y ) Y 2 · P (Y )
-2 1/5 -2/5 4/5
-1 1/5 -1/5 1/5
0 1/5 0 0
3 1/5 3/5 9/5
5 1/5 5/5 25/5
1 µy = 1 E(Y 2 ) = 39/5

39 34
2. ∴ V AR(X) = E(X 2 ) − {E(X)}2 = − 12 = = 6, 8
5 5
Observação. A variância é um quadrado, por exemplo a altura média de um grupo de pessoas é
1,70 m e a variância 25 cm2. De forma que a interpretação em cm2 é “estranha” e para facilitar
a interpretação é definido o desvio padrão.
Definição 6.3.3. Desvio padrão da variável X é a raiz quadrada da variância de X, isto é:
p
σx = V AR(X)
Observação. O desvio padrão populacional σx também será denotado por σ(X) e σ. No caso
amostral, a variância será indicada por s2 e o desvio padrão por s.
Estatı́stica 111

6.3.1 Propriedades da Variância


a. V AR(k) = 0, sendo k constante;

b. V AR(k · X) = k 2 · V AR(X);

c. V AR(X ± Y ) = V AR(X) + V AR(Y ) ± 2 · cov(X, Y );

d. V AR( ni=1 Xi ) = ni=1 V AR(Xi ) + 2 · ni<j cov(Xi , Xj );


P P P

e. V AR(aX ± b) = V AR(aX) + V AR(b) ± 2 · cov(aX, b), sendo a e b constantes.

6.4 Correlação
A covariância mede o grau de dependência entre as duas variáveis X e Y .

Definição 6.4.1. A covariância entre X e Y é definida por:

cov(X, Y ) = E{[X − E(X)] · [Y − E(Y )]}


TA
Definição 6.4.2. A Covariância entre X e Y pode ser obtido por:
Populacional PN
i=1 (xi − x)(yi − y)
U
cov(X, Y ) =
N
Amostral
IN

Pn
i=1 (xi − x)(yi − y)
cov(X, Y ) =
n−1
Exemplo 6.4.1.
M

6.5 Função de Distribuição F (x)


Definição 6.5.1. A função de distribuição de X é definida por:
X
F (x) = P (X ≤ x) = p(xi )
xi ≤x

Exemplo 6.5.1. Consideremos que a variável X tenha a seguinte distribuição de probabilidades.

X P (X)
1 0,1
2 0,2
3 0,4
4 0,2
5 0,1

1. Calcular F (x) para x = 1, 2, 3, 4, 5, para x = 1, 34 e x = 3, 98 e para x = −1, −2, −3 ;


Estatı́stica 112

2. Escrever F (x) na forma de uma função composta;

3. Construir o gráfico de F (x).

Solução

1. (a) F (1) = P (X ≤ 1) = P (X = 1) = 0, 1
(b) F (2) = P (X ≤ 2) = P (X = 1) + P (X = 2) = 0, 3
(c) F (3) = P (X ≤ 3) = P (X = 1) + P (X = 2) + P (X = 3) = 0, 7
(d) F (4) = P (X ≤ 4) = P (X = 1) + P (X = 2) + P (X = 3) + P (X = 4) = 0, 9
(e) F (5) = P (X ≤ 5) = P (X = 1) + P (X = 2) + P (X = 3)
+ P (X = 4) + P (X = 4) = 1
(f) F (1, 34) = P (X ≤ 1, 34) = P (X ≤ 1) = F (1) = 0, 1
(g) F (3, 98) = P (X ≤ 3, 98) = P (X ≤ 3) = F (3) = 0, 7
(h) F (−1) = P (X ≤ −1) = 0
(i) F (−2) = P (X ≤ −2) = 0
(j) F (−3) = P (X ≤ −3) = 0
TA
2.
U

 0 se X < 1
IN


0, 1 se 1 ≤ X < 2




0, 3 se 2 ≤ X < 3

F (X) =

 0, 7 se 3 ≤ X < 4
M

0, 9 se 4 ≤ X < 5




1 se X ≥ 5

Estatı́stica 113

1
0.9
0.7
Valores de X

TA
0.3

U
0.1

IN
0

−0.5 1.0 2.0 3.0 4.0 5.0


M

F(X)

Figura 6.5: Gráfico de F(X)

3.

6.5.1 Propriedades de F (x)


a. 0 ≤ F (x) ≤ 1
b. F (−∞) = 0
c. F (+∞) = 0
d. F (x) é descontı́nua em X = x0 , onde P (X = x0 ) ̸= 0.

lim F (x) ̸= lim F (x) ̸= F (x0 )


x→x0− x→x0+
Estatı́stica 114

e. F (x) é contı́nua à direita dos pontos X = x0 , onde P (X = x0 ) ̸= 0.

Se P (X = x0 ) > 0 =⇒ lim F (x) = F (x0 )


x→x0+

f. P (a < X ≤ b) = F (b) − F (a)

g. P (a ≤ X ≤ b) = F (b) − F (a) + P (X = a)

h. P (a < X < b) = F (b) − F (a) − P (X = b)

i. Como P (a < X ≤ b) = F (b) − F (a) ≥ 0 =⇒ F (b) ≥ F (a), F (x) é uma função não
decrescente.

6.6 Exercı́cios
1. Uma urna contém 4 bolas brancas e 6 pretas. Três bolas são retiradas com reposição. Seja X
o número de bolas brancas. Calcular E(X).
TA
2. Sabe-se que uma moeda mostra a face cara quarto vezes mais do que a face coroa, quando
lançada. Essa moeda é lança 4 vezes. Seja X o número de caras que aparece, determine:

a. E(X)
U
b. V AR(X)
c. P (X ≥ 2)
IN

d. P (1 ≤ X ≤ 3)
M
Estatı́stica 115

7 Distribuições Teóricas de Probabilidade para Variáveis


Aleatórias Discretas
7.1 Distribuição de Bernoulli
Consideremos uma única tentativa de um experimento aleatório, em que se pode obter sucesso
ou fracasso. Seja p a probabilidade de sucesso e q a probabilidade de fracasso, com p + q = 1.
Seja X o número de sucessos em uma única tentativa do experimento.
X assume o valor 0 (fracasso), com probabilidade q, ou valor 1 (sucesso) com probabilidade p, ou
seja,

0 fracasso
X= com P (X = 0) = q e P (X = 1) = p
1 sucesso

Assim, a variável X tem distribuição de Bernoulli, e sua função de probabilidade é dada por:
P (X = x) = pX · q 1−X

7.1.1 Esperança e Variância


TA
A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
U
distribuição Bernoulli são dadas por:

 E(X) = p
IN

V AR(X) = p · q

M

Exemplo 7.1.1. Uma urna tem 30 bolas brancas e 20 verdes. Retira-se uma bola dessa urna. Seja
X um número de bolas verdes, calcular E(X) e V AR(X) e determinar P (X).

Solução

0 −→ q
1. X =
1 −→ p
30 20
2. q = ep=
50 50
30

 0 −→ q =

3. X = 50
 1 −→ p = 20

50
20 20 30 6
4. E(X) = p = e V AR(X) = p · q = · =
50 50 50 25
 x  1−x
2 3
5. P (X = x) = pX · q 1−X = ·
5 5
Estatı́stica 116

7.2 Distribuição Binomial


Consideremos n tentativas independentes de um mesmo experimento aleatório. Cada tentativa
admite apenas dois resultados: fracasso com probabilidade e sucesso com probabilidade p, p+q =
1. As probabilidade de fracasso e sucesso são as mesmas probabilidades em cada tentativa.
Seja X número de sucesso em n tentativas. A função de probabilidade da variável X, isto é,
P (X = k), quando o número de sucessos é igual a k, e considerando todas as n-uplas com k
sucessos, é dada por:  
n k n−k
P (X = k) = p ·q
k

Essa função de distribuição de probabilidade Binomial. Assim, a variável X tem distribuição


binomial, com parâmetros n e p, e é indicada pela notação: B(n; p)

7.2.1 Esperança e Variância


A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
distribuição Binomial são dadas por: TA

 E(X) = n · p

V AR(X) = n · p · q

U
Exemplo 7.2.1. Uma prova tipo teste tem 50 questões independentes. Cada questão tem 5 alter-
nativas. Apenas uma das alternativas é a correta. Se o aluno resolve a prova respondendo a esmo
IN

as questões, qual a probabilidade de tirar nota 5?


Solução
M

1. X : número de acertos; X : 0, 1, 2, . . . , 50.


1 4
2. p = P (acerto) = , q = P (fracasso) =
5 5
3. X : B(n; p), P (X = k) = nk pk · q n−k


     25  25
1 50 1 4 (a)
4. X : B 50; , P (X = 25) = · ≈ 0, 000002
5 25 5 5
   
n n! 50 50!
(a) = =⇒ =
k k!(n − k)! 25 25!(25)!
Exemplo 7.2.2. Determinar a média e a variância da variável aleatória Y = 3X + 2, sendoX :
B(20; 0, 3).
Solução
1. E(X) = n · p = 20 · 0, 3 = 6, V AR(X) = n · p · q = 20 · 0, 3 · (1 − 0, 3) = 4, 2
2. E(Y ) = E(3X + 2) = E(3X) + E(2) = 3E(X) + 2 = 3 · 6 + 2 = 20
3. V AR(Y ) = V AR(3X + 2) = 32 V AR(X) = 9V AR(X) = 9 · 4, 2 = 37, 8
Estatı́stica 117

7.3 Distribuição de Poisson


Consideremos a probabilidade de ocorrência de sucessos em um determinado intervalo. A
probabilidade da ocorrência de um sucesso no intervalo é proporcional ao intervalo.
Seja X o número de sucesso no intervalo, então a probabilidade de X assumir o valor igual a k
sucessos é dada por:
e−λ · λk
P (X = k) =
k!
em que λ é a média de ocorrência num intervalo. A variável X assim definida tem distribuição de
Poisson.

7.3.1 Esperança e Variância


A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
distribuição Poisson são dadas por:

 E(X) = λ · p

V AR(X) = λ
 TA
Exemplo 7.3.1. Num livro de 800 páginas há 800 erros de impressão. Qual a probabilidade de
U
que uma página contenha pelo menos 3 erros?

Solução
IN

e−λ · λk
1. P (X = k) = , λ é a media de ocrrência em um intervalo.
k!
M

erros 800
2. λ = = =1
páginas 800
3. P (X ≥ 3), X : número de erros por página.

4. P (X ≥ 3) = 1 − P (X < 3) = 1 − {P (X = 0) + P (X = 1) + P (X = 2)}
 −1 0
e−1 · 11 e−1 · 12

e ·λ
=1− + +
0! 1! 2!
= 1 − 0, 919698 ≈ 0, 080301
Exemplo 7.3.2. Numa central telefônica chegam 300 telefonemas por hora. Qual a probabilidade
de que:

1. num minuto não haja nenhum chamado?

2. em 2 minutos haja 2 chamados?

3. em t minutos não haja chamados?

Solução
Estatı́stica 118

1. (a) X : número de chamados por minuto


e−λ · λk
(b) P (X = k) = , λ é a media de ocrrência em um intervalo.
k!
300
(c) λ = =5
60
e−5 · 50
(d) P (X = 0) = ≈ 0, 006738
0!
2. (a) X : número de chamados por minuto
e−λ · λk
(b) P (X = k) = , λ é a media de ocrrência em um intervalo.
k!
300
(c) λ = = 5, logo em 2 minutos =⇒ λ = 5 · 2 = 10
60
e−10 · (2 · 5)2
(d) P (X = 2) = ≈ 0, 00227
2!
3. (a) X : número de chamados por minuto

(b) P (X = k) =
e−λ · λk
k!
TA
, λ é a media de ocrrência em um intervalo.
300
(c) λ = = 5, logo em t minutos =⇒ λ = 5 · t = 5t
60
U
e−5t · (5t)0
(d) P (X = 0) = = e−5t
0!
IN
M
Estatı́stica 119

8 Variáveis Aleatórias Contı́nuas


Consideremos a variável aleatória discreta X com distribuição de probabilidades dada no qua-
dro:

X P(X)
1 0,1
2 0,2
3 0,4
4 0,2
5 0,1

Cuja representação gráfica é apresentada na Figura (8.1), a seguir:

𝑃(𝑋)
0,4 TA
0,3
0,2
U
0,1 𝐴𝑟1 𝐴𝑟2 𝐴𝑟3 𝐴𝑟4 𝐴𝑟5
IN

0 1 2 3 4 5 𝑋

Figura 8.1: Histograma da variável X


M

A área dos retângulos indicados na Figura são:


Ar1 = b1 · h1 = 1 · 0, 1 = 0, 1 ∴ Ar1 = P (X = 1)
Ar2 = b2 · h2 = 1 · 0, 2 = 0, 2 ∴ Ar2 = P (X = 2)
Ar3 = b3 · h3 = 1 · 0, 4 = 0, 4 ∴ Ar3 = P (X = 3)
Ar4 = b4 · h4 = 1 · 0, 2 = 0, 2 ∴ Ar4 = P (X = 4)
Ar5 = b5 · h5 = 1 · 0, 1 = 0, 1 ∴ Ar5 = P (X = 5)
Como 5i=1 P (X = i) = 1 =⇒ 5i=1 Ari = 1.
P P

Para calcular P (1 ≤ X ≤ 3), basta calcular a soma das áreas Ar1 , Ar2 e Ar3 , da seguinte forma:
P (1 ≤ X ≤ 3) = 3i=1 Ari = 0, 1 + 0, 2 + 0, 3 = 0, 7
P

Se tomarmos os pontos médios das bases superiores dos retângulos e ligarmos, temos a curva. Se
X é uma variável aleatória contı́nua, uma função contı́nua f (x) pode ser indicada no gráfico, a
seguir:
Estatı́stica 120

𝑃(𝑋)
0,4
𝑓(𝑥)
0,3
0,2
0,1
𝐴𝑟1 𝐴𝑟2 𝐴𝑟3 𝐴𝑟4 𝐴𝑟5

0 1 2 3 4 5 𝑋 a b 𝑋

Figura 8.2: Histograma com curva da função f (x)

8.1 Definições
Uma variável aleatória X é contı́nua em R se existir uma função f (x), tal que:

1. f (x) ≥ 0 (não negativa)


R +∞
TA
2. −∞ f (x)dx = 1
U
A função f (x) é chamada função de densidade de probabilidade (f. d. p.). Assim,
Z b
IN

P (a ≤ X ≤ b) = f (x)dx
a

que corresponde a área delimitada pela função f (x), eixo dos X, e pelas retas X = a e X = b,
M

indicada na Figura (8.3), a seguir:

𝑓(𝑥)

a b 𝑋
Figura 8.3: Probabilidade igual a área delimitada

ou seja, Z b
A = P (a ≤ X ≤ b) = f (x)dx
a
Estatı́stica 121

8.2 Esperança Matemática


A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X contı́nua
são dadas por:  R
+∞
E(X) = x · f (x)dx



 −∞



R +∞
 V AR(X) =
 {x − E(X)}2 dx
−∞

A variância V AR(X) pode também ser obtida por:

V AR(X) = E(X 2 ) − {E(X)}2 ,


R +∞
sendo E(X 2 ) = x2 · f (x)dx.
−∞

8.3 Função de Distribuição F (x)


TA
A função de distribuião F (X) de uma vriável aleatória contı́nua é dada por:
Z x

F (X) = P (X ≤ x) = f (s)ds
U
−∞
IN

Uma representação gráfica de F (X) é indcada na Figura (8.4) a seguir:


M

𝐹(𝑥)

𝑋
Figura 8.4: Função de distribuição

Se existir a f.d.p f (x), esta pode ser obtida de F (x), pois

d
F (x) = f (x)
dx
em pontos em que F (x) é derivável.
Estatı́stica 122

9 Distribuições Teóricas de Probabilidade para Variáveis


Aleatórias Contı́nuas
9.1 Distribuição Uniforme
Uma variável aleatória contı́nua X tem distribuição uniforme de probabilidades no intervalo
[a, b] se a sua f. d. p. é dada por:
1

 se a ≤ x ≤ b
b−a

f (x) =


0 se x < a ou x > b

Uma representação gráfica da distribuição uniforme é apresentada na Figura (9.1)

𝑓(𝑋)
1
TA
𝑏−𝑎
U
IN

a b 𝑋
Figura 9.1: Distribuição Uniforme
M

9.1.1 Esperança e Variância


A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
distribuição Uniforme são dadas por:

b+a
 E(X) = 2


2
 V AR(X) = (b − a)



12

9.1.2 Função de Distribuição


A função de distribuição F (X) da variável X com distribuição Uniforme é dada por:
Estatı́stica 123

a b 𝑋

Figura 9.2: Função de distribuição Uniforme



 0 se x ≤ a



 x−a
F (x) = se a < x < b

 b−a



 TA
1 se x ≥ b

Uma representação gráfica de F (x) é apresentada na Figura (9.2)


U
Exemplo 9.1.1. Um ponto é escolhido ao acaso no intervalo [0, 2]. Qual a probabilidade de que
IN

esteja entre 1 e 1,5?

Solução
M

1


 se 0 ≤ x ≤ 2
1. f (x) = 2

0 se x < 0 ou x > 2

Z 1,5
1,5
1 1
2. P (1 ≤ X ≤ 1, 5) = dx = x
2 2 1
1
1 1 1 3 1 3 1 3−2 1
= · 1, 5 − · 1 = · − = − = =
2 2 2 2 2 4 2 4 4

9.2 Distribuição Exponencial


Uma variável aleatória contı́nua X tem distribuição Exponencial de probabilidades se a f. d. p.
é dada por:
 −λx
 λe se x ≥ 0
f (x) =
0 se x < 0

Estatı́stica 124

Uma representação gráfica da distribuição exponencial é apresentada na Figura (9.3)

𝑓(𝑋)
𝜆

𝑋
Figura 9.3: Distribuição Exponencial

9.2.1 Esperança e Variância


TA
A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
distribuição Uniforme são dadas por:
 1
U
 E(X) = λ


IN

 V AR(X) = 1


λ2
M

9.2.2 Função de Distribuição


A função de distribuição F (X) da variável X com distribuição Exponencial é dada por:

 1 − e−λx se x > 0
F (x) =
0 se x ≤ 0

Uma representação gráfica de F (x) é apresentada na Figura (9.4)


Estatı́stica 125

𝐹(𝑋)
1

𝑋
Figura 9.4: Função de distribuição Exponencial

Exemplo 9.2.1. Seja X uma variável aleatória com distribuição exponencial, sendo λ = 25.
Calcular P (X > 0, 1).

Solução
R ∞ (a)
1. P (X > 0, 1) = 25e−25x dx = e−25(0,1) = 0, 082
TA
0,1
R ∞

(a) λe−λx dx = −e−λx 0
0
U
Alternativamente, a solução pode ser obtida pela função de distribuição F (x), da se-
guinte forma:
IN

(b) P (X > 0, 1) = 1 − F (0, 1) = e−25(0,1) = 0, 082

9.3 Distribuição Normal


M

Uma variável aleatória contı́nua X tem distribuição normal de probabilidade se a sua f.d.p. é
dada por:
1 x − µ !2
1 −
f (x) = √ e 2 σ
σ 2π
para −∞ < x < ∞. A notação será X : N (µ; σ 2 ).
Uma representação gráfica da distribuição normal é apresentada na Figura (9.5)
Estatı́stica 126

𝜇−𝜎 𝜇 𝜇+𝜎
𝑋
Figura 9.5: Distribuição Normal

As principais caracterı́sticas de f (x) são:

a. O ponto máximo de f (x) é o ponto X = µ;

b. Os pontos de inflexão da função são: X = µ − σ e X = µ + σ

c. A curva é simétrica em relação a µ. TA


d. E(X) = µ e V AR(X) = σ 2

A probabilidade P (a ≤ X ≤ b) é a área delimitada pelo eixo dos X pela curva da função f (x)
U
e pelas retas X = a e X = b, coforme indicado na Figura (9.6)
IN
M

a 𝑏
𝑋
Figura 9.6: Distribuição Normal - Área

A probabilidade P (a ≤ X ≤ b) será obtida por:


Z b 1 x − µ !2
1 −
P (a ≤ X ≤ b) = √ e 2 σ dx
σ 2π
a
Estatı́stica 127

9.3.1 Esperança e Variância


A esperança matemática E(X) e a variância V AR(X) de uma variável aleatória X com
distribuição Normal, X : N (µ; σ 2 ) são os parâmetros a seguir, que figuram na f. d. p. da
distribuição normal: 
 E(X) = µ

V AR(X) = σ 2

Definição 9.3.1. Seja X uma variável aleatória X : N (µ; σ 2 ), definimos a variável aleatória Z a
seguir:
X −µ
Z=
σ
Z é denominada variável normal reduzida, normal padronizada ou variável normalizada.

9.3.2 Esperança e Variância


A esperança matemática E(Z) e a variância V AR(Z) de uma variável aleatória Z são dadas
por: 
 E(Z) = 0
TA
V AR(Z) = 1

U
Assim, a f.d.p de Z é dada por:
IN

−z 2
1
f (z) = √ e 2
M


para −∞ < x < ∞. Logo,
X : N (µ, σ 2 ) −→ Z : (0; 1)
Uma representação gráfica da distribuição normal padronizada é apresentada na Figura (9.7)

−1 0 1 𝑍
Figura 9.7: Distribuição Normal Padronizada

Exemplo 9.3.1. Seja X : N (20; 4). Achar os valores reduzidos correspondentes a


Estatı́stica 128

a. X1 = 14 e. X5 = 22
b. X2 = 16
f. X6 = 24
c. X3 = 18
d. X4 = 20 g. X7 = 26
Solução
Observe que µ = 20 e σ2 = 2 ⇒ σ = 2
14 − 20
a. X1 = 14 =⇒ Z1 = = −3
2
16 − 20
b. X2 = 16 =⇒ Z2 = = −2
2
18 − 20
c. X3 = 18 =⇒ Z3 = = −1
2
20 − 20
d. X4 = 20 =⇒ Z4 = =0 TA
2
22 − 20
e. X5 = 22 =⇒ Z5 = =1
2
U
24 − 20
f. X6 = 24 =⇒ Z6 = =2
2
IN

26 − 20
g. X7 = 26 =⇒ Z7 = =3
2
Uma relação da variável X com a variável padronizada Z é indicada na figura a seguir:
M

14 16 18 20 22 24 26 𝑋 −3 −2 −1 0 1 2 3 𝑍

14 = 𝜇𝑥 − 3𝜎 −3 = 𝜇𝑧 − 3𝜎
16 = 𝜇𝑥 − 2𝜎 −2 = 𝜇𝑧 − 2𝜎
18 = 𝜇𝑥 − 𝜎 −1 = 𝜇𝑧 − 𝜎
20 = 𝜇𝑥 0 = 𝜇𝑧
22 = 𝜇𝑥 + 𝜎 1 = 𝜇𝑧 + 𝜎
24 = 𝜇𝑥 + 2𝜎 2 = 𝜇𝑧 + 2𝜎
{ 26 = 𝜇𝑥 + 3𝜎 { 3 = 𝜇𝑧 + 3𝜎

Figura 9.8: Relação da variável X com a Z


Estatı́stica 129

É possı́vel observar que a variável Z indica quantos desvios padrões a variável X está afastada
da média.

𝜇−𝜎 𝜇 𝜇+𝜎 𝑋 −1 0 1 𝑍
𝑃(𝜇 − 𝜎 ≤ 𝑋 ≤ 𝜇) = 𝑃(𝜇 ≤ 𝑋 ≤ 𝜇 + 𝜎) 𝑃(−1 ≤ 𝑍 ≤ 0) = 𝑃(0 ≤ 𝑍 ≤ 1)

Figura 9.9: Relação da probabilidade de X e Z

TA
𝜇
U
𝑋1 𝑋2 𝑋 𝑍1 0 𝑍2 𝑍
IN

𝑃(𝑋1 ≤ 𝑋 ≤ 𝑋2 ) = 𝑃(𝑍1 ≤ 𝑍 ≤ 𝑍2 )
Figura 9.10: Igualdade das probabilidades
M

X −µ
A vantagem de se utilizar a variável Z = é que podemos tabelar os valores da área, ou
σ
as probabilidades, pois para cada dado, a área depende de µ e σ 2 . Como µ = 0 e σ 2 = 1, uma
tabela Z é suficiente.

𝑃(0 ≤ 𝑍 ≤ 𝑍𝛼 ) = 𝛼
𝛼

0 𝑍𝛼 𝑍
Figura 9.11: Área da variável com nı́vel α

Exemplo 9.3.2. Seja X : N (100; 25). Calcular:


1. P (100 ≤ X ≤ 106)
Estatı́stica 130

2. P (89 ≤ X ≤ 107)

Solução

Como µ = 100, σ 2 = 25 =⇒ σ = 5 e X : N (µ; σ 2 ) =⇒ Z : N (0; 1)

1. Segue que P (100 ≤ X ≤ 106) pode ser obtida como:

1.1 P (X1 ≤ X ≤ X2 ) = P (Z1 ≤ Z ≤ Z2 )


100 − 100 0 106 − 100 6
1.2 Z1 = = = 0 e Z2 = = = 1, 2
5 5 5 5
1.3 P (100 ≤ X ≤ 106) = P (0 ≤ Z ≤ 1, 2) = 0, 384930

2. Segue que P (89 ≤ X ≤ 107) pode ser obtida como:

2.1 P (X1 ≤ X ≤ X2 ) = P (Z1 ≤ Z ≤ Z2 )


89 − 100 −11 TA 107 − 100 7
2.2 Z1 = = = −2, 2 e Z2 = = = 1, 4
5 5 5 5
2.3 P (89 ≤ X ≤ 107) = P (−2, 2 ≤ Z ≤ 1, 4)
U
= P (−2, 2 ≤ Z ≤ 0) + P (0 ≤ Z ≤ 1, 4)
= P (0 ≤ Z ≤ 2, 2) + P (0 ≤ Z ≤ 1, 4)
IN

= 0, 486097 + 1, 419243 = 0, 90534


M
Estatı́stica 131

10 Análise de Regressão e Correlação


10.1 Diagrama de Dispersão
A coleção de recursos estatı́sticos que são utilizados para modelar e explorar relações entre
variáveis que estão relacionadas de maneira não determinı́stica é chamada de análise de regressão.
Como problemas desse tipo ocorrem com frequência em muitos ramos da engenharia e da ciência,
análise de regressão é um dos recursos muito utilizados.
Vamos supor que há somente uma variável independente ou preditor x e a relação com a res-
posta y considerada linear. Considere os dados de Nı́veis de Oxigênio e Hidrocarbonetos apresen-
tados na tabela.

Tabela 10.1: Dados de Hidrocarboneto e Purezada Água


Número da Observação Nı́vel de Hidrocarboneto x(%) Pureza y(%)
1 0,99 90,01
2 1,02 89,05
3 1,15 91,43
4 1,29 93,74
5
TA 1,46 96,73
6 1,36 94,45
7 0,87 87,59
U
8 1,23 91,77
9 1,55 99,42
IN

10 1,40 93,65
11 1,19 93,54
12 1,15 92,52
M

13 0,98 90,56
14 1,10 89,54
15 1,11 87,85
16 1,20 90,39
17 1,26 93,25
18 1,32 93,41
19 1,43 94,98
20 0,95 87,33

O diagrama de dispersão dos dados é um gráfico no qual cada par (xi , yi ) para i = 1, . . . n é
representado como um ponto plotado em um sistema bidimensional de coordenadas.

Exemplo 10.1.1. Gráfico de dispersão para os dados da Tabela 10.1


Estatı́stica 132

100

98

96

94

92

90

88

86
0,85 0,95 1,05 1,15 1,25 1,35 1,45 1,55

Figura 10.1: Dispersão dos dados de Hidrocarboneto e Purezada Água

Exemplo 10.1.2. No Software .


#Dados - Agua
##Hidrocarboneto x Pureza
TA
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
U
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
IN

93.25, 93.41, 94.98, 87.33)


par(mar = c(2.5,2.5,1,1), mgp=c(1.5,0.5,0))
plot(x,y, xlab = "NH", ylab="Pureza")
M 98
92 94 96
Pureza
90
88

0.9 1.0 1.1 1.2 1.3 1.4 1.5


NH

Figura 10.2: Gráfico de Dispersão


Estatı́stica 133

10.2 Modelo Linear Simples


Podemos considerar que a media da variável Y esteja relacionada a x pela seguinte relação
linear
E(Y |x) = β0 + β1 x
em que a inclinação β1 e a intereseção β0 da linha são chamadas de coeficientes de regressão.
Como a média de Y é uma função linear de x, o valor real observado, y, não cai exatamente na
linha reta.
A maneira de generalizar para um modelo linear probabilı́stico é considerar que o valor espe-
rado de Y seja uma função linear de x; para um valor fixo de x, o valor real de Y seja determinado
pela função do valor média (modelo linear) mais um termo de erro aleatório,
Y = β0 + β1 x + ϵ
em que ϵ é o termo de erro aleatório. Esse modelo de modelo de regressão linear simples, porque
ele tem apenas uma variável independente (ou regressor).
No caso de regressão linear simples se considera um único regressor ou preditor x e uma
variável dependente ou variável resposta Y . Consideremos que cada observação, Y , possa ser
descrita pelo modelo:
TA
Y = β0 + β1 x + ϵ
em que os coeficientes β0 (interseção) e β1 (inclinação) são desconhecidos da regressão e ϵ é um
erro aleatório com média zero e variância σ 2 (desconhecida).
U
Suponha que tenhamos n pares (x1 , y1 ), . . . (xn , yn ). Um diagrama de dispersão pode ser utilizado
para indicar uma linha estimada de regressão. As estimativas de β0 e β1 devem resultar em uma
IN

linha que sejam (em algum sentido) o “melhor ajuste”para os dados.

Valores
M

𝑦 observados (y)

Linha de regressão
estimada

𝑥
Figura 10.3: Desvios dos dados em relação ao modelo estimado de regressão.

10.2.1 Estimativas de Mı́nimos Quadrados para β0 e β1


Os parâmetros β0 e β1 do modelo
Estatı́stica 134

Y = β0 + β1 x + ϵ
podem ser estimados de modo a minimizar a soma dos quadrados dos desvios verticais pelo método
de mı́nimos quadrados. Podemos expressar as n observações na amostra como:

y i = β0 + β1 x + ϵ

para i = 1, . . . , n, sendo a soma dos quadrados dos desvios das observações me relação à linha
verdadeira de regressão dada por:
n
X n
X
L= ϵi 2 = (yi − β0 − β1 x)2
i=1 i=1

Os estimadores de mı́nimos quadrados de β0 e β1 , isto é, βb0 e βb1 tem de satisfazer


n
∂L X
= −2 (y1 − βb0 − βb1 xi ) = 0
∂β0 βb0 ,βb1 i=1
TA
n
∂L X
= −2 (y1 − βb0 − βb1 xi ) = 0
∂β1 βb0 ,βb1 i=1
U
A simplificação dessas duas equações resulta:
IN

n
X n
X
nβb0 + βb1 xi = yi
i=1 i=1
M

n
X n
X n
X
βb0 xi + βb1 x2i = y i xi
i=1 i=1 i=1

Essas equações São chamadas de equações normais dos mı́nimos quadrados. A solução para as
equações normais resulta nos estimadores de mı́nimos quadrados β0 e β1 .
As estimativas de mı́nimos quadrados da interseção e da inclinação do modelo de regressão
linear simples são:
βb0 = y − βb1 x

( ni=1 yi )( ni=1 xi )
P P
Pn
i=1 yi xi −
βb1 = P n
Pn 2 ( ni=1 xi )2
i=1 xi −
n
Pn Pn
i=1 yi xi
em que y = e x = i=1
n n
A linha de regressão ajustada ou estimada é, consequentemente,

yb = βb0 + βb1 x
Estatı́stica 135

Assim cada par (xi , yi ) para i = 1, . . . , n, satisfaz a relação

yi = βb0 + βb1 xi + ϵi

para i = 1, . . . , n, sendo ϵi os erros estimados por ei = yi − ybi denominados resı́duos da regressão.


Por conveniência vamos atribuir os sı́mbolos Sxx para o denominador e Syy para o numerador
da equação com a estimativa de βb1 :
n
( ni=1 yi )( ni=1 xi )
X P P
Sxx = y i xi −
i=1
n
n
( ni=1 xi )2
X P
2
Syy = xi −
i=1
n

Exemplo 10.2.1. Ajustar um modelo de regressão linear simples aos dados de pureza de oxigênio.

Solução
P20 P20
1. Como n = 20, xi = 24, 0100, yi = 1841, 2100,
i=1
TAi=1

Pn
x = 1, 2005, y = 92, 0605, i=1 yi xi = 2220, 4952
U
2. Sxx será obtido como:
IN

n Pn
yi )( ni=1 xi )
P
X ( i=1 (1841, 2100)(24, 0100)
Sxx = yi xi − = 2220, 4952 − ≈= 10, 1226
i=1
n 20
M

3. Syy será obtido como:

n
( ni=1 xi )2 (24, 0100)2
X P
Syy = x2i − = 29, 4791 − ≈ 0, 6551
i=1
n 20

4. Logo, as estimativas de mı́nimos quadrados da inclinação e da interseção são:


Sxx 10, 1226
βb1 = = ≈ 15, 4521
Syy 0, 6551

βb0 = y − βb1 x = 92, 0605 − (15, 4521)1, 2005 ≈ 73, 5103

5. Assim, o modelo de regressão linear simples (coeficientes com quatro casas decimais) é:

yb = 73, 5103 + 15, 4521x

6. Interpretação
Estatı́stica 136

6.1 Por meio do modelo esperarı́amos uma pureza do oxigênio yb = 88, 96, quando o nı́vel
de hidrocarboneto fosse x = 1, 0%;

6.2 A pureza de 88,96% pode ser interpretada como uma estimativa da pureza média da
população verdadeira quando x = 1, 0%;

6.3 A pureza de 88,96% pode ser interpretada também como uma estimativa de uma nova
observação quando x = 1, 0%;

Exemplo 10.2.2. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
TA
93.25, 93.41, 94.98, 87.33)

#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
U
Sxx
IN

## [1] 10.1226

Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)


M

Syy

## [1] 0.655095

beta_1 <- Sxx/Syy


beta_1

## [1] 15.4521

beta_0 <- mean(y) - beta_1 * mean(x)


beta_0

## [1] 73.5103

paste("y = ", beta_0, " + ", beta_1, "x")

## [1] "y = 73.510251108618 + 15.4521023668322 x"


Estatı́stica 137

10.2.2 Coeficiente de Determinação


Estimativa da variância dos erros σ 2
Um parâmetro desconhecido do modelo de regressão é σ 2 (a variância do termo do erro ϵ). Os
erros ϵi são estimados pelos resı́duos ei = yi − ybi e usados no cálculo da estimativa de σ 2 . A Soma
dos quadrados dos resı́duos (SQE ), frequentemente, chamada de soma dos quadrados dos erros,
por ser uma estimativa do mesmo, é dado por:
n
X n
X
SQE = e2i = (yi − ybi )2
i=1 i=1

em que ybi = βb0 + βb1 xi . Logo, SQE é obtido como:


n
X
SQE = (yi − βb0 − βb1 xi )
i=1

A SQE pode ser entendida como a variabilidade da variável dependente não explicada pelas
variáveis independentes. Essa medida representa as distâncias ao quadrado entre os valores obser-
vados de yi e seus valores ajustados pelo modelo ybi .
TA
Podemos mostrar que o valor esperado da soma dos quadrados dos erros é dado por:

E(SQE ) = (n − 2)σ 2
U
Logo um estimador não tendencioso de σ 2 é dado por:
IN

SQE
σ2 =
n−2
M

Exemplo 10.2.3. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)

#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)

beta_1 <- Sxx/Syy


beta_0 <- mean(y) - beta_1 * mean(x)
Estatı́stica 138

#Soma dos quadrados dos resı́duos - SQE

SQE <- sum((y - beta_0 - beta_1*x)ˆ2)


SQE

## [1] 30.0035

#Estimativa da variância dos Erros

sigma_E <- SQE/(length(x) - 2)


sigma_E

## [1] 1.66686

A soma dos quadrados da regressão (SQR ) é a variabilidade da variável dependente expli-


cada pelas variáveis independentes. Essa medida representa as distâncias ao quadrado dos valores
ajustados pelo modelo ybi em relação à média aritmética y. A SQR é dada por:
TAn
X
SQR = yi − y)2
(b
i=1
U
Exemplo 10.2.4. No Software .
IN

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
M

1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,


1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)

#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)

beta_1 <- Sxx/Syy


beta_0 <- mean(y) - beta_1 * mean(x)

#Soma dos quadrados da regressão - SQR

SQR <- sum((beta_0 + beta_1*x - mean(y))ˆ2)


SQR

## [1] 156.415
Estatı́stica 139

A soma total dos quadrados (SQT ) é a variabilidade total da variável dependente. Essa medida
é represntada pelas distâncias ao quadrado dos valores de yi em relação à média aritmética y. A
SQT é dada por:
n
X
SQT = (yi − y)2
i=1

Exemplo 10.2.5. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
TA
#Soma total dos quadrados - SQT

SQT <- sum((y - mean(y))ˆ2)


U
SQT
IN

## [1] 186.419
M

As medidas SQE , SQR e SQT possuem as seguintes relações:


• SQE = SQT − SQR

• SQR = SQT − SQE

• SQT = SQR + SQE


Exemplo 10.2.6. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)

#Modelo Linear
Estatı́stica 140

Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)


Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)

beta_1 <- Sxx/Syy


beta_0 <- mean(y) - beta_1 * mean(x)

#Soma dos quadrados dos resı́duos - SQE


SQE <- sum((y - beta_0 - beta_1*x)ˆ2)
SQE

## [1] 30.0035

#Soma dos quadrados da regressão - SQR


SQR <- sum((beta_0 + beta_1*x - mean(y))ˆ2)
SQR

## [1] 156.415

#Soma total dos quadrados - SQT


TA
SQT <- sum((y - mean(y))ˆ2)
SQT
U
## [1] 186.419
IN

Com a soma os quadrados é possı́vel construir a Tabela de Análise de Variância:


M

Tabela 10.2: Análise de Variância - Modelo de Regressão

Fonte GL Soma de Quadrados Quadrados Médios Fcalc


SQR SQRM
Regressão k SQR SQRM =
k SQEM
SQE
Resı́duos n − (k + 1) SQE SQEM =
n − (k + 1)
SQT
Total n−1 SQT SQET =
(n − 1)
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, k: é o número de variáveis independentes no
modelo de regressão, para o caso univariado k = 1.

O valor de Fcalc obtido na Tabela 12.6 é utilizado para realizar o seguinte teste de hipóteses
sobre o modelo de regressão, com vistas a verificar se as variáveis independentes contribuem para
explicar a variação na variável dependente.

 H0 : βk = · · · = β0 = 0 (não contribui)

H1 : Pelo menos um βj ̸= 0 (contribui)



Estatı́stica 141

A rejeição da hipótese nula H0 significa afirmar que o modelo, com um certo nı́vel de signi-
ficância α%, contribui para explicar a variável dependente y, ou seja, há relação significativa entre
pelo menos uma variável explicativa e a variável dependente.
A regra de decisão requer a obtenção do Fcrı́tico = Fk, n−2, α% que é obtido da tabela F:

 Se Fcalc < Fcrı́tico =⇒ Não rejeita H0 (não contribui)

Se Fcalc > Fcrı́tico =⇒ rejeita H0 (contribui)


Exemplo 10.2.7. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
TA
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
U
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)
IN

beta_1 <- Sxx/Syy


beta_0 <- mean(y) - beta_1 * mean(x)
M

#Soma dos quadrados dos resı́duos - SQE


SQE <- sum((y - beta_0 - beta_1*x)ˆ2)
SQE

## [1] 30.0035

#Soma dos quadrados da regressão - SQR


SQR <- sum((beta_0 + beta_1*x - mean(y))ˆ2)
SQR

## [1] 156.415

#Soma total dos quadrados - SQT


SQT <- sum((y - mean(y))ˆ2)
SQT

## [1] 186.419
Estatı́stica 142

options(digits=4)
Fonte <- c("Regressão", "Resı́duos", "Total")
GL <- c(1, length(x)-2, length(x)-1)
SQ <- c( SQR, SQE, SQT)
SQM <- c( SQR/1, SQE/(length(x)-2), SQT/(length(x) - 1))
F_calc <- c((SQR/1)/(SQE/(length(x)-2)), NA, NA)

tab_anova <- [Link](Fonte, GL, SQ, SQM, F_calc)


tab_anova

## Fonte GL SQ SQM F_calc


## 1 Regressão 1 156.4 156.415 93.84
## 2 Resı́duos 18 30.0 1.667 NA
## 3 Total 19 186.4 9.812 NA

#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
TA
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, 1, (length(x) - 2), [Link]=F)
U
F_tab_5
IN

## [1] 4.414

F_tab_10 <- qf(0.1, 1, (length(x) - 2), [Link]=F)


M

F_tab_10

## [1] 3.007

#Decisão - 5% de significância - 95% de Confiança


ifelse(F_calc[1] < F_tab_5, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

#Decisão - 10% de significância - 90% de Confiança


ifelse(F_calc[1] < F_tab_10, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

O coeficiente de determinação R2 é uma estimativa da proporção da variabilidade da variável


dependente (Y ) que é explicada pelas k variáveis independentes X do modelo de regressão. O R2
é uma medida que varia de 0 que indica independência linear até 1 que indica uma relação linear
exata, isto é, 0 ≤ R2 ≤ 1. O R2 é dado por:
Estatı́stica 143

SQR SQE
R2 = =1−
SQT SQT
Exemplo 10.2.8. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)

#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x) TA
beta_1 <- Sxx/Syy
beta_0 <- mean(y) - beta_1 * mean(x)
U
#Soma dos quadrados dos resı́duos - SQE
SQE <- sum((y - beta_0 - beta_1*x)ˆ2)
IN

SQE

## [1] 30
M

#Soma dos quadrados da regressão - SQR


SQR <- sum((beta_0 + beta_1*x - mean(y))ˆ2)
SQR

## [1] 156.4

#Soma total dos quadrados - SQT


SQT <- sum((y - mean(y))ˆ2)
SQT

## [1] 186.4

#Coeficiente de determinação
R2 <- SQR/SQT
R2

## [1] 0.8391
Estatı́stica 144

2
O coeficiente de determinação ajustado (Rajus ), é obtido por meio de uma ponderação do coe-
2
ficiente de determinação (R ) pelo número de variáveis explicativas e pelo número de observações
2
da amostra. O Rajus é utilizado quando fazemos compararações de modelos de regressão múltipla
que prevêem a mesma variável dependente, pois penaliza aquele modelo com maior número de
2
variáveis independentes. O Rajus é dado por:
SQE
2 n − (k + 1) n−1
Rajus =1− = 1 − (1 − R2 )
SQT n − (k + 1)
(n − 1)
Exemplo 10.2.9. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
TA
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)
U
#Modelo Linear
Sxx <- sum(x * y) - (sum(y) * sum(x))/length(x)
IN

Syy <- sum(xˆ2) - ((sum(x))ˆ2)/length(x)

beta_1 <- Sxx/Syy


M

beta_0 <- mean(y) - beta_1 * mean(x)

#Soma dos quadrados dos resı́duos - SQE


SQE <- sum((y - beta_0 - beta_1*x)ˆ2)
SQE

## [1] 30

#Soma dos quadrados da regressão - SQR


SQR <- sum((beta_0 + beta_1*x - mean(y))ˆ2)
SQR

## [1] 156.4

#Soma total dos quadrados - SQT


SQT <- sum((y - mean(y))ˆ2)
SQT

## [1] 186.4
Estatı́stica 145

#Coeficiente de determinação
R2 <- SQR/SQT
R2

## [1] 0.8391

#Coeficiente de determinação ajustado


R2_ajus <- 1- (SQE/(length(x) - 2))/(SQT/(length(x) - 1))
R2_ajus

## [1] 0.8301

10.3 Coeficiente de Correlação de Pearson


Quando duas ou mais variáveis aleatórias são definidas em um espaço probabilı́stico, é útil
descrever como elas variam conjuntamente; ou seja, é útil medir a relação entre as variáveis. Uma
medida comum da relação entre duas variáveis aleatórias é a correlação.
TA
A correlação entre as variáveis aleatórias X e Y , denotada por ρXY , é definida por:

cov(X, Y ) σXY
ρXY = p =
V AR(X) · V AR(Y ) σX σY
U
em que cov(X, Y ) = E(XY ) − µX µY . Como σX > 0 e σY > 0, se a covariância entre X e Y
IN

for positiva, negativa ou zero, a correlação entre X e Y será positiva, negativa ou zero, respectiva-
mente. Um resultado importante sobre ρXY , é que para quaisquer duas variáveis aleatórias X e Y ,
se tem:
M

−1 ≤ ρXY ≤ 1
A correlação só escalona a covariância por meio do desvio-padrão de cada variável. Duas
variáveis aleatórias X e Y com correlação não zero são ditas estar correlacionadas. A correlação e
a covariância são medidas da relação linear entre as variáveis aleatórias.
O coeficiente ρXY é também chamado de correlação de Pearson, e pode ser calculado por:
Pn
cov(X, Y ) (xi − x) · (yi − y)
ρXY = p = pPn i=1 pPn
2 2
V AR(X) · V AR(Y ) i=1 (xi − x) · i=1 (yi − y)

1 Pn 1 Pn
em que x1 . . . , xn e x1 . . . , xn são valores das variáveis X e Y , x = i=1 xi e y = yi
n n i=1
são as médias de X e Y .

Exemplo 10.3.1. No Software .

#Dados - Agua
##Hidrocarboneto x Pureza
x <- c(0.99, 1.02, 1.15, 1.29, 1.46, 1.36, 0.87, 1.23, 1.55,
1.40, 1.19, 1.15, 0.98, 1.10, 1.11, 1.20, 1.26, 1.32,
Estatı́stica 146

1.43, 0.95)
y <- c(90.01, 89.05, 91.43, 93.74, 96.73, 94.45, 87.59, 91.77,
99.42, 93.65, 93.54, 92.52, 90.56, 89.54, 87.85, 90.39,
93.25, 93.41, 94.98, 87.33)

#Correlação
rho_xy <- sum((x - mean(x)) * (y - mean(x)))/
(sqrt(sum((x - mean(x))ˆ2)) * sqrt(sum((y - mean(y))ˆ2)))
rho_xy

## [1] 0.916

10.3.1 Sentido e Força da Correlação


O coeficiente de correlação é tal que

−1 ≤ ρXY ≤ 1
TA
sendo que O sinal indica o sentido, se a correlação é positiva ou negativa. E o valor indica a força
da correlação, ou seja, mais próximos de -1 e 1 indicam correlação mais forte. A Figura a seguir
ilustra a relação da dispersão dos pontos com a correlação.
U
Sentido Força
IN

y y
y y
M

x x
Correlação Positiva Correlação Negativa x x
Correlação “mais” forte Correlação “mais” fraca

x
Correlação Zero

Figura 10.4: Sentido e Força da Correlação

Uma vez calculado o valor da correlação ρXY uma interpretação que poser ser realizada para
ρXY é:

1. 0,9 a 1,0 positivo ou negativo, se tem uma correlação muito forte;

2. 0,7 a 0,9 positivo ou negativo, correlação forte;


Estatı́stica 147

3. 0,5 a 0,7 positivo ou negativo, correlação moderada;

4. 0,3 a 0,5 positivo ou negativo, correlação fraca;

5. 0,0 a 0,3 positivo ou negativo, correlação desprezı́vel.

Exemplo 10.3.2. Considere os dados da tabela abaixo:

Tabela 10.3: Dados do Exemplo


Anos de estudo (x) Renda (y)
3 1
4 3
6 4
8 6
10 9
TA
12 10
U
1. Construir o gráfico de dispersão;

2. Determinar os parâmetros para o modelo linear simples;


IN

3. Interpretar o modelo linear;


M

4. Estimar a variânia dos erros σ 2 ;

5. Construir a tabela da análise de variância;

6. Fazer o teste de hipótese sobre os parâmetros do modelo;

7. Calcular o coeficiente de determinação R2 .

Solução

1. Gráfico de dispersão
Estatı́stica 148

10
8
Renda
6 4
2

4 6 8 10 12
Anos Estudo

Figura 10.5: Gráfico de Dispersão

P6 P20
TA
2. Como n = 6, i=1 xi = 43, i=1 yi = 33,
Pn
x = 7, 1667, y = 5, 5, yi xi = 297
U
i=1

(a) Sxx será obtido como:


IN

n Pn
yi )( ni=1 xi )
P
X ( i=1 (33)(43)
Sxx = yi xi − = 297 − = 60, 5
n 6
M

i=1

(b) Syy será obtido como:


n
( ni=1 xi )2 (1849)2
X P
Syy = x2i − = 369 − = 60, 833
i=1
n 6

(c) Logo, as estimativas de mı́nimos quadrados da inclinação e da interseção são:


Sxx 60, 5
βb1 = = ≈ 0.99453
Syy 60, 833

βb0 = y − βb1 x = 5, 5 − (0, 99453)7, 1667 ≈ −1, 6275


(d) Assim, o modelo de regressão linear simples (coeficientes com quatro casas decimais)
é:
yb = −1, 6275 + 0, 99453x

3. Interpretação
Estatı́stica 149

6.1 Por meio do modelo esperarı́amos uma renda de yb = 1.3561, 00, para três anos de
estudo, ou seja, para x = 3 anos.

4. O estimador de σ 2 é dado por:

SQE
σ2 =
n−2
Pn
(a) Como n = 6 e SQE = i=1 (yi − βb0 − βb1 xi ) = 1, 331609, segue que

(b) A estimativa de σ 2 será:


SQE 1, 331609 1, 331609
σ2 = = = = 0, 332902
n−2 6−2 4

5. Para a tabela da análise de variância é necesssáro SQE = 1, 331609 e também da SQR e


SQT .

(a) A SQT = 61, 5, como SQR = SQT − SQE = 61, 5 − 1, 331609 = 60, 168391
TA
(b) Logo, a tabela será:

Tabela 10.4: Análise de Variância - Modelo de Regressão


U
Fonte GL Soma de Quadrados Quadrados Médios Fcalc
IN

60, 16839 60, 16839


Regressão 1 60, 16839 SQRM = = 180, 73891
1 0, 33290
M

1, 33161
Resı́duos 4 1, 33161 SQEM =
4
61, 5
Total 5 61, 5 SQT M =
5
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, k: é o número de variáveis independentes no
modelo de regressão, para o caso univariado k = 1.

6. Pela regra de decisão se Fcalc < Fcrı́tico se rejeita a hipótese nula H0 com nı́vel de signi-
ficância α%.

(a) Como Fcalc = 180, 73891

(b) Fcrı́tico = Fk, n−2, α% = F1, 4, 5% = 7, 7086 e

(c) Fcrı́tico = F1, 4, 10% = 4, 5448

(d) A 5% de significância se rejeita H0, pois Fcalc = 180, 73891 > 7, 7086 = Fcrı́tico

(e) A 10% de significância se rejeita H0, pois Fcalc = 180, 73891 > 4, 5448 = Fcrı́tico
Estatı́stica 150

7. O coeficiente de determinção R2 é igual:


SQR 60, 16839
R2 = = ≈ 0, 9783
SQT 61, 5

Exemplo 10.3.3. No Software .

#Dados - Renda
##Anos de Estudo x Renda
x <- c(3, 4, 6, 8, 10, 12)
y <- c(1, 3, 4, 6, 9, 10)

#Grafico Dispersão
par(mar = c(2.5,2.5,1,1), mgp=c(1.5,0.5,0))
plot(x,y, xlab="Anos Estudo", ylab="Renda")
10

TA
8

U
Renda
6

IN
4
M 2

4 6 8 10 12
Anos Estudo

Figura 10.6: Gráfico de Dispersão

#Parametros do Modelo
lm(y˜x)

##
## Call:
## lm(formula = y ˜ x)
##
## Coefficients:
## (Intercept) x
## -1.627 0.995
Estatı́stica 151

#Interpretar: Discursivo

#Estimar Variancia dos Erros


#SQE
y_est <- -1.62740 +0.99452*x
SQE <- sum((y - y_est)ˆ2)

sigma2 <- SQE/(length(x) - 2)

#Tabela Analise de Variancia


SQT <- sum((y - mean(y))ˆ2)
SQR <- SQT - SQE

Fonte <- c("Regressao", "Residuos", "Total")


GL <- c(1, 4, 5)
SQ <- c(SQR, SQE, SQT)
QM <- c(SQR/1, SQE/4, SQT/5)
F_calc <- c((SQR/1)/(SQE/4), NA, NA)
TA
tab_anova <- [Link](Fonte, GL, SQ, QM, F_calc)
tab_anova
U
## Fonte GL SQ QM F_calc
IN

## 1 Regressao 1 60.168 60.1685 180.8


## 2 Residuos 4 1.332 0.3329 NA
## 3 Total 5 61.500 12.3000 NA
M

#Decisão
#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, 1, (length(x) - 2), [Link]=F)
F_tab_10 <- qf(0.1, 1, (length(x) - 2), [Link]=F)

#Decisão - 5% de significância - 95% de Confiança


ifelse(F_calc[1] < F_tab_5, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

#Decisão - 10% de significância - 90% de Confiança


ifelse(F_calc[1] < F_tab_10, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"


Estatı́stica 152

11 Intervalos de Confiança - IC
O objetivo da Estatı́stica é conhecer populações por meio das informações amostrais. Como as
populações são caracterizadas por medidas numéricas descritivas, denominadas parâmetros, a es-
tatı́stica diz respeito a realização de inferências sobre esses parâmetros populacionais desconheci-
dos. Parâmetros populacionais tı́picos são a média, denotado por x (amostral) ou µ (populacional),
o desvio padrão, denotado por s (amostral) ou σ (populacional) ou a proporção (p) de determinado
evento populacional.

Os métodos para realizar inferências a respeito dos parâmetros pertencem a duas categorias:

• Estimação: determinação de estimativas dos parâmetros populacionais;

• Teses de hipóteses: a tomada de decisão está relacionada ao valor de um parâmetro popula-


cional.

Quando com base em dados amostrais calculamos um valor da estimativa do parâmetro po-
pulacional, temos uma estimativa por ponto do parâmetro considerado. Assim, o valor da média
amostral (x) é uma estimativa por ponto da média populacional (µ). De maneira análoga, o valor
TA
do desvio padrão amostral (s) constitui uma estimativa do parâmetro (σ).

Exemplo 11.0.1. Uma amostra aleatória de 260 alunos de uma universidade de 30.000 estudantes
U
revelou nota média amostral de 7,2. Lgo, x = 7, 2 é uma estimativa pontual da verdadeira média
dos 30.000 alunos.
IN

As principais caracterı́sticas de um estimador são:

• Não-tendenciosidade: quando o valor esperado da estatı́stica amostral for aproximadamente


M

igual ao parâmetro que está sendo estimado;

• Consistente: quando em termos práticos, pode-se com amostras suficientemente grandes


tornar o erro de estimação tão pequeno quanto se queira;

• Eficiência: Consegue descrever a população com pequena margem de erro.

Uma estimativa por intervalo para um parâmetro populacional é um intervalo determinado


por dois números, obtidos a partir de elementos amostrais, que se espera contenham o valor do
parâmetro com dado nı́vel de confiança ou probabilidade de (1 − α)%. É comum a utilização de
(1 − α)% = 90%, 95%, 97, 5%.

Exemplo 11.0.2. O intervalo [1,55 m; 1,74m] contém a altura média dos habitantes de uma certa
região, com um nı́vel de confiança de 95%.

Exemplo 11.0.3. Com 97,5% de confiança, o intervalo [12%; 16%] contém a proporção de anal-
fabetos de uma certa cidade.

Exemplo 11.0.4. O intervalo [10mm; 13,2mm] contém o desvio padrão do comprimento de uma
peça produzida por uma certa máquina, com 90% de confiança.
Estatı́stica 153

11.1 IC para a Média Populacional - Variância Populacional Conhecida


Os métodos de estimação por intervalo estão na maioria de suas vezes baseados no pressuposto
de que possa ser usada a distribuição normal de probabilidades. Esta pressuposição é garantida
sempre que o número de dados amostrados é maior que 30(n ≥ 30).
Sejam x1 , . . . , xn elementos de uma amostra. Então X : N (µ, σ 2 .
 
σ σ
IC(x, (1 − α)%) = P x − Zα/2 · √ ≤ µ ≤ x + Zα/2 · √
n n
Interpretação Geométrica de Zα/2 .

𝜑 =𝑛−1

𝛼 TA 𝛼
2 2
−𝑍𝛼 0 𝑍𝛼 𝑋
2 2
U
Figura 11.1: Interpretação geométrica do nı́vel de confiança (1 − α)%
IN

Como a distribuição normal é simétrica, pode ser utilizado os valores da área P (0 < Z < Zα )
delimitada pelo curva normal, pelo eixo de Z e pelas retas Z = 0 e Z = Zα . No caso Z : N (0, 1)
alguns valores para P (0 < Z < Zα ) são apresentados na Tabela (11.1), recorte da tabela normal
M

padronizada apresentada na Seção (13)

𝑃(0 < 𝑍 < 𝑍𝛼 )


𝛼

0 𝑍𝛼 𝑍

Figura 11.2: Valores da área


Estatı́stica 154

Tabela 11.1: Tabela Normal Padronizada - Recorte


Z 0,00 0,01 0,02 0,03 0,04 0,05 0,06 0,07 0,08 0,09 Z
1,20 0,384930 0,386860 0,388767 0,390651 0,392512 0,394350 0,396165 0,397958 0,399727 0,401475 1,20
1,30 0,403199 0,404902 0,406582 0,408241 0,409877 0,411492 0,413085 0,414656 0,416207 0,417736 1,30
1,40 0,419243 0,420730 0,422196 0,423641 0,425066 0,426471 0,427855 0,429219 0,430563 0,431888 1,40
1,50 0,433193 0,434478 0,435744 0,436992 0,438220 0,439429 0,440620 0,441792 0,442947 0,444083 1,50
1,60 0,445201 0,446301 0,447384 0,448449 0,449497 0,450529 0,451543 0,452540 0,453521 0,454486 1,60
1,70 0,455435 0,456367 0,457284 0,458185 0,459071 0,459941 0,460796 0,461636 0,462462 0,463273 1,70
1,80 0,464070 0,464852 0,465621 0,466375 0,467116 0,467843 0,468557 0,469258 0,469946 0,470621 1,80
1,90 0,471284 0,471933 0,472571 0,473197 0,473810 0,474412 0,475002 0,475581 0,476148 0,476705 1,90
2,00 0,477250 0,477784 0,478308 0,478822 0,479325 0,479818 0,480301 0,480774 0,481237 0,481691 2,00
2,10 0,482136 0,482571 0,482997 0,483414 0,483823 0,484222 0,484614 0,484997 0,485371 0,485738 2,10
2,20 0,486097 0,486447 0,486791 0,487126 0,487455 0,487776 0,488089 0,488396 0,488696 0,488989 2,20
2,30 0,489276 0,489556 0,489830 0,490097 0,490358 0,490613 0,490863 0,491106 0,491344 0,491576 2,30
2,40 0,491802 0,492024 0,492240 0,492451 0,492656 0,492857 0,493053 0,493244 0,493431 0,493613 2,40
2,50 0,493790 0,493963 0,494132 0,494297 0,494457 0,494614 0,494766 0,494915 0,495060 0,495201 2,50

Os valores destacados na Tabela (11.1) correspondem as áreas P (0 < Z < Zα ) para o nı́vel de
significância α = 20%, 15%, 10%, 5%, 2, 5%e1%, conforme a Tabela (11.2) a seguir:
TA
Tabela 11.2: Valores para alguns nı́veis de significância
α (1 − α) Zα
0,20 0,80 1,28
U
0,15 0,85 1,44
IN

0,10 0,90 1,65


0,05 0,95 1,96
0,025 0,975 2,24
M

0,01 0,99 2,58


Nota: α: nivel de significância, (1 − α): nı́vel de confiança,
Zα : valor da normal padronizada.
Exemplo 11.1.1. Seja X a duração da vida de uma peça de equipamento tal que σ = 5h.
Ensaiaram-se 100 peças e estas forneceram uma duração média de vida de 500 horas. Cons-
trua o IC com 95% de confiança para a média µ.
Solução

1. x = 500h, σ = 5h, Zα/2 = 1, 96, n = 100.

2. O IC será dado por:


 
σ σ
IC(x, (1 − α)%) = P x − Zα/2 · √ ≤ µ ≤ x + Zα/2 · √
n n
 
5 5
= P 500 − 1, 96 · √ ≤ µ ≤ 500 + 1, 96 · √
100 100
= P (499, 02 ≤ µ ≤ 500, 98)
Estatı́stica 155

3. O IC pode ser expresso como:


[499, 02; 500, 98]

4. A interpretação é que a verdadeira média na população é um valor maior ou igual ao limite


inferior e menor ou igual ao limite superior do intervalo de confiança com 5% de signi-
ficância.
Exemplo 11.1.2. No Software .

options(digits=8)
x_med <- 500; sigma <- 5; alpha<-0.05; n <- 100
Z_alpha5 <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)
IC <- c(x_med - Z_alpha5*sigma/sqrt(n),
x_med + Z_alpha5*sigma/sqrt(n))
IC

## [1] 499.02002 500.97998

11.2
TA
IC para a Média Populacional - Variância Populacional Desconhecida
Quando desconhecemos σ 2 , devemos estimar seu valor com base na amostra disponı́vel. Neste
caso, calcula-se a estimativa do desvio padrão a partir da amostra com a expressão:
U
" n #
Pn 2
1 X ( x
i=1 i )
s2 = x2 −
IN

n − 1 i=1 i n
A substituição do parâmetro σ por s somente será justificável para amostras grandes, ou seja,
para n ≥ 30. Em caso contrário, introduz-se uma correção a qual consiste em usar a variável t de
M

Student com n − 1 graus de liberdade (g.l.) ao invés de Z.

Função densidade de probabilidade


t de Student
𝛼
𝑝 − 𝑣𝑎𝑙𝑜𝑟 𝑝 − 𝑣𝑎𝑙𝑜𝑟
2 2

−𝑡 0 𝑡
Figura 11.3: Curva da função de densidade t

Uma distribuição t de Student é apropriada para inferências sobre a média quando σ for des-
conhecida e a população normalmente distribuı́da, qualquer que seja o tamanho da amostra. A
expressão do IC com a t de Student é dada por:
 
s s
IC(µ, (1 − α)%) = P x − tn−1, α/2 · √ ≤ µ ≤ x + tn−1, α/2 · √
n n
Estatı́stica 156

Exemplo 11.2.1. A seguinte amostra: 9, 8, 7, 12, 9, 6, 11, 6, 10, 9 foi extraı́da de uma população
normal. Construir um intervalo de confiança para a média (µ) ao nı́vel de 95% de confiança.

Solução

1. Para determinar o IC, o tamanho da amostra n deve ser considerado, de forma que
 
σ σ
(a) Se n ≥ 30, IC(x, (1 − α)%) = P x − Zα/2 · √ ≤ µ ≤ x + Zα/2 · √
n n
 
s s
(b) Se n < 30, IC(µ, (1 − α)%) = P x − tn−1, α/2 · √ ≤ µ ≤ x + tn−1, α/2 · √
n n

2. σ 2 pode ser estimado por s2 da seguinte forma:


" n #
Pn 2
1 X ( x
i=1 i )
s2 = x2 −
n − 1 i=1 i n

=
1
10 − 1
TA
793 −
7569
10

= 4, 01111

3. Como
U
87
(a) x = = 8, 7,
10
IN

(b) Para α = 5%, tn−1, α/2 = t10−1, 0,05/2 = t9, 0,025 ≈= 2, 26


√ √
M

(c) s = s2 = 4, 01111 ≈ 2, 0 e

(d) n = 10.

4. O IC será dado por:


 
s s
IC(µ, (1 − α)%) = P x − tn−1, α/2 · √ ≤ µ ≤ x + tn−1, α/2 · √
n n
 
2, 0 2, 0
= P 8, 7 − 2, 26 · √ ≤ µ ≤ 8, 7 + 2, 26 · √
10 10
= P (7, 27 ≤ µ ≤ 10, 13)

5. O IC pode ser expresso por:


IC = [7, 27; 10, 13]

6. A interpretação é que a verdadeira média na população é um valor maior ou igual ao limite


inferior e menor ou igual ao limite superior do intervalo de confiança com 5% de signi-
ficância.
Estatı́stica 157

𝑃ሺ𝑡 > 𝑡𝛼 ሻ = 𝛼

0 𝑡𝛼 𝑡

O valor tn−1, α/2 com n = 10 e α = 0, 05, é indicado na Tabela (11.3) recorte da tabela t da
Seção 13. Nessa tabela ϕ é o grau de liberdade e α é o nı́vel de significância. O valor de t9, 0,025
será:

Tabela 11.3: Tabela t - Recorte


ϕ/α 0,1 0,05 0,025 0,01 0,005
1 3,0777 6,3137 12,7062 31,8210 63,5590
2 1,8856 2,9200
TA 4,3027 6,9645 9,9250
3 1,6377 2,3534 3,1824 4,5407 5,8408
4 1,5332 2,1318 2,7765 3,7469 4,6041
5 1,4759 2,0150 2,5706 3,3649 4,0321
6 1,4398 1,9432 2,4469 3,1427 3,7074
U
7 1,4149 1,8946 2,3646 2,9979 3,4995
8 1,3968 1,8595 2,3060 2,8965 3,3554
9 1,3830 1,8331 2,2622 2,8214 3,2498
IN

10 1,3722 1,8125 2,2281 2,7638 3,1693

Exemplo 11.2.2. No Software .


M

options(digits=3)
x <- c(9, 8, 7, 12, 9, 6, 11, 6, 10, 9)
x_med <- mean(x)
n <- length(x)
t_value <- qt(p = 0.025, df = (n-1), [Link]=F)
s2 <- 1/(length(x) - 1) * (sum(xˆ2) - sum(x)ˆ2/length(x))
s <- sqrt(s2)
IC <- c(x_med - t_value*s/sqrt(n), x_med + t_value*s/sqrt(n))
IC

## [1] 7.27 10.13

11.3 IC para a Proporção ou Probabilidade


A proporção populacional p de sucessos em uma população pode ser estimada pela proporção
de sucessos em uma amostra, indicada por p, obtida por:
Estatı́stica 158

x
pb =
n
em que x é o número de sucessos (casos favoráveis) e n é tamanho da amostra (número total
de casos observados). O intervalo de confiança para a proporção p, considerando n > 30 é dado
por:
r r !
pb(1 − pb) pb(1 − pb)
IC(p, (1 − α)%) = P pb − Zα/2 · ≤ p ≤ pb + Zα/2 ·
n n
Exemplo 11.3.1. Dentre 500 pessoas que foram entrevistadas a respeito de suas preferências
eleitorais, 260 mostraram-se favoráveis ao candidato y. Calcule o IC ao nı́vel de 90% para a
proporção de eleitores favoráveis ao candidato y.
Solução

1. Como n = 500, x = 260, a proporção p será:


x 260
pb = = = 0, 52
n 500 TA
2. Para α = 10% = 0, 1, se tem que Zα/2 = Z0,1/2 = Z0,05 = 1, 65

3. O IC será dador por:


U
r r !
pb(1 − pb) pb(1 − pb)
IC(p, (1 − α)%) = P pb − Zα/2 · ≤ p ≤ pb + Zα/2 ·
n n
IN

r r !
0, 52(1 − 0, 52) 0, 52(1 − 0, 52)
=P 0, 52 − 1, 65 · ≤ p ≤ 0, 52 + 1, 65 ·
n n
M

= P (0, 483 ≤ p ≤ 0, 557)

4. O IC pode ser expresso por:


IC = [0, 483; 0, 557]
Exemplo 11.3.2. No Software .

options(digits=4)
n <- 500
x <- 260
p <- x/n
alpha <- 0.1
Z_alpha1 <- qnorm(alpha/2, mean = 0, sd = 1, [Link] = FALSE)

IC <- c(p - Z_alpha1*sqrt(p*(1 - p)/n),


p + Z_alpha1*sqrt(p*(1 - p)/n))
IC

## [1] 0.4832 0.5568


Estatı́stica 159

11.4 IC para a Variância Populacional


Para determinarmos o IC ao nı́vel de (1 − α) para a variância σ 2 da população. Neste caso pode
ser usada a famı́lia das distribuições χ2 chi-quadrado.
!
2 2
s · (n − 1) s · (n − 1)
IC(σ 2 , (1 − α)%) = P ≤ σ2 ≤ 2
χ2n−1, α/2 χn−1, 1−α/2

𝑓(𝜒 2 𝑖)
𝜑 =𝑛−1

𝛼
1−𝛼 𝛼
2
2
2 2
𝜒𝐼𝑛𝑓𝑒𝑟𝑖𝑜𝑟 𝜒𝑆𝑢𝑝𝑒𝑟𝑖𝑜𝑟 𝜒2
TA
Exemplo 11.4.1. Os dados sobre a voltagem de quebra de circuitos eletricamente foram obtidos
U
de um gráfico de probabilidade normal com 17 pontos. Sabe-se que a variância da distribuição
da voltagem de quebra é de 137324,3. Construir um I.C. de 95% de confiança.
IN

Solução

1. Como
M

(a) O tamanho da amostra n = 17 e a variância s2 = 137324, 3

(b) Para α = 5%, se tem que:


χ2n−1, α/2 = χ217−1, 0,05/2 = χ216, 0,025 = 28, 845 e

χ2n−1, 1−α/2 = χ217−1, 1−0,05/2 = χ216, 1−0,025 = chi216, 0,975 = 6, 907

2. O IC será dado por: !


s2 · (n − 1) s2 · (n − 1)
IC(σ 2 , (1 − α)%) = P ≤ σ 2

χ2n−1, α/2 χ2n−1, 1−α/2
 
137324, 3 · (17 − 1) 137324, 3 · (17 − 1)
=P ≤ σ2 ≤
28, 845 6, 907

= P 76172, 259 ≤ σ 2 ≤ 318110, 439




3. O IC pode ser expresso por:


IC = [76172, 259; 318110, 439]
Estatı́stica 160

Exemplo 11.4.2. No Software .

options(digits=8)
n <- 17
s2 <- 137324.3
alpha <- 0.05

chi_lim_inf <- qchisq(alpha/2, df=(n - 1), [Link]=FALSE)


chi_lim_sup <- qchisq(1 - alpha/2, df=(n - 1), [Link]=FALSE)

IC <- c(s2*(n-1)/chi_lim_inf, s2*(n-1)/chi_lim_sup)


IC

## [1] 76171.332 318079.844

𝑃ሺ𝜒 2 > 𝜒𝛼2 ሻ = 𝛼


TA
𝛼
U

0 𝜒𝛼2 𝜒2
IN
M

Tabela 11.4: Tabela χ2 - Recorte


ϕ/α 0,995 0,99 0,975 0,95 0,9 0,8 0,75 0,25 0,2 0,1 0,05 0,025 0,01 0,005 ϕ/α
10 2,1558 2,5582 3,2470 3,9403 4,8652 6,1791 6,7372 12,5489 13,4420 15,9872 18,3070 20,4832 23,2093 25,1881 10
11 2,6032 3,0535 3,8157 4,5748 5,5778 6,9887 7,5841 13,7007 14,6314 17,2750 19,6752 21,9200 24,7250 26,7569 11
12 3,0738 3,5706 4,4038 5,2260 6,3038 7,8073 8,4384 14,8454 15,8120 18,5493 21,0261 23,3367 26,2170 28,2997 12
13 3,5650 4,1069 5,0087 5,8919 7,0415 8,6339 9,2991 15,9839 16,9848 19,8119 22,3620 24,7356 27,6882 29,8193 13
14 4,0747 4,6604 5,6287 6,5706 7,7895 9,4673 10,1653 17,1169 18,1508 21,0641 23,6848 26,1189 29,1412 31,3194 14
15 4,6009 5,2294 6,2621 7,2609 8,5468 10,3070 11,0365 18,2451 19,3107 22,3071 24,9958 27,4884 30,5780 32,8015 15
16 5,1422 5,8122 6,9077 7,9616 9,3122 11,1521 11,9122 19,3689 20,4651 23,5418 26,2962 28,8453 31,9999 34,2671 16
17 5,6973 6,4077 7,5642 8,6718 10,0852 12,0023 12,7919 20,4887 21,6146 24,7690 27,5871 30,1910 33,4087 35,7184 17
18 6,2648 7,0149 8,2307 9,3904 10,8649 12,8570 13,6753 21,6049 22,7595 25,9894 28,8693 31,5264 34,8052 37,1564 18

11.5 IC para o Desvio padrão Populacional


Para determinarmos o IC ao nı́vel de (1 − α) para a o desvio padrão populacional σ, pode ser
usada a famı́lia das distribuições χ2 chi-quadrado.
s s !
s2 · (n − 1) s2 · (n − 1)
IC(σ, (1 − α)%) = P ≤σ≤
χ2n−1, α/2 χ2n−1, 1−α/2
Estatı́stica 161

Exemplo 11.5.1. No Exemplo 11.4.1 o IC obtido para a variância foi:

IC = [76172, 259; 318110, 439]

1. Como, s s !
s2 · (n − 1) s2 · (n − 1)
IC(σ, (1 − α)%) = P ≤σ≤
χ2n−1, α/2 χ2n−1, 1−α/2
√ √
2. Para determinar o IC para o desvio padrão s = s2 = 137324.3 ≈= 370.57293, basta
extrair a raiz quadrada dos limites do IC para a variância, ou seja:
p √ p 
IC(σ, (1 − α)%) = P 76172, 259 ≤ σ 2 ≤ 318110, 439

= P (275, 99154 ≤ σ ≤ 563.98568)


3. O IC pode ser expresso por:

IC = [275, 99154; 563.98568]


TA
Exemplo 11.5.2. No Software .

options(digits=8)
U
n <- 17
s2 <- 137324.3
IN

alpha <- 0.05

chi_lim_inf <- qchisq(alpha/2, df=(n - 1), [Link]=FALSE)


M

chi_lim_sup <- qchisq(1 - alpha/2, df=(n - 1), [Link]=FALSE)

IC <- c(s2*(n-1)/chi_lim_inf, s2*(n-1)/chi_lim_sup)


sqrt(IC)

## [1] 275.99154 563.98568

11.6 Exercı́cios
1. A voltagem de quebra da corrente alternada (CA) de um lı́quido isolante indica sua resistência
dielétrica. Construa um intervalo de confiança com 1% de margem de erro, sabendo que foram
amostradas 48 tensões de quebra, com média de 54,7 kV e desvio padrão de 5,23 kV.

2. Em uma amostra aleatória, de 85 mancais de eixos de manivelas de motores de automóveis


10 tem uma superfı́cie que é mais rugosa do que as especificações permitidas. Faça uma
estimativa da proporção de mancais na população que excede a especificação de rugosidade
com 95% de confiança.
Estatı́stica 162

3. Sabe-se que o tempo de vida de certo tipo de válvula tem distribuição aproximadamente nor-
mal. Uma amostra de 25 válvulas forneceu e s = 50. Construir um I.C. para σ 2 , ao nı́vel de
2%.

4. Uma amostra de onze elementos, extraı́da de uma população com distribuição normal, forne-
ceu variância s2 = 7, 08 . Construir um I.C. de 90% para a variância da população.

TA
U
IN
M
Estatı́stica 163

12 Testes de Hipóteses
Uma hipótese em estatı́stica pode ser entendida como uma alternativa relativa a um parâmetro
de uma distribuição de probabilidade. Em estatı́stica é utilizado uma hipótese nula, denotada por
H0 , associada a um valor suposto para um parâmetro populacional. Com o uso da amostra esse
parâmetro é estimado, e se o resultado não for muito diferente do parâmetro a hipótese H0 não
poderá ser rejeitada. A hipótese alternativa, denotada por H1 , é uma hipótese que contraria a
hipótese nula. Essa hipótese, em estatı́stica, é aceita se os resultados da amostra forem diferentes
da indicada em H0 .
No processo de testar hipóteses, podem ocorrer, dois tipos de erros, denominados erro de Tipo
I e erro de Tipo II. O erro de tipo I ocorre ao rejeitar a hipótese nula (H0 ), quando na realidade ela
é verdadeira, esse erro também é chamdo de falsos positivos. O erro tipo II ocorre se a hipótese
nula (H0 ) não é rejeitada, quando na verdade ela é falsa, esses erro também é chamado de falsos
negativos. O quadro abaixo resumos os erros de Tipo I e II.

𝐻0 : Hipótese Nula Realidade


𝐻1 : Hipótese Alternativa 𝐻0 Verdadeira
TA 𝐻0 Falsa
Rejeitar 𝐻0 Erro Tipo I Decisão Correta
Decisão
Não Rejeitar 𝐻0 Decisão Correta Erro Tipo II
U
Figura 12.1: Erros de tipo I e II
IN

Geralmente, a hipótese nula é estabelecida com base no comportamento passado, já a alter-
nativa é formulada em função de alterações ou inovações recentes. Na realização de um teste de
hipóteses, é comum passar pelos seguintes passos:
M

1. Definir a hipótse nula H0 ;

2. Calcular a estatı́stica do teste;

3. Determinar a região crı́tica.

4. Utilizar a regra de decisão para rejeitar ou não H0 .

A estatı́stica do teste é um valor calculado a partir da amostra e que será utilizado na tomada de
decisão. A decisão é realizada por meio da comparação do valor tabelado, segundo a distribuição
do teste, com a estatı́stica do teste.
A região crı́tica é a região em que a hipótese nula H0 é rejeita. A área da região crı́tica é igual
ao nı́vel de significância (α) estabelecido para a probabilidade de rejeição de H0 quando ela é
verdadeira.
Os testes de hipóteses podem ser unilateral à direita, unilateral à esquerda ou bilateral.

1. Para um teste unilateral à direita, um parâmetro populacional é comparado com a estimativa


θ0 , da seguinte forma:
Estatı́stica 164

(
H0 : θ = θ0
H1 : θ > θ0

sendo que a região de rejeição α é indicada na Figura a seguir:

1−𝛼
𝛼

𝑋
Figura 12.2: Região de rejeição - Unilateral à direita
TA
2. Para um teste unilateral à esquerda, um parâmetro populacional é comparado com a estima-
tiva θ0 , da seguinte forma:
(
H0 : θ = θ0
U
H1 : θ < θ0
IN

sendo que a região de rejeição α é indicada na Figura a seguir:


M

1−𝛼

𝛼
𝑋
Figura 12.3: Região de rejeição - Unilateral à esquerda

3. Para um teste bilateral, um parâmetro populacional é comparado com a estimativa θ0 , da


seguinte forma:
(
H0 : θ = θ0
̸ θ0
H1 : θ =

sendo que a região de rejeição α é indicada na Figura a seguir:


Estatı́stica 165

1−𝛼
𝛼 𝛼
2 2
𝑋
Figura 12.4: Região de rejeição - Bilateral

A regra de decisão consiste em analisar o valor valor da estatı́stica do teste e verificar se o


mesmo está na região crı́tica. Nesse caso se rejeita H0 . Na utilização dessa regra para a rejeição
da hipótese nula H0 , há uma evidência estatı́stica de que essa hipótese seja falsa. A Figura a seguir
ilustra a região em que H0 pode ser rejeitada ou aceita.
TA
𝐻0 é aceita
U
𝐻0 é rejeitada 𝐻0 é rejeitada
Região Crítica Região Crítica
𝛼 𝛼
1−𝛼
IN

2 2
Região de Rejeição Região de Região de Rejeição
Aceite
M

Figura 12.5: Região de rejeição ou aceita de H0

Como conclusão de um teste de hipótese, se tem que ao rejeitar a hipótse nula H0 , implica que
se tem evidências estatı́sticas com um nı́vel de significância α, que corresponde ao risco de uma
decisão errada, erro de tipo I. E ao aceitar a hipótese nula H0 , implica que a hipótese nula não pode
ser rejeitada com a significância α, que corresponde ao risco de uma decisão errada, ou seja, erro
de tipo II.

12.1 Teste para a média populacional µ


No teste para a média populacional as hipóteses são formuladas da seguinte forma:



 H0 : µ = µ0


 H1 pode ser formulada como:


 H1 : µ > µ0



 H1 : µ < µ0

H1 : µ ̸= µ0

Estatı́stica 166

Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a


estatı́stica de teste deve ser calculada.
Nesse teste a tabela da distribuição normal padronizada pode ser utilizada N (0, 1). Alguns
valores da região crı́tica (Zα ) para os nı́veis de significância α = 20%, 15%, 10%, 5%, 2, 5%e1%,
são apresentado na Tabela (12.1) a seguir:

Tabela 12.1: Valores para alguns nı́veis de significância


α (1 − α) Zα
0,20 0,80 1,28
0,15 0,85 1,44
0,10 0,90 1,65
0,05 0,95 1,96
0,025 0,975 2,24
0,01 0,99 2,58
Nota: α: nivel de significância, (1 − α): nı́vel de confiança,
TA
Zα : valor da normal padronizada.

Para a estatı́stica do teste, deve ser considerado dois caso:


U
1. O desvio padrão populacional σ é conhecido. Nesse caso a estatı́stica do teste é dada por:
x − µ0
IN

Zcalc = σ

n
M

E as regras de decisão são:

(a) Se Zcalc < −Zα , rejeita-se H0 (unilateral à esquerda)

(b) Se Zcalc > Zα , rejeita-se H0 (unilateral à direita)

(c) Se |Zcalc | > Zα/2 , rejeita-se H0 (bilateral)

2. O desvio padrão populacional σ é desconhecido. Nesse caso a estatı́stica do teste é dada por:
x − µ0
tcalc = s

n
sendo que a estimativa do desvio padrão σ é obtido a partir da amostra com a expressão:
v " n #
Pn 2
u
u 1 X ( x
i=1 i )
s=t x2 −
n − 1 i=1 i n

E as regras de decisão são:


Estatı́stica 167

(a) Se tcalc < −tn−1, α , rejeita-se H0 (unilateral à esquerda)

(b) Se tcalc > tn−1, α , rejeita-se H0 (unilateral à direita)

(c) Se |tcalc | > tn−1, α/2 , rejeita-se H0 (bilateral)

O valor tn−1, α/2 com n = 10 e α = 0, 05, é indicado na Tabela (12.2) recorte da tabela t da
Seção 13. Nessa tabela ϕ é o grau de liberdade (n − 1) e α é o nı́vel de significância. O valor de
t9, 0,025 será:

Tabela 12.2: Tabela t - Recorte


ϕ/α 0,1 0,05 0,025 0,01 0,005
1 3,0777 6,3137 12,7062 31,8210 63,5590
2 1,8856 2,9200 4,3027 6,9645 9,9250
3 1,6377 2,3534 3,1824 4,5407 5,8408
4 1,5332 2,1318 2,7765 3,7469 4,6041
5 1,4759 2,0150 2,5706 3,3649 4,0321
6 1,4398 1,9432 2,4469 3,1427 3,7074
7 1,4149 1,8946 2,3646 2,9979 3,4995
8 1,3968 1,8595 2,3060 2,8965 3,3554
9 1,3830
TA
1,8331 2,2622 2,8214 3,2498
10 1,3722 1,8125 2,2281 2,7638 3,1693
U
Exemplo 12.1.1. Desvio padrão populacional σ é conhecido (bilateral). Uma amostra de tama-
nho 25 é extraı́da de uma população normal, obtendo uma média igual a 42 com desvio padrão
IN

populacional igual a 7. Ao nı́vel de 5% de significância testar as hipótese:


(
H0 : µ = 44
M

H1 : µ ̸= 44

Solução

1. O desvio padrão populacional σ = 7 é conhecido com n = 25 e x = 42. A estatı́stica do


teste será dada por:

x − µ0 42 − 44 −2
Zcalc = σ = = = −1, 4
√ 7 7

n 25 5

2. Pelas regras de decisão se tem que:

(a) Se |Zcalc | > Zα/2 , rejeita-se H0 (bilateral)

(b) Para α = 5%, Zα/2 = 1, 96

3. Como,
|Zcalc | = | − 1, 4| = 1, 4 < Zα/2 = 1, 96
Estatı́stica 168

4. Logo, a decisão é não rejeitar H0 , isto é, a média é igual a 44, com 5% de risco de não
rejeitarmos uma hipótese falsa.
Exemplo 12.1.2. Desvio padrão populacional σ é conhecido (unilateral à esquerda). Uma variável
X com distribuição normal tem desvio padrão igual a 3. Uma amostra de tamanho n = 12 dessa
população revelou uma média x = 23. Com um nı́vel de 5% de significância é possı́vel afirmar
que a média populacional é menor do que 26?
(
H0 : µ = 26
H1 : µ < 26
Solução

1. O desvio padrão populacional σ = 3 é conhecido com n = 12 e x = 23. A estatı́stica do


teste será dada por:

x − µ0 23 − 26 −3
Zcalc = σ = = = −3, 464
√ 3 3

TA √
n 12 12
2. Pelas regras de decisão se tem que:
U
(a) Se Zcalc < −Zα , rejeita-se H0 (unilateral à esquerda)
(b) Para α = 5%, Zα = Z5% = Z0,05 = 1, 64
IN

3. Como,
Zcalc = −3, 464 < −Zα = −Z0,05 = −1, 64
M

4. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que a média populacional é
menor do que 26, com 5% de risco de rejeitarmos uma hipótese verdadeira.
Exemplo 12.1.3. Desvio padrão populacional σ é conhecido (unilateral à direita). Uma variável
X com distribuição normal tem desvio padrão igual a 3. Uma amostra de tamanho n = 12 dessa
população revelou uma média x = 23. Com um nı́vel de 5% de significância é possı́vel afirmar
que a média populacional é maior do que 21?
(
H0 : µ = 21
H1 : µ > 21
Solução

1. O desvio padrão populacional σ = 3 é conhecido com n = 12 e x = 23. A estatı́stica do


teste será dada por:

x − µ0 23 − 21 2
Zcalc = σ = = = 2, 309
√ 3 3
√ √
n 12 12
Estatı́stica 169

2. Pelas regras de decisão se tem que:

(a) Se Zcalc > Zα , rejeita-se H0 (unilateral à direita)

(b) Para α = 5%, Zα = Z5% = Z0,05 = 1, 64

3. Como,
Zcalc = 2, 309 > Zα = Z0,05 = 1, 64

4. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que a média populacional é
maior do que 21, com 5% de risco de rejeitarmos uma hipótese verdadeira.

12.2 Teste para a diferença entre duas médias populacionais µ1 e µ2


No teste para a diferença entre duas médias populacionais µ1 e µ2 as hipóteses são formuladas
da seguinte forma:



 H0 : µ1 − µ2 = d
TA


 H1 pode ser formulada como:


 H1 : µ1 − µ2 < d
U
H1 : µ1 − µ2 > d





H1 : µ1 − µ2 ̸= d

IN

Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a


estatı́stica de teste deve ser calculada.
M

12.2.1 Dados Emparelhados


Os dados são emparelhado, ou seja, o número de observações para determinar cada média é o
mesmo e igual a n. Nesse caso a estatı́stica do teste é dada por:

d−d
tcalc = s

n
s
P 2 P
(di − d) di
em que s = ,d= , di = xi − yi com di representando a i-ésima diferença
n−1 n
entre duas observações emparelhadas. Nesse caso são calculadas as diferenças para cada par de
valores, obtendo n diferenças.
E as regras de decisão, utilizam o grau de liberdade ϕ = n − 1 são:

1. Se tcalc < −tn−1, α , rejeita-se H0 (unilateral à esquerda)

2. Se tcalc > tn−1, α , rejeita-se H0 (unilateral à direita)

3. Se |tcalc | > tn−1, α/2 , rejeita-se H0 (bilateral)


Estatı́stica 170

12.2.2 Dados Não emparelhados


Em dados não emparelhados, não são calculadas as diferenças de valores das duas amostras.
Nesse caso é calculada a diferença entre as médias das duas amostras que será utilizado na es-
tatı́tisca do teste. Para a estatı́stica do teste, deve ser considerado quatro casos:

1. Os desvios padrões populacionais σ1 e σ2 são conhecidos. Nesse caso a estatı́stica do teste é


dada por:
(x − y) − d
Zcalc = r 2
σ1 σ22
+
n1 n2
E as regras de decisão são:

(a) Se Zcalc < −Zα , rejeita-se H0

(b) Se Zcalc > Zα , rejeita-se H0

(c) Se |Zcalc | > Zα/2 , rejeita-se H0 TA


2. Os desvios padrões populacionais σ1 e σ2 são desconhecidos, supostamente iguais. Nesse
caso a estatı́stica do teste é dada por:
U
(x − y) − d
tcalc = s  
1 1
IN

s2p +
n1 n2

em que
M

(n1 − 1)s21 + (n2 − 1)s22


s2p =
n1 + n2 − 2
sendo que a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as ex-
pressões:
"n # "n #
1
Pn1 2 2
Pn2 2
1 X ( x i ) 1 X ( y i )
s21 = x2 − i=1
e s22 = y2 − i=1
n1 − 1 i=1 i n1 n2 − 1 i=1 i n2

ou, equivalentemente, por:


Pn1 Pn2
(xi − x)2 (yi − y)2
s21 = i=1
e s22 = i=1
n1 − 1 n2 − 1
E as regras de decisão, utilizam o grau de liberdade n = n1 + n1 são:

(a) Se tcalc < −tn−2, α , rejeita-se H0 (unilateral à esquerda)

(b) Se tcalc > tn−2, α , rejeita-se H0 (unilateral à direita)


Estatı́stica 171

(c) Se |tcalc | > tn−2, α/2 , rejeita-se H0 (bilateral)

3. Os desvios padrões populacionais σ1 e σ2 são desconhecidos, supostamente diferentes. Nesse


caso a estatı́stica do teste é dada por:

(x − y) − d
tcalc = r 2
s1 s2
+ 2
n1 n2

O grau de liberdade, denominado por v para essa estatı́stica é dado por:


2
s21 s22

+
n1 n2
v =  2 2  2 2
s1 s2
n1 n2
+
n1 − 1 n2 − 1
sendo que a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as ex-
TA
pressões:
Pn1 2
Pn2
i=1 (xi − x) (yi − y)2
U
s21 = e s22 = i=1
n1 − 1 n2 − 1
IN

E as regras de decisão, utilizam o grau de liberdade n = n1 + n1 são:

(a) Se tcalc < −tv, α , rejeita-se H0 (unilateral à esquerda)


M

(b) Se tcalc > tv, α , rejeita-se H0 (unilateral à direita)

(c) Se |tcalc | > tv, α/2 , rejeita-se H0 (bilateral)

Exemplo 12.2.1. (Dados Emparelhados - Bilateral) Um grupo de 12 pessoas foi submetido a um


tratamento para reduzir a glicose por um perı́odo de 30 dias. Os dados observados antes do
tratamento foi denominada de xi e depois do tratamento yi . Ao nı́vel de 5% é possı́vel afirmar que
houve diferença nos nı́veis de glicose após o tratamento? Essa afirmação corresponde a testar
com 5% as seguintes hipóteses:

 H0 : µ1 − µ2 = d = 0

H : µ − µ2 ̸= d = 0
 1 1

sendo µ1 = µx e µ2 = µy
Estatı́stica 172

Tabela 12.3: Exemplo - Dados Emparelhados


xi yi di (di − d)2
150 112 38 6,67
140 122 18 303,34
130 132 -2 1400,01
147 110 37 2,51
129 117 12 548,34
133 100 33 5,84
192 123 69 1127,84
180 130 50 212,67
177 121 56 423,67
166 116 50 212,67
168 156 12 548,34
192 140 TA 52 275,01

Solução
U
1. As diferenças di = xi − yi com i = 1, . . . , n já estão calculadas na tabela do enunciado.

2. A média dos di é dada por:


IN

P
di
d= = 35, 42
n
M

3. O desvio padrão s é dado por:


s
P 2 r
(di − d) 5066, 91
s= = = 21, 462
n−1 12 − 1

4. A estatı́stica do teste é dada por:

d−d 35, 42 − 0
tcalc = s = 21, 462 = 5, 716
√ √
n 12

5. O valor de ttabelado com ϕ = n − 1 graus de liberdade e α/2 = 5%/2 = 0, 025 é dado por:

tn−1, α/2 = t11, 0,025 = 2, 201

6. Pela regra de decisão: Se |tcalc | > tn−1, α/2 , rejeita-se H0 (bilateral)

7. Como,
tcalc = 5, 716 > 2, 201 = t11, 0,025 = tn−1, α/2
Estatı́stica 173

8. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que houve diferença nos
nı́veis de glicose após o tratamento, com 5% de risco de rejeitarmos uma hipótese verdadeira.

Exemplo 12.2.2. (Dados Emparelhados - Unilateral à direita) No exemplo 12.2.1 um grupo de


12 pessoas foi submetido a um tratamento para reduzir a glicose por um perı́odo de 30 dias. Os
dados observados antes do tratamento foi denominada de xi e depois do tratamento yi . Ao nı́vel
de 5% é possı́vel afirmar que houve diminuição da glicose após o tratamento? Essa afirmação
corresponde a testar com 5% as seguintes hipóteses:

 H0 : µ1 − µ2 = d = 0

H : µ − µ2 > d = 0
 1 1

sendo µ1 = µx e µ2 = µy

Solução

1. O teste é unilateral a direita, pois nos dados da Tabela 12.2.1 se tem que:
TA
µ1 = µx = 152, 67 > 123, 25 = µy = µ2

ou seja, µ1 − µ2 = µx − µy > 0.
U
2. As diferenças di = xi − yi com i = 1, . . . , n já estão calculadas na Tabela 12.2.1 do enunci-
ado.
IN

3. A média dos di é dada por: P


di
d= = 35, 42
n
M

4. O desvio padrão s é dado por:


s
P 2 r
(di − d) 5066, 62
s= = = 21, 462
n−1 12 − 1

5. A estatı́stica do teste é dada por:

d−d 35, 42 − 0
tcalc = s = 21, 462 = 5, 717
√ √
n 12

6. O valor de ttabelado com ϕ = n − 1 graus de liberdade e α = 5 = 0, 05 é dado por:

tn−1, α = t11, 0,05 = 1, 796

7. Pela regra de decisão: Se tcalc > tn−1, α , rejeita-se H0 (unilateral à direita)


Estatı́stica 174

8. Como,
tcalc = 5, 716 > 1, 796 = t11, 0,05 = tn−1, α

9. Logo, a decisão é rejeitar H0 , isto é, é verdadeira a afirmação de que houve diminuição nos
nı́veis de glicose após o tratamento, com 5% de risco de rejeitarmos uma hipótese verdadeira
(Tipo I).

Exemplo 12.2.3. (Dados Não emparelhados - Caso 1 - Bilateral) As variáveis aleatórias X e


Y são extraı́das de duas populações normais com variâncias iguais a 36. Duas amostras
P16 foram
obtidas
P25 para X com tamanho n 1 = 16 e para Y com tamanho n 2 = 25, sendo i=1 i = 64
x
e i=1 yi = 75. Ao nı́vel de 5% de significância é possı́vel afirmar que as médias µx e µy são
iguais. Essa afirmação corresponde a testar com 5% as seguintes hipóteses:

 H0 : µ1 − µ2 = d = 0

H : µ − µ2 ̸= d = 0
 1 1

sendo µ1 = µx e µ2 = µy

Solução
TA
1. As variâncias são conhecidas:
σ12 = σ22 = 36
U
2. As médias µx e µy são dadas por:
IN

64 75
µx = = 4 e µy = =3
16 25
M

3. A estatı́stica do teste Zcalc é dada por:

(x − y) − d (4 − 3) − 0
Zcalc = r 2 2
= r = 0, 520
σ1 σ2 36 36
+ +
n1 n2 16 25

4. Pelas regras de decisão se tem que:

(a) Se |Zcalc | > Zα/2 , rejeita-se H0 (bilateral)

(b) Para α = 5%, Zα/2 = Z0,05/2 = Z0,025 = 2, 24

5. Como,
|Zcalc | = |0, 520| = 0, 520 < Zα/2 = Z0,025 = 2, 24

6. Logo, a decisão é não rejeitar H0 , isto é, as médias populacionais são iguais, com 5% de
risco de não rejeitarmos uma hipótese falsa.
Estatı́stica 175

Exemplo 12.2.4. (Dados Não emparelhados - Caso 2 - Bilateral) Um grupo de 12 pessoas foi
submetido a um tratamento para reduzir a glicose por um perı́odo de 30 dias. Os dados observados
para as 12 pessoas antes do tratamento foi denominada de xi . Considere a situação em que depois
do tratamento foi possı́vel observar a glicose de apenas 9 pessoas sendo as denominado de yi . Ao
nı́vel de 5% é possı́vel afirmar que houve diferença nos nı́veis de glicose após o tratamento? Essa
afirmação corresponde a testar com 5% as seguintes hipóteses:

 H0 : µ1 − µ2 = d = 0

H : µ − µ2 ̸= d = 0
 1 1

sendo µ1 = µx e µ2 = µy

Tabela 12.4: Exemplo - Dados Não Emparelhados


xi yi
150 112
140
TA 122
130 132
147 110
129 117
U
133 100
IN

192 123
180 130
177 121
M

166
168
192

Solução

1. O tamanho das amostras n1 = 12 e n2 = 9, podemos supor que desvios padrões são iguais.
Logo a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as expressões:

"n
2
# " 12 P12 2 #
1
( ni=1
P 1
1 xi ) 1 i=1 xi
X X
s21 = 2
xi − = 2
xi − = 552, 24
n1 − 1 i=1 n1 12 − 1 i=1 12

" n2 Pn2 2
# " 9 P9 2 #
1 X ( i=1 yi ) 1 X y
i=1 i
s22 = yi2 − = yi2 − = 101, 53
n2 − 1 i=1
n2 9 − 1 i=1 9
Estatı́stica 176

2. Com essas estimativas podemos calcular s2p :

(n1 − 1)s21 + (n2 − 1)s22 (12 − 1)552, 24 + (9 − 1)101, 53


s2p = = = 362, 47
n1 + n2 − 2 12 + 9 − 2

3. Como x = 158, 67 e y = 118, 56, a estatı́stica do teste será dada por:


(x − y) − d (158, 67 − 118, 56) − 0
tcalc = s  = s   ≈ 4, 78
1 1 1 1
s2p + 362, 47 +
n1 n2 12 9

4. Como é um teste bilateral pelas regras de decisão, utilizam o grau de liberdade n = n1 + n1


se tem que:

(a) Se |tcalc | > tn−2, α/2 , rejeita-se H0 (bilateral)

(b) Como n = n1 + n1 = 12 + 9 = 21.


TA
(c) Para α = 5%, tn−2, α/2 = t21−2, 0,05/2 = t19, 0,025 = 2, 0930

5. Como,
|tcalc | = |4, 78| = 4, 78 > tn−2, α/2 = t19, 0,025 = 2, 0930
U
6. Logo, a decisão é rejeitar H0 , isto é, as médias populacionais são diferentes, com 5% de
IN

risco de rejeitarmos uma hipótese verdadeira.

Exemplo 12.2.5. Fazer o teste de hipótese do Exemplo 12.2.4 com a suposição de que os desvios
padrões são diferentes.
M

Solução

1. O tamanho das amostras n1 = 12 e n2 = 9, supondo que desvios padrões são diferentes.


Logo a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as expressões:

"n
1
Pn1 2
# " 12 P12 2 #
1 ( x
i=1 i ) 1 i=1 xi
X X
s21 = x2i − = x2i − = 552, 24
n1 − 1 i=1 n1 12 − 1 i=1 12

"n
2
Pn2 2
# " 9 P9 2 #
1 X ( y
i=1 i ) 1 X y
i=1 i
s22 = y2 − = y2 − = 101, 53
n2 − 1 i=1 i n2 9 − 1 i=1 i 9

2. Como x = 158, 67 e y = 118, 56, a estatı́stica do teste será dada por:

(x − y) − d (158, 67 − 118, 56) − 0


tcalc = r 2 2
= r ≈ 5, 30
s1 s2 552, 24 101, 53
+ +
n1 n2 12 9
Estatı́stica 177

3. O grau de liberdade é dado por:


2 2
s21 s22
 
552, 24 101, 53
+ +
n1 n2 12 9
v =  2 2  2 2 =  2  2 ≈ 15, 75 ≈ 16
s1 s2 552, 24 101, 53
n1 n2 12 9
+ +
n1 − 1 n2 − 1 12 − 1 9−1

4. Como é um teste bilateral pelas regras de decisão, utilizam o grau de liberdade n = n1 + n1


se tem que:

(a) Se |tcalc | > tv, α/2 , rejeita-se H0 (bilateral)

(b) Como v ≈ 16.

(c) Para α = 5%, tv, α/2 = t16, 0,05/2 = t16, 0,025 = 2, 1199

5. Como, TA
|tcalc | = |5, 30| = 5, 30 > tv, α/2 = t16, 0,025 = 2, 1199

6. Logo, a decisão é rejeitar H0 , isto é, as médias populacionais são diferentes, com 5% de
risco de rejeitarmos uma hipótese verdadeira.
U
12.3 Teste para a variância populacional σ 2
IN

No teste para a variância populacional σ 2 as hipóteses são formuladas da seguinte forma:


M




 H0 : σ 2 = σ02


 H1 pode ser formulada como:


 H1 : σ 2 < σ02
H1 : σ 2 > σ02





H1 : σ 2 ̸= σ02

Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a


estatı́stica de teste deve ser calculada.
Para a estatı́stica do teste, deve ser considerado dois caso:
1. A média populacional µ é conhecida. Nesse caso a estatı́stica do teste é dada por:
n · s2
χ2calc =
σ02

como a média µ conhecida, uma estimativa mais precisa para s2 utiliza µ no lugar de x,
sendo a estimativa de s2 obtida por:
Pn
2 (xi − µ)2
s = i=1
n
Estatı́stica 178

E as regras de decisão são:

(a) Se χ2calc < −χ2ϕ=n, 1−α , rejeita-se H0 (unilateral à esquerda)

(b) Se χ2calc > χ2ϕ=n, 1−α , rejeita-se H0 (unilateral à direita)

(c) Se χ2calc < χ2ϕ=n, 1−α/2 ou χ2calc > χ2ϕ=n, α/2 , rejeita-se H0 (bilateral)

2. A média populacional µ é desconhecida. Nesse caso a estatı́stica do teste é dada por:

(n − 1) · s2
χ2calc =
σ02

sendo a estimativa de s2 utiliza x e é obtida por:


Pn
2 (xi − x)2
s = i=1
n−1

E as regras de decisão são:


TA
(a) Se χ2calc < −χ2ϕ=(n−1), 1−α , rejeita-se H0 (unilateral à esquerda)
U
(b) Se χ2calc > χ2ϕ=(n−1), 1−α , rejeita-se H0 (unilateral à direita)
IN

(c) Se χ2calc < χ2ϕ=(n−1), 1−α/2 ou χ2calc > χ2ϕ=(n−1), α/2 , rejeita-se H0 (bilateral)

Exemplo 12.3.1. P De uma população normal com média µ = 250, foi obtida uma amostra com 30
elementos sendo ni=1 (xi − µ)2 = 235.000. Ao nı́vel de 5% de significância é possı́vel afirmar
M

que a variância populacional é igual a 2.400. Essa afirmação corresponde a testar com 5% as
seguintes hipóteses:
(
H0 : σ 2 = 2.400
H1 : σ 2 ̸= 2.400

Solução

1. Calculo de s2 Pn
2 i=1 (xi − µ)2 235.000
s = = = 7.833, 33
n 30
2. A estatı́stica do teste é dada por:

n · s2 30 · 7.833, 33
χ2calc = 2
= = 97, 92
σ0 2.400

3. Pelas regras de decisão


Estatı́stica 179

(a) Se χ2calc < χ2ϕ=(n−1), 1−α/2 ou χ2calc > χ2ϕ=(n−1), α/2 , rejeita-se H0 (bilateral)

(b) Como n = 30 e para α = 5%, se tem que:


χ2ϕ=(n−1), 1−α/2 = χ2ϕ=(30−1), 1−0,05/2 = χ2ϕ=29, 1−0,025 = χ2ϕ=29, 0,975 = 16, 0471

χ2ϕ=(n−1), α/2 = χ2ϕ=(30−1), 0,05/2 = χ2ϕ=29, 0,025 = 45, 7223

4. Como,
χ2calc = 97, 92 > χ2ϕ=(n−1), α/2 = χ2ϕ=29, 0,025 = 45, 7223

5. Logo, a decisão é rejeitar H0 , isto é, a variância populacional é diferente de 2.400, com 5% de
risco de rejeitarmos uma hipótese verdadeira.

12.4 Teste para a igualdade de duas variâncias populacionais σ12 e σ22


No teste para a variância populacional σ 2 as hipóteses são formuladas da seguinte forma:

H0 : σ12 = σ22





TA
 H1 pode ser formulada como:

 H1 : σ12 < σ22


U

H1 : σ12 > σ22





H1 : σ12 ̸= σ22

IN

Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a


estatı́stica de teste deve ser calculada.
Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a
M

estatı́stica de teste deve ser calculada. Nesse caso a estatı́stica do teste é dada por:

s21
Fcalc =
s22

sendo que a estimativa das variâncias s21 e s22 são obtidas a partir da amostra com as expressões:
Pn1 2
Pn2
2 i=1 (xi − x) 2 (xi − x)2
s1 = e s2 = i=1
n1 − 1 n2 − 1
E as regras de decisão são:

1. Se Fcalc < F1−α, (n1 −1), (n2 −1) , rejeita-se H0

2. Se Fcalc > Fα, (n1 −1), (n2 −1) , rejeita-se H0

3. Se Fcalc < F1−α/2, (n1 −1), (n2 −1) ou Fcalc > Fα/2, (n1 −1), (n2 −1) , rejeita-se H0
Estatı́stica 180

Exemplo 12.4.1. São obtidas amostras de duas populações possuem com número de elementos
n1 = 12 e n2 = 26. As variâncias calculadas em para as amostras foram s21 = 4, 55 e s22 =
15, 6. Ao nı́vel de 5% de significância é possı́vel afirmar que as populações possuem as mesmas
variâncias. Essa afirmação é equivalente a testar com 5% de significância as seguintes hipótese:
(
H0 : σ12 = 4, 55 = 15, 6 = σ22
H1 : σ12 = 4, 55 ̸= 15, 6 = σ22

Solução

1. A estatı́stica do teste Fcalc é dada por:

s21
Fcalc = 2
s2

2. Por convenção o valor da maior variância é utilizado no numerador, ou seja,

s22
TA 15, 6
Fcalc = 2
= ≈ 3, 65
s1 4, 55

3. Pelas regras de decisão:


U
Se Fcalc > Fα, (n1 −1), (n2 −1) , rejeita-se H0
IN

4. Como Fα, (n1 −1), (n2 −1) = F0,05, (12−1), (26−1) = F0,05, 11, 25 = 2, 198

5. Logo,
M

Fcalc = 3, 65 > F0,05, 11, 25 = 2, 198

6. Logo, a decisão é rejeitar H0 , isto é, as variâncias populacionais são diferentes, com 5% de
risco de rejeitarmos uma hipótese verdadeira.

12.5 Teste para a proporção populacional p


A proporção populacional p de sucessos em uma população pode ser estimada pela proporção
de sucessos em uma amostra, indicada por p, obtida por:
x
pb =
n
em que x é o número de sucessos (casos favoráveis) e n é tamanho da amostra (número total
de casos observados).
No teste para a proporção populacional p as hipóteses são formuladas da seguinte forma:
Estatı́stica 181




 H0 : p = p0


 H1 pode ser formulada como:


 H1 : p < p0



 H1 : p > p0

H1 : p ̸= p0

Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a


estatı́stica de teste deve ser calculada.
Um nı́vel α de confiança deve ser fixado para determinar a região de rejeição de H0 . E a
estatı́stica de teste deve ser calculada. Nesse caso a estatı́stica do teste é dada por:
pb − p0
Zcalc = r
p0 (1 − p0 )
n
E as regras de decisão são:
1. Se Zcalc < −Zα , rejeita-se H0
TA
2. Se Zcalc > Zα , rejeita-se H0
U
3. Se |Zcalc | > Zα/2 , rejeita-se H0
IN

Exemplo 12.5.1.

12.6 Delineamento Inteiramente Casualizado - DIC


M

No Delineamento Inteiramente Casualizado (DIC) ou Planejamento Completamente Aleatori-


zado, se faz a suposição de homogeneidade entre as unidades experimentais. Nesse delineamento
os os tratamentos são atribuı́dos às unidades experimentais de forma casualizada, por meio de
um sorteio. Por isso, os experimentos segundo esse delineamento são chamados de experimentos
inteiramente casualizados ou experimentos inteiramente ao acaso.
O DIC possui as seguintes caracterı́sticas
• Apenas os princı́pios da repetição e da casualização são utilizados.

• Os tratamentos são distribuı́dos nas unidades experimentais (parcelas) de forma inteiramente


casual, com números iguais ou diferentes de repetições em cada tratamento.

• Possui apenas um fator experimental.

• Cada nı́vel desse fator experimental é um tratamento.


As principais vantanges do DIC são: o delineamento é flexı́vel, pois o número de tratamentos e
repetições depende apenas do número de unidades experimentais (parcelas) disponı́veis; o número
de repetições pode variar de um tratamento para outro, porém recomenda-se utilizar o mesmo
número em todos os tratamentos; a análise estatı́stica é simples; o número de graus de liberdade
Estatı́stica 182

para estimar o erro experimental (obtido pelo desvio padrão dos resı́duos) é o maior possı́vel. Nesse
tipo de delineamento as principais desvantagens são: exigência da homogeneidade das condições
experimentais; a estimativa para a variância dos resı́duos pode ser alta, já que todas as variações
das unidades experimentais são consideradas como variação aleatória. A Tabela 12.5 apresenta a
organização dos dados para um DIC, com I tratamentos e J repetições.

Tabela 12.5: Organização dos dados em um DIC com I tratamentos e J repetições


Tratamentos Repetições/Observações Totais Médias
1 y11 y12 ··· y1j T1 y1
2 y21 y22 ··· y2j T2 y2
.. .. .. ..
. ··· ··· . ··· . .
I yI1 yI2 ··· yIJ TI yI

Na Tabela 12.5 yij representa a j-ésima observação do i-ésimo tratamento, Ti é o total do


i-ésimo tratamento dado por: TA
XJ
Ti = yij
j=1

y i é a média do i-ésimo tratamento dado por:


U
J
yij Ti
IN

X
yi = =
j=1
J J

E a média geral y é dada por:


M

I X J
X yij
y=
i=1 j=1
I ·J

12.6.1 Modelo Estatı́stico


O modelo estatı́stico de efeito fixo para o DIC é dado por:

yij = µ + τi + ϵij (12.1)

em que:
• yij é o valor observado para a variável resposta obtido para o i-ésimo tratamento na j-ésima
repetição.

• µ é a média das médias de cada tratamento.

• τi é o efeito do tratamento i no valor obsrvado yij .

• ϵij é o erro experimental associado ao valor observado yij .


Estatı́stica 183

Os estimadores para µ e τi são, respectivamente, µ


b e τbi dados por:
(
b=y
µ
τbi = y i − y
para i = 1, . . . , I.
Em um experimento com o DIC o objetivo geral é testar a igualdade de médias dos I tratamen-
tos. As hipóteses estatı́sticas são:
(
H0 : µ1 = µ2 = · · · = µI

(12.2)
H1 : µi ̸= µi , pelo menos duas médias diferem

Como τbi = y i − y e µi é estimada por y i as hipóteses podem ser escritas, alternativamente,


como:
(
H0 : τ1 = τ2 = · · · = τI = 0
(12.3)
H1 : τi ̸= 0, pelo menos um tratamento tem efeito
TA
ou seja, as hipótese nulas H0 de 12.2 é equivalente a hipótese nula H0 de 12.3, pois as médias
serem iguais corresponde ao efeito dos tratamentos serem iguais.
A medida de variação utilizada é a soma de quadrados, sendo que a soma de quadrados total
U
(SQT ) corresponde a soma de quadrados dos desvios de todos os dados em relação à média, a
soma dos quadrados dos tratamentos (SQT rat ) corresponde a soma dos quadrados dos desvios das
IN

médias dos tratamentos em relação a média geral, ea soma dos qudrados dos resı́duos (SQR ) é a
soma dos quadrados dos desvios dos valores estimados pelo modelo e observados. As somas de
quadrados SQT , SQT rat e SQR são dadas por:
M

I X
J I X
J PI PJ
X
2
X ( i=1 j=1 yij )2
SQT = (yij − y) = yij2 −
i=1 j=1 i=1 j=1
I ·J
I X
J PI PJ
yij )2
PI 2
X
i=1 Ti
( i=1 j=1
SQT rat = J · (y i − y)2 = −
i=1 j=1
J I ·J

X J
I X I X
X J
SQR = ϵ2ij = (yij − y − τbi )2
i=1 j=1 i=1 j=1
I X
X J
= (yij − y − (y i − y))2
i=1 j=1
I X
X J
= (yij − y i )2
i=1 j=1

A soma de quadrado dos resı́duos SQR pode ser obtida das somas de quadrados SQT , SQT rat
e SQR por meio da relação:
Estatı́stica 184

SQR = SQT − SQT rat


Para o modelo 12.1 as seguintes suposições devem ser verificadas:

1. Aditividade, os efetios devem se somar, sem interção.

2. Independência, os erros ϵij devem ser aleatórios e independentes, o que indica que os efeitos
dos tratamentos sejam também independnetes.

3. normalidade, os erros ϵij devem ser possuir uma distribuição normal de probabilidade, ou
seja, ϵij ∼N (0, σ 2 ) =⇒ yij ∼N (µi , σ 2 )

4. homocedasticidade ou homogeneidade de variâncias, os erros ϵij devem possuir uma variância


comum σ 2 , o que indica uma variabilidade igual entre os tratamentos.

12.6.2 Teste F
Com a soma os quadrados é possı́vel construir a Tabela de Análise de Variância (ANOVA) para
TA
o DIC e utilizar o teste F sobre as hipóteses enunciadas. A Tabela ANOVA é apresentada a seguir:

Tabela 12.6: Análise de Variância


U
Fonte GL Soma de Quadrados Quadrados Médios Fcalc
IN

SQT rat SQT ratM


Tratamento I −1 SQT rat SQT ratM =
I −1 SQRM
SQR
M

Resı́duos I(J − 1) SQR SQRM =


I(J − 1)

Total IJ − 1 SQT
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.

O valor de Fcalc obtido na Tabela 12.6 é utilizado para realizar o seguinte teste de hipóteses H0
de 12.2 (ou 12.3).
A rejeição da hipótese nula H0 significa afirmar que pelo menos um tratamento teve efeito
sobre a variável em estudo (ou pelo menos um par de médias são diferentes), com um certo nı́vel
de significância α%.
A regra de decisão requer a obtenção do Fcrı́tico = FI−1, I(J−1), α% que é obtido da tabela F,
com nı́vel α de probabilidade, I − 1 graus de liberdade do numerador e I(J − 1) graus de liberdade
do denominador:

 Se Fcalc < Fcrı́tico =⇒ Não rejeita H0

Se Fcalc > Fcrı́tico =⇒ rejeita H0
Estatı́stica 185

Se Fcalc < Fcrı́tico é comum concluir que não há evidencias para rejeitar H0 . Uma medida
para avaliar
√ a precisão de experimentos é o coeficiente de variação (CV ) que pode ser obtido por
SQRM
CV = · 100, sendo que quanto menor o CV , mais preciso é o experimento.
y
Exemplo 12.6.1. Para verificar a influência de quatro tratamentos em uma certa variável foi
realizado um experimento em um área homogênea, cujos dados são apresentados na tabela a
seguir. Realizar o teste F .

Tabela 12.7: Dados de um DIC com 4 tratamentos e 5 repetições


Tratamentos Repetições/Observações Totais Médias
1 2 3 4 5
1 2,9 2,2 3,8 2,0 2,1 13,0 2,6
2 4,1 6,0 8,1 5,0 5,1 28,3 5,7
3 3,6 3,0 3,1 2,8 3,0 15,5 3,1
4 1,8 1,5 3,3
TA 2,9 2,7 12,2 2,4

Solução
U
1. Cálculo de SQT
I X
X J
SQT = (yij − y)2 = 48, 0
IN

i=1 j=1

2. Cálculo de SQT rat


M

I X
X J
SQT rat = J · (y i − y)2 = 33, 8
i=1 j=1

3. Cálculo de SQR
I X
X J I X
X J
SQR = ϵ2ij = (yij − y i )2 = 14, 2
i=1 j=1 i=1 j=1

4. Para a tabela de Análise de Variância também devemos calcular SQT ratM e SQR M da
seguinte forma:
SQT rat 33, 8 33, 8
SQT ratM = = = ≈ 11, 3
I −1 4−1 3

SQR 14, 2 14, 2 14, 2


SQRM = = = = ≈ 0, 9
I(J − 1) 4 · (5 − 1) 4·4 16

5. Com os valores de SQT ratM e SQR M se calcula o Fcalc da seguinte forma:


SQT ratM 11, 3
= ≈ 12, 7
SQRM 0, 9
Estatı́stica 186

6. Assim, a tabela de Análise de Variância para o experimento é dada por:

Tabela 12.8: Análise de Variância

Fonte GL Soma de Quadrados Quadrados Médios Fcalc

Tratamento 3 33, 8 11, 3 12, 7

Resı́duos 16 14, 2 0, 9

Total 19 48, 0
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.

7. A regra de decisão é se Fcalc > Fcrı́tico se rejeita H0 . O Fcrı́tico para 5% de significância é


Fcrı́tico = FI−1, I(J−1), α% = F3, 16, 5% = 3, 49
TA
8. Como Fcalc = 13, 7 > 3, 49 = Fcrı́tico , segue que se rejeita H0 com 5% de significância,
ou seja pelo menos duas médias são diferentes, ou pelo menos um tratamento tem efeito na
variável em estudo.
U

Exemplo 12.6.2. No Software .


IN

#Dados do Exemplo do DIC


M

T1 <- c(2.9, 2.2, 3.8, 2.0, 2.1)


T2 <- c(4.1, 6.0, 8.1, 5.0, 5.1)
T3 <- c(3.6, 3.0, 3.1, 2.8, 3.0)
T4 <- c(1.8, 1.5, 3.3, 2.9, 2.7)

dados <- rbind(T1, T2, T3, T4)

#Calculo SQT
SQT <- sum((dados - mean(dados))ˆ2)

#Calulo SQTrat
SQTrat <- length(T1)*(sum((mean(T1) - mean(dados))ˆ2)+
sum((mean(T2) - mean(dados))ˆ2) +
sum((mean(T3) - mean(dados))ˆ2) +
sum((mean(T4) - mean(dados))ˆ2))

#Claulo SQR
Estatı́stica 187

SQR <- SQR <- SQT - SQTrat

#Calculo SQTratM e SQRM


SQTratM <- SQTrat/(4 - 1)
SQRM <- SQR/(4*(5 - 1))

#Calculo do F_calc
F_calc <- SQTratM/SQRM

options(digits=3)
Fonte <- c("Tratamento", "Residuos", "Total")
I_Trat <- dim(dados)[1]
J_Rep <- dim(dados)[2]
GL <- c(I_Trat-1, I_Trat*(J_Rep-1), I_Trat*J_Rep-1)
SQ <- c(SQTrat, SQR, SQT)
SQM <- c(SQTratM, SQRM, NA)
F_calc <- c(F_calc, NA, NA)
TA
tab_anova <- [Link](Fonte, GL, SQ, SQM, F_calc)
tab_anova
U
## Fonte GL SQ SQM F_calc
IN

## 1 Tratamento 3 33.7 11.249 12.7


## 2 Residuos 16 14.2 0.889 NA
## 3 Total 19 48.0 NA NA
M

#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)
F_tab_5

## [1] 3.24

F_tab_10 <- qf(0.1, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)


F_tab_10

## [1] 2.46

#Decisão - 5% de significância - 95% de Confiança


ifelse(F_calc[1] < F_tab_5, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"


Estatı́stica 188

#Decisão - 10% de significância - 90% de Confiança


ifelse(F_calc[1] < F_tab_10, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

Exemplo 12.6.3. Para verificar a influência de quatro tratamentos em uma certa variável foi
realizado um experimento em um área homogênea, cujos dados são apresentados na tabela a
seguir. Realizar o teste F .

Tabela 12.9: Dados de um DIC com 4 tratamentos e 5 repetições


Tratamentos Repetições/Observações Totais Médias
1 2 3 4 5
1 25 26 20 23 21 115 23
2 31 25 28 27 24 135 27
3
4
22
33
26
29
TA 28
31
25
34
29
28
130
155
26
31
U
Solução
IN

1. Cálculo de SQT
I X
X J
SQT = (yij − y)2 = 275, 75
i=1 j=1
M

2. Cálculo de SQT rat


I X
X J
SQT rat = J · (y i − y)2 = 163, 75
i=1 j=1

3. Cálculo de SQR
I X
X J I X
X J
SQR = ϵ2ij = (yij − y i )2 = 112, 00
i=1 j=1 i=1 j=1

4. Para a tabela de Análise de Variância também devemos calcular SQT ratM e SQR M da
seguinte forma:
SQT rat 163, 75 163, 75
SQT ratM = = = ≈ 54, 58
I −1 4−1 3

SQR 112, 00 112, 00 112, 00


SQRM = = = = ≈ 7, 00
I(J − 1) 4 · (5 − 1) 4·4 16
Estatı́stica 189

5. Com os valores de SQT ratM e SQR M se calcula o Fcalc da seguinte forma:


SQT ratM 54, 58
= ≈ 7, 80
SQRM 7, 00

6. Assim, a tabela de Análise de Variância para o experimento é dada por:

Tabela 12.10: Análise de Variância

Fonte GL Soma de Quadrados Quadrados Médios Fcalc

Tratamento 3 163, 75 54, 58 7, 80

Resı́duos 16 112, 00 7, 00

Total 19 275, 75
Nota: Fonte: Fonte de Variação, GL: Graus de Liberdade, I: é o número de tratamentos do experimento,
J é o número de repetições por tratamento.
TA
7. A regra de decisão é se Fcalc > Fcrı́tico se rejeita H0 . O Fcrı́tico para 5% de significância é
U
Fcrı́tico = FI−1, I(J−1), α% = F3, 16, 5% = 3, 49

8. Como Fcalc = 7, 80 > 3, 49 = Fcrı́tico , segue que se rejeita H0 com 5% de significância,


IN

ou seja pelo menos duas médias são diferentes, ou pelo menos um tratamento tem efeito na
variável em estudo.
M

Exemplo 12.6.4. No Software .

#Dados do Exemplo do DIC

T1 <- c(25, 26, 20, 23, 21)


T2 <- c(31, 25, 28, 27, 24)
T3 <- c(22, 26, 28, 25, 29)
T4 <- c(33, 29, 31, 34, 28)

dados <- rbind(T1, T2, T3, T4)

#Calculo SQT
SQT <- sum((dados - mean(dados))ˆ2)

#Calulo SQTrat
SQTrat <- length(T1)*(sum((mean(T1) - mean(dados))ˆ2)+
sum((mean(T2) - mean(dados))ˆ2) +
Estatı́stica 190

sum((mean(T3) - mean(dados))ˆ2) +
sum((mean(T4) - mean(dados))ˆ2))

#Claulo SQR
SQR <- SQR <- SQT - SQTrat

#Calculo SQTratM e SQRM


SQTratM <- SQTrat/(4 - 1)
SQRM <- SQR/(4*(5 - 1))

#Calculo do F_calc
F_calc <- SQTratM/SQRM

options(digits=3)
Fonte <- c("Tratamento", "Residuos", "Total")
I_Trat <- dim(dados)[1]
J_Rep <- dim(dados)[2]
TA
GL <- c(I_Trat-1, I_Trat*(J_Rep-1), I_Trat*J_Rep-1)
SQ <- c(SQTrat, SQR, SQT)
SQM <- c(SQTratM, SQRM, NA)
U
F_calc <- c(F_calc, NA, NA)
IN

tab_anova <- [Link](Fonte, GL, SQ, SQM, F_calc)


tab_anova
M

## Fonte GL SQ SQM F_calc


## 1 Tratamento 3 164 54.6 7.8
## 2 Residuos 16 112 7.0 NA
## 3 Total 19 276 NA NA

#Teste de Hipótese
#qf(p, df1, df2. [Link]=FALSE)
#p - significância
#df1 - grau de liberdade da regressão - NUMERADOR
#df2 - grau de liberdade da amostra - DENOMINADOR
F_tab_5 <- qf(0.05, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)
F_tab_5

## [1] 3.24

F_tab_10 <- qf(0.1, I_Trat-1, I_Trat*(J_Rep-1), [Link]=F)


F_tab_10

## [1] 2.46
Estatı́stica 191

#Decisão - 5% de significância - 95% de Confiança


ifelse(F_calc[1] < F_tab_5, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

#Decisão - 10% de significância - 90% de Confiança


ifelse(F_calc[1] < F_tab_10, "Não Rejeita H0", "Rejeita H0")

## [1] "Rejeita H0"

12.7 Teste de Tukey


O teste de Tukey permite comparar múltiplas médias. Nesse teste o objetivo é comparar médias
duas a duas (ou grupos de médias, denominado de comparações múltiplas). Para testar médias duas
a duas, inicialmente, é importante testar, com o uso da ANOVA, se os tratamentos são diferentes.
Se pelo menos um tratamento for diferente, caso em que se rejeita a hipótese H0 com o teste F,
então é possı́vel testar quais médias (ou grupo de médias) diferem entre si.
TA
Nos teste de comparações de múltiplas médias (duas a duas) as hipóteses podem ser enunciadas
como:
U
(
H0 : mu = mv , u ̸= v
(12.4)
IN

H1 : mu ̸= mv , u ̸= v
ou, alternativamente como:
M

(
H0 : mu − mv = 0, u ̸= v
(12.5)
H1 : mu − mv ̸= 0, u ̸= v
Para realizar o teste de Tukey, basta seguir o procedimento a seguir:

1. Calcular o valor absoluto da diferença entre as médias (duas a duas), ou seja, para os trata-
mentos u e v com u ̸= v calcular
|m
bu − m b v|

2. Calcular a Diferença Mı́nima Significativa (dms), dada por:


r
SQRM
dms = qα, I , I(J−1)
J
sendo qα, I , I(J−1) o valor da tabela com amplitude total q para o teste de Tukey com nı́vel α
de probabilidade, I número de tratamentos e I(J − 1) graus de liberdade.
3. Regra de Decisão: As médias dos tratamentos u e v são estatisticamente diferentes (ou há
uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms
Estatı́stica 192

Um intervalo de confiaça para a diferença entre as médias populacionais para os pares de


tratamentos u e v é dado por:
" r #
SQRM
IC[mu − mv , (1 − %)100] = (mu − mv ) ∓ qα, I , I(J−1)
J

Exemplo 12.7.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo, pelo
menos duas médias são diferentes. Realizar o teste de Tukey para comparar as múltiplas médias.

Tabela 12.11: Dados de um DIC com 4 tratamentos e 5 repetições


Tratamentos Repetições/Observações Totais Médias
1 2 3 4 5
1 2,9 2,2 3,8 2,0 2,1 13,0 2,6
2 4,1 6,0 8,1 5,0 5,1 28,3 5,7
3 3,6 3,0 3,1 2,8 3,0 15,5 3,1
4 1,8 1,5
TA
3,3 2,9 2,7 12,2 2,4

Solução
U
1. Calcular o valor absoluto da diferença entre as médias (duas a duas):
IN

|m
b1 − m
b 2 | = |2, 6 − 5, 7| = 3, 1

|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
M

|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7

2. Calcular a Diferença Mı́nima Significativa (dms), dada por:


r
SQRM
dms = qα, I , I(J−1)
r J
0, 9
= q5%, 4, 4(5−1)
5
r
0, 9
= q5%, 4, 16
5
r
0, 9
= 4, 05 ≈ 1, 71
5
sendo qα, I , I(J−1) o valor da tabela com amplitude total q para o teste de Tukey com nı́vel α
de probabilidade, I número de tratamentos e I(J − 1) graus de liberdade.
Estatı́stica 193

3. A Regra de Decisão diz que as médias de dois tratamentos são estatisticamente diferentes
(ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms

4. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.

Tabela 12.12: Compração de múltiplas médias - Teste de Tukey


Tratamentos Comparados Valor Absoluta Diferença e DMS
|m
b1 − m
b 2| |2, 6 − 5, 7| = 3, 1 > 1, 71∗
|m
b1 − m
b 3| |2, 6 − 3, 1| = 0, 5 < 1, 71 ns
|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 71 ns
|m
b2 − m
b 3| |5, 7 − 3, 1| = 2, 6 > 1, 71∗
|m
b2 − m
b 4| |5, 7 − 2, 4| = 3, 3 > 1, 71∗
|m
b3 − m
b 4|
TA |3, 1 − 2, 4| = 0, 7 < 1, 71 ns

A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
U
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.
IN

Tabela 12.13: Teste de Tukey - Utilizando Letras


Tratamentos Médias
M

1 5,7 a
2 3,1 b
3 2,6 a
4 2,4 a

Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.

12.8 Teste de Fisher


No teste da diferença mı́nima significativa de Fisher, as médias duas a duas devem ser compa-
radas com a diferença mı́nima significativa que considera a tabela t. O rigor desse teste é menor do
que o teste de Tukey. Assim, para realizar esse teste o seguinte procedimento deve ser realizado.
1. Calcular o valor absoluto da diferença entre as médias (duas a duas), ou seja, para os trata-
mentos u e v com u ̸= v calcular
|m
bu − m b v|
Estatı́stica 194

2. Calcular a Diferença Mı́nima Significativa (dms), dada por:


r
2 · SQRM
dms = tα/2, I(J−1)
J
sendo tα/2, I(J−1) o valor obtido da tabela t com nı́vel α/2 de probabilidade e I(J − 1) graus
de liberdade.

3. Regra de Decisão: As médias dos tratamentos u e v são estatisticamente diferentes (ou há
uma diferença significativa entre as médias dos dois tratamentos) se:

|m
bu − m
b v | ≥ dms

Um intervalo de confiaça para a média populacional de cada tratamentos é dado por:


" r #
2 · SQRM
IC[mu , (1 − %)100] = mu ∓ tα/2, I(J−1)
Ju
sendo Ju o número de repetições realizadas no tratamento u
TA
Exemplo 12.8.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo, pelo
menos duas médias são diferentes. Realizar o teste de Fisher para comparar as múltiplas médias.
U
Tabela 12.14: Dados de um DIC com 4 tratamentos e 5 repetições
IN

Tratamentos Repetições/Observações Totais Médias


1 2 3 4 5
M

1 2,9 2,2 3,8 2,0 2,1 13,0 2,6


2 4,1 6,0 8,1 5,0 5,1 28,3 5,7
3 3,6 3,0 3,1 2,8 3,0 15,5 3,1
4 1,8 1,5 3,3 2,9 2,7 12,2 2,4

Solução

1. Calcular o valor absoluto da diferença entre as médias (duas a duas):

|m
b1 − m
b 2 | = |2, 6 − 5, 7| = 3, 1

|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
Estatı́stica 195

2. Calcular a Diferença Mı́nima Significativa (dms), dada por:


r
2 · SQRM
dms = tα/2, I(J−1)
r J
2 · SQRM
= t5%/2, 4(5−1)
r J
2 · 0, 9
= t2,5%, 16
5
r
1, 8
= 2, 12 ≈ 1, 27
5
sendo tα/2, I(J−1) o valor obtido da tabela t com nı́vel α/2 de probabilidade e I(J − 1) graus
de liberdade.
3. A Regra de Decisão diz que as médias de dois tratamentos são estatisticamente diferentes
(ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
b v | ≥ dms
TA
4. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
U
Tabela 12.15: Compração de múltiplas médias - Teste de Fisher
Tratamentos Comparados Valor Absoluta Diferença e DMS
IN

|m
b1 − m
b 2| |2, 6 − 5, 7| = 3, 1 > 1, 27∗
|m
b1 − m
b 3| |2, 6 − 3, 1| = 0, 5 < 1, 27 ns
M

|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 27 ns
|m
b2 − m
b 3| |5, 7 − 3, 1| = 2, 6 > 1, 27∗
|m
b2 − m
b 4| |5, 7 − 2, 4| = 3, 3 > 1, 27∗
|m
b3 − m
b 4| |3, 1 − 2, 4| = 0, 7 < 1, 27 ns

A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.

Tabela 12.16: Teste de Tukey - Utilizando Letras


Tratamentos Médias
1 5,7 a
2 3,1 b
3 2,6 a
4 2,4 a
Estatı́stica 196

Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.

12.9 Teste de Duncan


O teste de Duncan classifica diferenças entre médias com mais facilidade do que o Tukey,
porém possui menor rigor do que o teste de Tukey. Nesse teste é requerido que o número de
repetições sejam iguais em cada tratamento e que as médias dos tratamentos sejam ordenadas da
maior para a menor. Assim, para realizar esse teste o seguinte procedimento deve ser realizado.
1. Ordenar as estimativa das médias dos I tratamentos da maior para a menor.
2. Calcular o valor absoluto da diferença entre as médias (duas a duas), ou seja, para os trata-
mentos u e v com u ̸= v calcular
|m
bu − m b v|
3. Calcular a Diferença Mı́nima Significativa (dms), dada por:
r
SQRM
dms = Zα, mI , I(J−1)
TA J
sendo Zα, mI , I(J−1) o valor obtido da tabela para o teste de Duncan com nı́vel α de probabi-
lidade, mI é o numero de médias abrangidas pela diferença de média considerada e I(J − 1)
graus de liberdade.
U
4. Regra de Decisão: As médias dos tratamentos u e v são estatisticamente diferentes (ou há
uma diferença significativa entre as médias dos dois tratamentos) se:
IN

|m
bu − m
b v | ≥ dms
5. A comparação é inicida pelo maior intervalo de médias dos I tratamentos (maior diferença
M

entre duas médias).


• Se a maior diferença não for significativa se encerra o processo de comparação.
• Se não forem significativas, segue a comparação com os demais intervalos (diferenças)
de médias.
Exemplo 12.9.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo, pelo
menos duas médias são diferentes. Realizar o teste de Duncan para comparar as múltiplas médias.

Tabela 12.17: Dados de um DIC com 4 tratamentos e 5 repetições


Tratamentos Repetições/Observações Totais Médias
1 2 3 4 5
1 2,9 2,2 3,8 2,0 2,1 13,0 2,6
2 4,1 6,0 8,1 5,0 5,1 28,3 5,7
3 3,6 3,0 3,1 2,8 3,0 15,5 3,1
4 1,8 1,5 3,3 2,9 2,7 12,2 2,4
Estatı́stica 197

Solução

1. Ordenar as médias da maior para a menor: 5,7; 3,1; 2,6; 2,4.

m
b 2 = 5, 7

m
b 3 = 3, 1
m
b 1 = 2, 6
m
b 4 = 2, 4

2. Calcular o valor absoluto da diferença entre as médias (duas a duas), e ordenar da maior
diferença para a menor:
|m
b2 − mb 4 | = |5, 7 − 2, 4| = 3, 3
|m
b2 − m
b 1 | = |2, 6 − 5, 7| = 3, 1
|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
|m
b2 − m
b 3 | = |5, 7 − 3, 1| = 2, 6
TA
|m
b1 − m
b 3 | = |2, 6 − 3, 1| = 0, 5
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2
U
3. Calcular a Diferença Mı́nima Significativa (dms), dada por:
IN

(a) Considerando a diferença |m


b2 − m
b 4|
M

r
SQRM
dms4 = Zα, mI , I(J−1)
r J
0, 9
= Z5%, 4, 4(5−1)
5
r
0, 9
= Z5%, 4, 16
5
r
0, 9
= 3, 23 ≈ 1, 37
5

Nesse caso a diferença entre |m


b2 − m
b 4 | abrange 4 médias, ou seja, mI = 4.
Estatı́stica 198

(b) Considerando a diferença |m


b1 − m
b 2|
r
SQRM
dms3 = Zα, mI , I(J−1)
r J
0, 9
= Z5%, 3, 4(5−1)
5
r
0, 9
= Z5%, 3, 16
5
r
0, 9
= 3, 14 ≈ 1, 33
5

Nesse caso a diferença entre |m


b1 − m
b 2 | abrange 3 médias, ou seja, mI = 3.

(c) Considerando a diferença |m


b2 − m
b 3|
r
SQRM
TA
dms2 = Zα, mI , I(J−1)
r J
0, 9
= Z5%, 2, 4(5−1)
5
U
r
0, 9
= Z5%, 2, 16
5
IN

r
0, 9
= 2, 99 ≈ 1, 27
5
M

Nesse caso a diferença entre |m


b2 − m
b 3 | abrange 2 médias, ou seja, mI = 2.

sendo Zα, mI , I(J−1) o valor obtido da tabela para o teste de Duncan com nı́vel α de proba-
bilidade, mI número de médias abrangidas pela diferença de média considerada e I(J − 1)
graus de liberdade.

4. A Regra de Decisão diz que as médias de dois tratamentos são estatisticamente diferentes
(ou há uma diferença significativa entre as médias dos dois tratamentos) se:

|m
bu − m
b v | ≥ dms

5. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
Estatı́stica 199

Tabela 12.18: Compração de múltiplas médias - Teste de Duncan


Tratamentos Comparados Valor Absoluta Diferença e DMS
|m
b2 − m
b 4| |5, 7 − 2, 4| = 3, 3 > 1, 37 = dms4 ∗
|m
b2 − m
b 1| |2, 6 − 5, 7| = 3, 1 > 1, 33 = dms3 ∗
|m
b3 − m
b 4| |3, 1 − 2, 4| = 0, 7 < 1, 33 = dms3 ns
|m
b2 − m
b 3| |5, 7 − 3, 1| = 2, 6 > 1, 27 = dms2 ∗
|m
b1 − m
b 3| |2, 6 − 3, 1| = 0, 5 < 1, 27 = dms2 ns
|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 27 = dms2 ns

A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.

Tratamentos
TA
Tabela 12.19: Teste de Duncan - Utilizando Letras
Médias
1 5,7 a
U
2 3,1 b
3 2,6 a
IN

4 2,4 a
M

Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.

12.10 Teste de Dunnet


Comparação de grupo controle (testemunha) com os tratamentos. Nesse teste não há interesse
na comparação dos demais tratamentos entre si.
(
H0 : mu = mcontrole
(12.6)
H1 : mu ̸= mcontrole

Para realizar esse teste o seguinte procedimento deve ser realizado.

1. Calcular o valor absoluto da diferença entre as médias u com a média do controle, ou seja,

|m
bu − m
b controle |

2. Calcular a Diferença Mı́nima Significativa (dms), dada por:


Estatı́stica 200

(a) Dados Balanceados r


2 · SQRM
dms = tα, I−1, I(J−1)
J
sendo tα, I−1, I(J−1) o valor obtido da tabela para o teste de Dunnett com nı́vel α de
probabilidade, I − 1 número de médias de tratamentos e I(J − 1) graus de liberdade.

(b) Dados Desbalanceados


s  
1 1
dms = tα, I−1, I(J−1) SQRM +
Ju Jcontrole

3. Regra de Decisão: As médias dos tratamentos u e controle são estatisticamente diferentes


(ou há uma diferença significativa entre as médias dos dois tratamentos) se:

|m
bu − m
b controle | ≥ dms

Exemplo 12.10.1. No exemplo 12.6.1, foi possı́vel concluir que no DIC, com os dados abaixo,
TA
pelo menos duas médias são diferentes. Realizar o teste de Dunnett para comparar as múltiplas
médias, considerando o tratamento 4 como controle..
U
Tabela 12.20: Dados de um DIC com 4 tratamentos e 5 repetições
Tratamentos Repetições/Observações Totais Médias
IN

1 2 3 4 5
1 2,9 2,2 3,8 2,0 2,1 13,0 2,6
M

2 4,1 6,0 8,1 5,0 5,1 28,3 5,7


3 3,6 3,0 3,1 2,8 3,0 15,5 3,1
4 1,8 1,5 3,3 2,9 2,7 12,2 2,4

Solução

1. Calcular o valor absoluto da diferença entre as médias dos tratamentos com a média do
tratameno controle (m4 = mcontrole = mcon ).

|m
b2 − m
b 4 | = |5, 7 − 2, 4| = 3, 3

|m
b3 − m
b 4 | = |3, 1 − 2, 4| = 0, 7
|m
b1 − m
b 4 | = |2, 6 − 2, 4| = 0, 2

2. Calcular a Diferença Mı́nima Significativa (dms), que nos caso de dados balanceados (mesmo
número de repetições nos tratamentos), é dada por:
Estatı́stica 201

r
2 · SQRM
dms = tα, I−1, I(J−1)
r J
2 · 0, 9
= tα, 4−1, 4(5−1)
5
r
2 · 0, 9
= tα, 3, 16
5
r
1, 8
= 2, 42 ≈ 1, 45
5

sendo tα, I−1, I(J−1) o valor obtido da tabela para o teste de Dunnett com nı́vel α de proba-
bilidade, I − 1 número de médias de tratamentos e I(J − 1) graus de liberdade.
3. A Regra de Decisão diz que as médias de um tratamento com o controle são estatisticamente
diferentes (ou há uma diferença significativa entre as médias dos dois tratamentos) se:
|m
bu − m
TAb controle | ≥ dms

4. Assim, é possı́vel construir a seguinte tabela e indicar com * as médias que são significati-
vamente diferentes e com ns as médias que não são diferentes com 5% de probabilidade.
U
Tabela 12.21: Compração de múltiplas médias - Teste de Dunnett
IN

Tratamentos Comparados Valor Absoluta Diferença e DMS


|m
b2 − m
b 4| |5, 7 − 2, 4| = 3, 3 > 1, 45 = dms ∗
|m
b3 − m
b 4| |3, 1 − 2, 4| = 0, 7 < 1, 45 = dms ns
M

|m
b1 − m
b 4| |2, 6 − 2, 4| = 0, 2 < 1, 45 = dms ns

A compração de múltiplas médias, pode também, ser representada com a tabela a seguir que
utiliza letras diferentes para indicar tratamentos estatisticamente diferentes com um nı́vel α
de significância. Nesse exemplo α = 5%.

Tabela 12.22: Teste de Duncan - Utilizando Letras


Tratamentos Médias
1 5,7 a
2 3,1 b
3 2,6 a
4 2,4 a

Letras diferentes indicam que as médias são estatı́sticamente diferentes com α% de signi-
ficância.
Estatı́stica 202

13 Tabelas de Distribuições
Tabela da distribuição Normal Padronizada - N (0, 1)

𝑃ሺ0 < 𝑍 < 𝑍𝛼 ሻ = 𝛼 𝛼

0 𝑍𝛼 𝑍

Z 0,00 0,01 0,02 0,03 0,04 0,05 0,06 0,07 0,08 0,09 Z
0,00 0,000000 0,003989 0,007978 0,011967 0,015953 0,019939 0,023922 0,027903 0,031881 0,035856 0,00
0,10 0,039828 0,043795 0,047758 0,051717 0,055670 0,059618 0,063559 0,067495 0,071424 0,075345 0,10
0,20 0,079260 0,083166 0,087064 0,090954 0,094835 0,098706 0,102568 0,106420 0,110261 0,114092 0,20
0,30 0,117911 0,121719 0,125516 0,129300 0,133072 0,136831 0,140576 0,144309 0,148027 0,151732 0,30
0,40 0,155422 0,159097 0,162757 0,166402 0,170031 0,173645 0,177242 0,180822 0,184386 0,187933 0,40
0,50 0,191462 0,194974 0,198468 0,201944 0,205402 0,208840 0,212260 0,215661 0,219043 0,222405 0,50
0,60 0,225747 0,229069 0,232371 0,235653 0,238914 0,242154 0,245373 0,248571 0,251748 0,254903 0,60
0,70 0,258036 0,261148 0,264238 0,267305 0,270350
TA 0,273373 0,276373 0,279350 0,282305 0,285236 0,70
0,80 0,288145 0,291030 0,293892 0,296731 0,299546 0,302338 0,305106 0,307850 0,310570 0,313267 0,80
0,90 0,315940 0,318589 0,321214 0,323814 0,326391 0,328944 0,331472 0,333977 0,336457 0,338910 0,90
1,00 0,341345 0,343752 0,346136 0,348495 0,350830 0,353145 0,355428 0,357690 0,359929 0,362146 1,00
1,10 0,364334 0,366500 0,368643 0,370762 0,372857 0,374928 0,376976 0,378999 0,381000 0,382977 1,10
U
1,20 0,384930 0,386860 0,388767 0,390651 0,392512 0,394350 0,396165 0,397958 0,399727 0,401475 1,20
1,30 0,403199 0,404902 0,406582 0,408241 0,409877 0,411492 0,413085 0,414656 0,416207 0,417736 1,30
1,40 0,419243 0,420730 0,422196 0,423641 0,425066 0,426471 0,427855 0,429219 0,430563 0,431888 1,40
IN

1,50 0,433193 0,434478 0,435744 0,436992 0,438220 0,439429 0,440620 0,441792 0,442947 0,444083 1,50
1,60 0,445201 0,446301 0,447384 0,448449 0,449497 0,450529 0,451543 0,452540 0,453521 0,454486 1,60
1,70 0,455435 0,456367 0,457284 0,458185 0,459071 0,459941 0,460796 0,461636 0,462462 0,463273 1,70
M

1,80 0,464070 0,464852 0,465621 0,466375 0,467116 0,467843 0,468557 0,469258 0,469946 0,470621 1,80
1,90 0,471284 0,471933 0,472571 0,473197 0,473810 0,474412 0,475002 0,475581 0,476148 0,476705 1,90
2,00 0,477250 0,477784 0,478308 0,478822 0,479325 0,479818 0,480301 0,480774 0,481237 0,481691 2,00
2,10 0,482136 0,482571 0,482997 0,483414 0,483823 0,484222 0,484614 0,484997 0,485371 0,485738 2,10
2,20 0,486097 0,486447 0,486791 0,487126 0,487455 0,487776 0,488089 0,488396 0,488696 0,488989 2,20
2,30 0,489276 0,489556 0,489830 0,490097 0,490358 0,490613 0,490863 0,491106 0,491344 0,491576 2,30
2,40 0,491802 0,492024 0,492240 0,492451 0,492656 0,492857 0,493053 0,493244 0,493431 0,493613 2,40
2,50 0,493790 0,493963 0,494132 0,494297 0,494457 0,494614 0,494766 0,494915 0,495060 0,495201 2,50
2,60 0,495339 0,495473 0,495603 0,495731 0,495855 0,495975 0,496093 0,496207 0,496319 0,496427 2,60
2,70 0,496533 0,496636 0,496736 0,496833 0,496928 0,497020 0,497110 0,497197 0,497282 0,497365 2,70
2,80 0,497445 0,497523 0,497599 0,497673 0,497744 0,497814 0,497882 0,497948 0,498012 0,498074 2,80
2,90 0,498134 0,498193 0,498250 0,498305 0,498359 0,498411 0,498462 0,498511 0,498559 0,498605 2,90
3,00 0,498650 0,498694 0,498736 0,498777 0,498817 0,498856 0,498893 0,498930 0,498965 0,498999 3,00
3,10 0,499032 0,499064 0,499096 0,499126 0,499155 0,499184 0,499211 0,499238 0,499264 0,499289 3,10
3,20 0,499313 0,499336 0,499359 0,499381 0,499402 0,49S423 0,499443 0,499462 0,499481 0,499499 3,20
3,30 0,499517 0,499533 0,499550 0,499566 0,499581 0,499596 0,499610 0,499624 0,499638 0,499650 3,30
3,40 0,499663 0,499675 0,499687 0,499698 0,499709 0,499720 0,499730 0,499740 0,499749 0,499758 3,40
3,50 0,499767 0,499776 0,499784 0,499792 0,499800 0,499807 0,499815 0,499821 0,499828 0,499835 3,50
3,60 0,499841 0,499847 0,499853 0,499858 0,499864 0,499869 0,499874 0,499879 0,499883 0,499888 3,60
3,70 0,499892 0,499896 0,499900 0,499904 0,499908 0,499912 0,499915 0,499918 0,499922 0,499925 3,70
3,80 0,499928 0,499930 0,499933 0,499936 0,499938 0,499941 0,499943 0,499946 0,499948 0,499950 3,80
3,90 0,499952 0,499954 0,499956 0.499958 0,499959 0,499961 0,499963 0,499964 0,499966 0,499967 3,90
4,00 0,499968 0,499970 0,499971 0,499972 0,499973 0,499974 0,499975 0,499976 0,499977 0,499978 4,00
Estatı́stica 203

Tabela da distribuição t, com ϕ graus de liberdade e nı́vel de significância α.

𝑃ሺ𝑡 > 𝑡𝛼 ሻ = 𝛼

0 𝑡𝛼 𝑡

ϕ/α 0,1 0,05 0,025 0,01 0,005 ϕ/α


1 3,0777 6,3137 12,7062 31,8210 63,5590 1
2 1,8856 2,9200 4,3027 6,9645 9,9250 2
3 1,6377 2,3534 3,1824 4,5407 5,8408 3
4 1,5332 2,1318 2,7765 3,7469 4,6041 4
5 1,4759 2,0150 2,5706 3,3649 4,0321 5
6 1,4398 1,9432 2,4469 3,1427 3,7074 6
7 1,4149 1,8946 2,3646 2,9979 3,4995 7
8 1,3968 1,8595 2,3060
TA 2,8965 3,3554 8
9 1,3830 1,8331 2,2622 2,8214 3,2498 9
10 1,3722 1,8125 2,2281 2,7638 3,1693 10
11 1,3634 1,7959 2,2010 2,7181 3,1058 11
12 1,3562 1,7823 2,1788 2,6810 3,0545 12
U
13 1,3502 1,7709 2,1604 2,6503 3,0123 13
14 1,3450 1,7613 2,1448 2,6245 2,9768 14
15 1,3406 1,7531 2,1315 2,6025 2,9467 15
IN

16 1,3368 1,7459 2,1199 2,5835 2,9208 16


17 1,3334 1,7396 2,1098 2,5669 2,8982 17
18 1,3304 1,7341 2,1009 2,5524 2,8784 18
M

19 1,3277 1,7291 2,0930 2,5395 2,8609 19


20 1,3253 1,7247 2,0860 2,5280 2,8453 20
21 1,3232 1,7207 2,0796 2,5176 2,8314 21
22 1,3212 1,7171 2,0739 2,5083 2,8188 22
23 1,3195 1,7139 2,0687 2,4999 2,8073 23
24 1,3178 1,7109 2,0639 2,4922 2,7970 24
25 1,3163 1,7081 2,0595 2,4851 2,7874 25
26 1,3150 1,7056 2,0555 2,4786 2,7787 26
27 1,3137 1,7033 2,0518 2,4727 2,7707 27
28 1,3125 1,7011 2,0484 2,4671 2,7633 28
29 1,3114 1,6991 2,0452 2,4620 2,7564 29
30 1,3104 1,6973 2,0423 2,4573 2,7500 33
35 1,3062 1,6896 2,0301 2,4377 2,7238 35
40 1,3031 1,6839 2,0211 2,4233 2,7045 40
45 1,3007 1,6794 2,0141 2,4121 2,6896 45
50 1,2987 1,6759 2,0086 2,4033 2,6778 50
60 1,2958 1,6706 2,0003 2,3901 2,6603 60
70 1,2938 1,6669 1,9944 2,3808 2,6479 70
80 1,2922 1,6641 1,9901 2,3739 2,6387 80
90 1,2910 1,6620 1,9867 2,3685 2,6316 90
100 1,2901 1,6602 1,9840 2,3642 2,6259 100
1000 1,2824 1,6464 1,9623 2,3301 2,5807 1000
Estatı́stica 204

Tabela da distribuição χ2 , com ϕ graus de liberdade e nı́vel de significância α.

𝑃ሺ𝜒 2 > 𝜒𝛼2 ሻ = 𝛼

𝛼
0 𝜒𝛼2 𝜒2

ϕ/α 0,995 0,99 0,975 0,95 0,9 0,8 0,75 0,25 0,2 0,1 0,05 0,025 0,01 0,005 ϕ/α
1 0,0000 0,0002 0,0010 0,0039 0,0158 0,0642 0,1015 1,3233 1,6424 2,7055 3,8415 5,0239 6,6349 7,8794 1
2 0,0100 0,0201 0,0506 0,1026 0,2107 0,4463 0,5754 2,7726 3,2189 4,6052 5,9915 7,3778 9,2104 10,5965
3 0,0717 0,1148 0,2158 0,3518 0,5844 1,0052 1,2125 4,1083 4,6416 6,2514 7,8147 9,3484 11,3449 12,8381 3
4 0,2070 0,2971 0,4844 0,7107 1,0636 1,6488 1,9226 5,3853 5,9886 7,7794 9,4877 11,1433 13,2767 14,8602 4
5
6
0,4118
0,6757
0,5543
0,8721
0,8312
1,2373
1,1455
1,6354
1,6103
2,2041
2,3425
3,0701
TA
2,6746
3,4546
6,6257
7,8408
7,2893 9,2363 11,0705 12,8325 15,0863 16,7496
8,5581 10,6446 12,5916 14,4494 16,8119 18,5475
5
6
7 0,9893 1,2390 1,6899 2,1673 2,8331 3,8223 4,2549 9,0371 9,8032 12,0170 14,0671 16,0128 18,4753 20,2777 7
8 1,3444 1,6465 2,1797 2,7326 3,4895 4,5936 5,0706 10,2189 11,0301 13,3616 15,5073 17,5345 20,0902 21,9549 8
U
9 1,7349 2,0879 2,7004 3,3251 4,1682 5,3801 5,8988 11,3887 12,2421 14,6837 16,9190 19,0228 21,6660 23,5893 9
10 2,1558 2,5582 3,2470 3,9403 4,8652 6,1791 6,7372 12,5489 13,4420 15,9872 18,3070 20,4832 23,2093 25,1881 10
IN

11 2,6032 3,0535 3,8157 4,5748 5,5778 6,9887 7,5841 13,7007 14,6314 17,2750 19,6752 21,9200 24,7250 26,7569 11
12 3,0738 3,5706 4,4038 5,2260 6,3038 7,8073 8,4384 14,8454 15,8120 18,5493 21,0261 23,3367 26,2170 28,2997 12
13 3,5650 4,1069 5,0087 5,8919 7,0415 8,6339 9,2991 15,9839 16,9848 19,8119 22,3620 24,7356 27,6882 29,8193 13
14 4,0747 4,6604 5,6287 6,5706 7,7895 9,4673 10,1653 17,1169 18,1508 21,0641 23,6848 26,1189 29,1412 31,3194 14
M

15 4,6009 5,2294 6,2621 7,2609 8,5468 10,3070 11,0365 18,2451 19,3107 22,3071 24,9958 27,4884 30,5780 32,8015 15
16 5,1422 5,8122 6,9077 7,9616 9,3122 11,1521 11,9122 19,3689 20,4651 23,5418 26,2962 28,8453 31,9999 34,2671 16
17 5,6973 6,4077 7,5642 8,6718 10,0852 12,0023 12,7919 20,4887 21,6146 24,7690 27,5871 30,1910 33,4087 35,7184 17
18 6,2648 7,0149 8,2307 9,3904 10,8649 12,8570 13,6753 21,6049 22,7595 25,9894 28,8693 31,5264 34,8052 37,1564 18
19 6,8439 7,6327 8,9065 10,1170 11,6509 13,7158 14,5620 22,7178 23,9004 27,2036 30,1435 32,8523 36,1908 38,5821 19
20 7,4338 8,2604 9,5908 10,8508 12,4426 14,5784 15,4518 23,8277 25,0375 28,4120 31,4104 34,1696 37,5663 39,9969 20
21 8,0336 8,8972 10,2829 11,5913 13,2396 15,4446 16,3444 24,9348 26,1711 29,6151 32,6706 35,4789 38,9322 41,4009 21
22 8,6427 9,5425 10,9823 12,3380 14,0415 16,3140 17,2396 26,0393 27,3015 30,8133 33,9245 36,7807 40,2894 42,7957 22
23 9,2604 10,1957 11,6885 13,0905 14,8480 17,1865 18,1373 27,1413 28,4288 32,0069 35,1725 38,0756 41,6383 44,1814 23
24 9,8862 10,8563 12,4011 13,8484 15,6587 18,0618 19,0373 28,2412 29,5533 33,1962 36,4150 39,3641 42,9798 45,5584 24
25 10,5196 11,5240 13,1197 14,6114 16,4734 18,9397 19,9393 29,3388 30,6752 34,3816 37,6525 40,6465 44,3140 46,9280 25
26 11,1602 12,1982 13,8439 15,3792 17,2919 19,8202 20,8434 30,4346 31,7946 35,5632 38,8851 41,9231 45,6416 48,2898 26
27 11,8077 12,8785 14,5734 16,1514 18,1139 20,7030 21,7494 31,5284 32,9117 36,7412 40,1133 43,1945 46,9628 49,6450 27
28 12,4613 13,5647 15,3079 16,9279 18,9392 21,5880 22,6572 32,6205 34,0266 37,9159 41,3372 44,4608 48,2782 50,9936 28
29 13,1211 14,2564 16,0471 17,7084 19,7677 22,4751 23,5666 33,7109 35,1394 39,0875 42,5569 45,7223 49,5878 52,3355 29
30 13,7867 14,9535 16,7908 18,4927 20,5992 23,3641 24,4776 34,7997 36,2502 40,2560 43,7730 46,9792 50,8922 53,6719 30
35 17,1917 18,5089 20,5694 22,4650 24,7966 27,8359 29,0540 40,2228 41,7780 46,0588 49,8018 53,2033 57,3420 60,2746 35
40 20,7066 22,1642 24,4331 26,5093 29,0505 32,3449 33,6603 45,6160 47,2685 51,8050 55,7585 59,3417 63,6908 66,7660 40
Estatı́stica 205

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 01

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,01

1%

0 𝐹𝛼 𝐹

D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 4052,18 4999,34 5403,53 5624,26 5763,96 5858,95 5928,33 5980,95 6022,40 6055,93 6083,40 6106,68 6125,77 1
2 98,5019 99,0003 99,1640 99,2513 99,3023 99,3314 99,3568 99,3750 99,3896 99,3969 99,4078 99,4187 99,4223 2
3 34,1161 30,8164 29,4567 28,7100 28,2371 27,9106 27,6714 27,4895 27,3449 27,2285 27,1320 27,0520 26,9829 3
4 21,1976 17,9998 16,6942 15,9771 15,5219 15,2068 14,9757 14,7988 14,6592 14,5460 14,4523 14,3737 14,3064 4
5 16,2581 13,2741 12,0599 11,3919 10,9671 10,6722 10,4556 10,2893 10,1577 10,0511 9,9626
TA 9,8883 9,8248 5
6 13,7452 10,9249 9,7796 9,1484 8,7459 8,4660 8,2600 8,1017 7,9760 7,8742 7,7896 7,7183 7,6575 6
7 12,2463 9,5465 8,4513 7,8467 7,4604 7,1914 6,9929 6,8401 6,7188 6,6201 6,5381 6,4691 6,4100 7
8 11,2586 8,6491 7,5910 7,0061 6,6318 6,3707 6,1776 6,0288 5,9106 5,8143 5,7343 5,6667 5,6089 8
9 10,5615 8,0215 6,9920 6,4221 6,0569 5,8018 5,6128 5,4671 5,3511 5,2565 5,1779 5,1115 5,0545 9
U
10 10,0442 7,5595 6,5523 5,9944 5,6364 5,3858 5,2001 5,0567 4,9424 4,8491 4,7716 4,7058 4,6496 10
11 9,6461 7,2057 6,2167 5,6683 5,3160 5,0692 4,8860 4,7445 4,6315 4,5393 4,4624 4,3974 4,3416 11
IN

12 9,3303 6,9266 5,9525 5,4119 5,0644 4,8205 4,6395 4,4994 4,3875 4,2961 4,2198 4,1553 4,0998 12
13 9,0738 6,7009 5,7394 5,2053 4,8616 4,6203 4,4410 4,3021 4,1911 4,1003 4,0245 3,9603 3,9052 13
14 8,8617 6,5149 5,5639 5,0354 4,6950 4,4558 4,2779 4,1400 4,0297 3,9394 3,8640 3,8002 3,7452 14
M

15 8,6832 6,3588 5,4170 4,8932 4,5556 4,3183 4,1416 4,0044 3,8948 3,8049 3,7299 3,6662 3,6115 15
16 8,5309 6,2263 5,2922 4,7726 4,4374 4,2016 4,0259 3,8896 3,7804 3,6909 3,6162 3,5527 3,4981 16
17 8,3998 6,1121 5,1850 4,6689 4,3360 4,1015 3,9267 3,7909 3,6823 3,5931 3,5185 3,4552 3,4007 17
18 8,2855 6,0129 5,0919 4,5790 4,2479 4,0146 3,8406 3,7054 3,5971 3,5081 3,4338 3,3706 3,3162 18
19 8,1850 5,9259 5,0103 4,5002 4,1708 3,9386 3,7653 3,6305 3,5225 3,4338 3,3596 3,2965 3,2422 19
20 8,0960 5,8490 4,9382 4,4307 4,1027 3,8714 3,6987 3,5644 3,4567 3,3682 3,2941 3,2311 3,1769 20
21 8,0166 5,7804 4,8740 4,3688 4,0421 3,8117 3,6396 3,5056 3,3982 3,3098 3,2359 3,1729 3,1115 21
22 7,9453 5,7190 4,8166 4,3134 3,9880 3,7583 3,5866 3,4530 3,3458 3,2576 3,1837 3,1209 3,0667 22
23 7,8811 5,6637 4,7648 4,2635 3,9392 3,7102 3,5390 3,4057 3,2986 3,2106 3,1368 3,0740 3,0199 23
24 7,8229 5,6136 4,7181 4,2185 3,8951 3,6667 3,4959 3,3629 3,2560 3,1681 3,0944 3,0316 2,9775 24
25 7,7698 5,5680 4,6755 4,1774 3,8550 3,6272 3,4568 3,3239 3,2172 3,1294 3,0558 2,9931 2,9389 25
26 7,7213 5,5263 4,6365 4,1400 3,8183 3,5911 3,4210 3,2884 3,1818 3,0941 3,0205 2,9578 2,9038 26
27 7,6767 5,4881 4,6009 4,1056 3,7847 3,5580 3,3882 3,2558 3,1494 3,0618 2,9882 2,9256 2,8715 27
28 7,6357 5,4529 4,5681 4,0740 3,7539 3,5276 3,3581 3,2259 3,1195 3,0320 2,9585 2,8959 2,8418 28
29 7,5977 5,4205 4,5378 4,0449 3,7254 3,4995 3,3303 3,1982 3,0920 3,0045 2,9311 2,8685 2,8144 29
30 7,5624 5,3903 4,5097 4,0179 3,6990 3,4735 3,3045 3,1726 3,0665 2,9791 2,9057 2,8431 2,7890 30
40 7,3142 5,1785 4,3126 3,8283 3,5138 3,2910 3,1238 2,9930 2,8876 2,8005 2,7273 2,6648 2,6107 40
50 7,1706 5,0566 4,1994 3,7195 3,4077 3,1864 3,0202 2,8900 2,7850 2,6981 2,6250 2,5625 2,5083 50
100 6,8953 4,8239 3,9837 3,5127 3,2059 2,9877 2,8233 2,6943 2,5898 2,1793 2,4302 2,3676 2,3132 100
Estatı́stica 206

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 01 (continuação)

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,01

1%

0 𝐹𝛼 𝐹

D/N 14 15 16 17 18 19 20 25 30 40 50 100 N/D


1 6143 6156,97 6170,01 6181,19 6191,43 6200,75 6208,66 6239,86 6260,35 6286,43 6302,26 6333,92 1
2 99,4260 99,4332 99,4369 99,4405 99,4442 99,4478 99,4478 99,4587 99,4660 99,4769 99,4769 99,4914 2
3 26,9238 26,8719 26,8265 26,7864 26,7510 26,7191 26,6900 26,5791 26,5045 26,4108 26,3544 26,2407 3
4 14,2486 14,1981 14,1540 14,1144 14,0794 14,0481 14,0194 13,9107 13,8375 13,7452 13,6897 13,5769 4
5 9,7700 9,7223 9,6802 9,6429 9,6095 9,5797
TA 9,5527 9,4492 9,3794 9,2912 9,2377 9,1300 5
6 7,6050 7,5590 7,5186 7,4826 7,4506 7,4219 7,3958 7,2960 7,2286 7,1432 7,0914 6,9867 6
7 6,3590 6,3144 6,2751 6,2400 6,2089 6,1808 6,1555 6,0579 5,9920 5,9084 5,8577 5,7546 7
8 5,5588 5,5152 5,4765 5,4423 5,4116 5,3841 5,3591 5,2631 5,1981 5,1156 5,0654 4,9633 8
9 5,0052 4,9621 4,9240 4,8902 4,8599 4,8327 4,8080 4,7130 4,6486 4,5667 4,5167 4,4150 9
U
10 4,6008 4,5582 4,5204 4,4869 4,4569 4,4299 4,4054 4,3111 4,2469 4,1653 4,1155 4,0137 10
11 4,2933 4,2509 4,2135 4,1802 4,1503 4,1234 4,0990 4,0051 3,9411 3,8596 3,8097 3,7077 11
IN

12 4,0517 4,0096 3,9724 3,9392 3,9095 3,8827 3,8584 3,7647 3,7008 3,6192 3,5692 3,4668 12
13 3,8573 3,8154 3,7783 3,7452 3,7156 3,6889 3,6646 3,5710 3,5070 3,4253 3,3752 3,2723 13
14 3,6976 3,6557 3,6187 3,5857 3,5561 3,5294 3,5052 3,4116 3,3476 3,2657 3,2153 3,1118 14
M

15 3,5639 3,5222 3,4852 3,4523 3,4228 3,3961 3,3719 3,2782 3,2141 3,1319 3,0814 2,9772 15
18 3,4506 3,4090 3,3721 3,3392 3,3096 3,2829 3,2587 3,1650 3,1007 3,0182 2,9675 2,8627 16
17 3,3533 3,3117 3,2748 3,2419 3,2124 3,1857 3,1615 3,0676 3,0032 2,9204 2,8694 2,7639 17
18 3,2689 3,2273 3,1905 3,1575 3,1280 3,1013 3,0771 2,9831 2,9185 2,8354 2,7841 2,6779 18
19 3,1949 3,1533 3,1165 3,0836 3,0541 3,0274 3,0031 2,9089 2,8442 2,7608 2,7092 2,6023 19
20 3,1296 3,0880 3,0512 3,0183 2,9887 2,9620 2,9377 2,8434 2,7785 2,6947 2,6430 2,5353 20
21 3,0715 3,0300 2,9931 2,9602 2,9306 2,9038 2,8795 2,7850 2,7200 2,6359 2,5838 2,4755 21
22 3,0195 2,9779 2,9411 2,9082 2,8786 2,8518 2,8274 2,7328 2,6675 2,5831 2,5308 2,4218 22
23 2,9727 2,9311 2,8942 2,8613 2,8317 2,8049 2,7805 2,6857 2,6202 2,5355 2,4829 2,3732 23
24 2,9303 2,8887 2,8519 2,8189 2,7892 2,7624 2,7380 2,6430 2,5773 2,4923 2,4395 2,3291 24
25 2,8917 2,8502 2,8133 2,7803 2,7506 2,7238 2,6993 2,6041 2,5383 2,4530 2,3999 2,2888 25
26 2,8566 2,8150 2,7781 2,7451 2,7154 2,6885 2,6640 2,5686 2,5026 2,4170 2,3637 2,2519 26
27 2,8243 2,7827 2,7458 2,7127 2,6830 2,6561 2,6316 2,5360 2,4699 2,3840 2,3304 2,2180 27
28 2,7946 2,7530 2,7160 2,6830 2,6532 2,6263 2,6018 2,5060 2,4397 2,3535 2,2997 2,1867 28
29 2,7672 2,7256 2,6886 2,6555 2,6257 2,5987 2,5742 2,4783 2,4118 2,3253 2,2713 2,1577 29
30 2,7418 2,7002 2,6632 2,6301 2,6002 2,5732 2,5487 2,4526 2,3860 2,2992 2,2450 2,1307 30
40 2,5634 2,5216 2,4844 2,4511 2,4210 2,3937 2,3689 2,2714 2,2034 2,1142 2,0581 1,9383 40
50 2,4609 2,4190 2,3816 2,3481 2,3178 2,2903 2,2652 2,1667 2,0976 2,0066 1,9490 1,8248 50
100 2,2654 2,2230 2,1852 2,1511 2,1203 2,0923 2,0666 1,9651 1,8933 1,7972 1,7353 1,5977 100
Estatı́stica 207

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 025

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,025

2,5%

0 𝐹𝛼 𝐹

D/N 1 2 3 4 5 6 7 -8 9 10 11 12 13 N/D
1 647,79 799,48 864,15 899,60 921,83 937,11 948,20 956,64 963,28 968,63 973,03 976,72 979,84 1
2 38,5062 39,0000 39,1656 39,2483 39,2984 39,3311 39,3557 39,3729 39,3866 39,3984 39,4066 39,4148 39,4211 2
3 17,4434 16,0442 15,4391 15,1010 14,8848 14,7347 14,6244 14,5399 14,4730 14,4189 14,3741 14,3366 14,3045 3
4 12,2179 10,6490 9,9792 9,6045 9,3645 9,1973 9,0741 8,9796 8,9046 8,8439 8,7936 8,7512 8,7150 4
5 10,0069 8,4336 7,7636 7,3879 7,1464 6,9777TA 6,8530 6,7572 6,6810 6,6192 6,5678 6,5245 6,4876 5
6 8,8131 7,2599 6,5988 6,2271 5,9875 5,8197 5,6955 5,5996 5,5234 5,4613 5,4098 5,3662 5,3290 6
7 8,0727 6,5415 5,8898 5,5226 5,2852 5,1186 4,9949 4,8993 4,8232 4,7611 4,7095 4,6658 4,6285 7
8 7,5709 6,0595 5,4160 5,0526 4,8173 4,6517 4,5285 4,4333 4,3572 4,2951 4,2434 4,1997 4,1622 8
9 7,2093 5,7147 5,0781 4,7181 4,4844 4,3197 4,1970 4,1020 4,0260 3,9639 3,9121 3,8682 3,8306 9
U
10 6,9367 5,4564 4,8256 4,4683 4,2361 4,0721 3,9498 3,8549 3,7790 3,7168 3,6649 3,6210 3,5832 10
11 6,7241 5,2559 4,6300 4,2751 4,0440 3,8806 3,7586 3,6638 3,5879 3,5257 3,4737 3,4296 3,3917 11
IN

12 6,5538 5,0959 4,4742 4,1212 3,8911 3,7283 3,6065 3,5118 3,4358 3,3735 3,3215 3,2773 3,2393 12
13 6,4143 4,9653 4,3472 3,9959 3,7667 3,6043 3,4827 3,3880 3,3120 3,2497 3,1975 3,1532 3,1150 13
14 6,2979 4,8567 4,2417 3,8919 3,6634 3,5014 3,3799 3,2853 3,2093 3,1469 3,0946 3,0502 3,0119 14
M

15 6,1995 4,7650 4,1528 3,8043 3,5764 3,4147 3,2934 3,1987 3,1227 3,0602 3,0078 2,9633 2,9249 15
16 6,1151 4,6867 4,0768 3,7294 3,5021 3,3406 3,2194 3,1248 3,0488 2,9862 2,9337 2,8891 2,8506 16
17 6,0420 4,6189 4,0112 3,6648 3,4379 3,2767 3,1556 3,0610 2,9849 2,9222 2,8696 2,8249 2,7863 17
18 5,9781 4,5597 3,9539 3,6083 3,3820 3,2209 3,0999 3,0053 2,9291 2,8664 2,8137 2,7689 2,7302 18
19 5,9216 4,5075 3,9034 3,5587 3,3327 3,1718 3,0509 2,9563 2,8801 2,8172 2,7645 2,7196 2,6808 19
20 5,8715 4,4612 3,8587 3,5147 3,2891 3,1283 3,0074 2,9128 2,8365 2,7737 2,7209 2,6758 2,6369 20
21 5,8266 4,4199 3,8188 3,4754 3,2501 3,0895 2,9686 2,8740 2,7977 2,7348 2,6819 2,6368 2,5978 21
22 5,7863 4,3828 3,7829 3,4401 3,2151 3,0546 2,9338 2,8392 2,7628 2,6998 2,6469 2,6017 2,5626 22
23 5,7498 4,3492 3,7505 3,4083 3,1835 3,0232 2,9023 2,8077 2,7313 2,6682 2,6152 2,5699 2,5308 23
24 5,7166 4,3187 3,7211 3,3794 3,1548 2,9946 2,8738 2,7791 2,7027 2,6396 2,5865 2,5411 2,5019 24
25 5,6864 4,2909 3,6943 3,3530 3,1287 2,9685 2,8478 2,7531 2,6766 2,6135 2,5603 2,5149 2,4756 25
26 5,6586 4,2655 3,6697 3,3289 3,1048 2,9447 2,8240 2,7293 2,6528 2,5896 2,5363 2,4909 2,4515 26
27 5,6331 4,2421 3,6472 3,3067 3,0828 2,9228 2,8021 2,7074 2,6309 2,5676 2,5143 2,4688 2,4293 27
28 5,6096 4,2205 3,6264 3,2863 3,0626 2,9027 2,7820 2,6872 2,6106 2,5473 2,4940 2,4484 2,4089 28
29 5,5878 4,2006 3,6072 3,2674 3,0438 2,8840 2,7633 2,6686 2,5919 2,5286 2,4752 2,4295 2,3900 29
30 5,5675 4,1821 3,5893 3,2499 3,0265 2,8667 2,7460 2,6513 2,5746 2,5112 2,4578 2,4120 2,3727 30
40 5,4239 4,0510 3,4633 3,1261 2,9037 2,7444 2,6238 2,5289 2,4519 2,3882 2,3343 2,2882 2,2481 40
50 5,3403 3,9749 3,3902 3,0544 2,8326 2,6736 2,5530 2,4579 2,3808 2,3168 2,2627 2,2162 2,1758 50
100 5,1786 3,8284 3,2496 2,9166 2,6961 2,5374 2,4168 2,3215 2,2439 2,1793 2,1245 2,0773 2,0363 100
Estatı́stica 208

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 025 (continuação)

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,025

2,5%

0 𝐹𝛼 𝐹

D/N 14 15 16 17 18 19 20 25 30 40 50 100 N/D


1 982,5453 984,8736 986,9109 988,7153 990,3451 991,8003 993,0809 998,0868 1001,4046 1005,5955 1008,0985 1013,1625 1
2 39,4266 39,4311 39,4357 39,4393 39,4421 39,4457 39,4475 39,4575 39,4648 9,4662 39,4775 39,4875 2
3 14,2768 14,2527 14,2315 14,2127 14,1961 14,1808 14,1674 14,1154 14,0806 5,1597 14,0099 13,9562 3
4 8,6837 8,6566 8,6326 8,6113 8,5923 8,5753 8,5599 8,5010 8,4613 3,8036 8,3808 8,3195 4
5 6,4556 6,4277 6,4032 6,3814 6,3619 6,3444
TA 6,3285 6,2678 6,2269 3,1573 6,1436 6,0800 5
6 5,2968 5,2686 5,2439 5,2218 5,2021 5,1844 5,1684 5,1069 5,0652 2,7812 4,9804 4,9154 6
7 4,5961 4,5678 4,5428 4,5206 4,5008 4,4829 4,4668 4,4045 4,3624 2,5351 4,2763 4,2101 7
8 4,1297 4,1012 4,0761 4,0538 4,0338 4,0158 3,9994 3,9367 3,8940 2,3614 3,8067 3,7393 8
9 3,7980 3,7693 3,7441 3,7216 3,7015 3,6833 3,6669 3,6035 3,5604 2,2320 3,4719 3,4034 9
U
10 3,5504 3,5217 3,4963 3,4736 3,4534 3,4351 3,4185 3,3546 3,3110 2,1317 3,2214 3,1517 10
11 3,3588 3,3299 3,3044 3,2816 3,2612 3,2428 3,2261 3,1616 3,1176 2,0516 3,0268 2,9560 11
IN

12 3,2062 3,1772 3,1515 3,1286 3,1081 3,0896 3,0728 3,0077 2,9633 1,9861 2,8714 2,7996 12
13 3,0819 3,0527 3,0269 3,0039 2,9832 2,9646 2,9477 2,8821 2,8373 1,9315 2,7443 2,6715 13
14 2,9786 2,9493 2,9234 2,9003 2,8795 2,8607 2,8437 2,7777 2,7324 1,8852 2,6384 2,5646 14
M

15 2,8915 2,8621 2,8360 2,8128 2,7919 2,7730 2,7559 2,6894 2,6437 1,8454 2,5488 2,4739 15
16 2,8170 2,7875 2,7614 2,7380 2,7170 2,6980 2,6808 2,6138 2,5678 1,8108 2,4719 2,3961 16
17 2,7526 2,7230 2,6968 2,6733 2,6522 2,6331 2,6158 2,5484 2,5020 1,7805 2,4053 2,3285 17
18 2,6964 2,6667 2,6403 2,6168 2,5956 2,5764 2,5590 2,4912 2,4445 1,7537 2,3468 2,2692 18
19 2,6469 2,6171 2,5907 2,5670 2,5457 2,5264 2,5089 2,4408 2,3937 1,7298 2,2952 2,2167 19
20 2,6030 2,5731 2,5465 2,5228 2,5014 2,4821 2,4645 2,3959 2,3486 1,7083 2,2493 2,1699 20
21 2,5638 2,5338 2,5071 2,4833 2,4618 2,4424 2,4247 2,3558 2,3082 1,6890 2,2081 2,1280 21
22 2,5285 2,4984 2,4717 2,4478 2,4262 2,4067 2,3890 2,3198 2,2718 1,6714 2,1710 2,0901 22
23 2,4966 2,4665 2,4396 2,4156 2,3940 2,3745 2,3566 2,2871 2,2389 1,6554 2,1374 2,0556 23
24 2,4677 2,4374 2,4105 2,3865 2,3648 2,3452 2,3273 2,2574 2,2090 1,6407 2,1067 2,0243 24
25 2,4413 2,4110 2,3840 2,3599 2,3381 2,3184 2,3005 2,2303 2,1816 1,6272 2,0787 1,9955 25
26 2,4171 2,3867 2,3597 2,3355 2,3137 2,2939 2,2759 2,2054 2,1565 1,6147 2,0530 1,9691 26
27 2,3949 2,3644 2,3373 2,3131 2,2912 2,2713 2,2533 2,1826 2,1334 1,6032 2,0293 1,9447 27
28 2,3743 2,3438 2,3167 2,2924 2,2704 2,2505 2,2324 2,1614 2,1121 1,5925 2,0073 1,9221 28
29 2,3554 2,3248 2,2976 2,2732 2,2512 2,2313 2,2131 2,1419 2,0923 1,5825 1,9870 1,9011 29
30 2,3378 2,3072 2,2799 2,2554 2,2334 2,2134 2,1952 2,1237 2,0739 1,5732 1,9681 1,8816 30
40 2,2130 2,1819 2,1542 2,1293 2,1068 2,0864 2,0677 1,9943 1,9429 1,5056 1,8324 1,7405 40
50 2,1404 2,1090 2,0810 2,0558 2,0330 2,0122 1,9933 1,9186 1,8659 1,4648 1,7520 1,6558 50
100 2,0001 1,9679 1,9391 1,9132 1,8897 1,8682 1,8486 1,7705 1,7148 1,3817 1,5917 1,4833 100
Estatı́stica 209

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 05

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,05

5%

0 𝐹𝛼 𝐹

D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 161,4462 199,4995 215,7067 224,5833 230,1604 233,9875 236,7669 238,8842 240,5432 241,8819 242,9806 243,9047 244,6905 1
2 18,5128 19,0000 19,1642 19,2467 19,2963 19,3295 19,3531 19,3709 19,3847 19,3959 19,4050 19,4125 19,4188 2
3 10,1280 9,5521 9,2766 9,1172 9,0134 8,9407 8,8867 8,8452 8,8123 8,7855 8,7633 8,7447 8,7286 3
4 7,7086 6,9443 6,5914 6,3882 6,2561 6,1631 6,0942 6,0410 5,9988 5,9644 5,9358 5,9117 5,8911 4
5 6,6079 5,7861 5,4094 5,1922 5,0503 4,9503TA 4,8759 4,8183 4,7725 4,7351 4,7040 4,6777 4,6552 5
6 5,9874 5,1432 4,7571 4,5337 4,3874 4,2839 4,2067 4,1468 4,0990 4,0600 4,0274 3,9999 3,9764 6
7 5,5915 4,7374 4,3468 4,1203 3,9715 3,8660 3,7871 3,7257 3,6767 3,6365 3,6030 3,5747 3,5503 7
8 5,3176 4,4590 4,0662 3,8379 3,6875 3,5806 3,5005 3,4381 3,3881 3,3472 3,3129 3,2839 3,2590 8
9 5,1174 4,2565 3,8625 3,6331 3,4817 3,3738 3,2927 3,2296 3,1789 3,1373 3,1025 3,0729 3,0475 9
U
10 4,9646 4,1028 3,7083 3,4780 3,3258 3,2172 3,1355 3,0717 3,0204 2,9782 2,9430 2,9130 2,8872 10
11 4,8443 3,9823 3,5874 3,3567 3,2039 3,0946 3,0123 2,9480 2,8962 2,8536 2,8179 2,7876 2,7614 11
IN

12 4,7472 3,8853 3,4903 3,2592 3,1059 2,9961 2,9134 2,8486 2,7964 2,7534 2,7173 2,6866 2,6602 12
13 4,6672 3,8056 3,4105 3,1791 3,0254 2,9153 2,8321 2,7669 2,7144 2,6710 2,6346 2,6037 2,5769 13
14 4,6001 3,7389 3,3439 3,1122 2,9582 2,8477 2,7642 2,6987 2,6458 2,6022 2,5655 2,5342 2,5073 14
M

15 4,5431 3,6823 3,2874 3,0556 2,9013 2,7905 2,7066 2,6408 2,5876 2,5437 2,5068 2,4753 2,4481 15
16 4,4940 3,6337 3,2389 3,0069 2,8524 2,7413 2,6572 2,5911 2,5377 2,4935 2,4564 2,4247 2,3973 16
17 4,4513 3,5915 3,1968 2,9647 2,8100 2,6987 2,6143 2,5480 2,4943 2,4499 2,4126 2,3807 2,3531 17
18 4,4139 3,5546 3,1599 2,9277 2,7729 2,6613 2,5767 2,5102 2,4563 2,4117 2,3742 2,3421 2,3143 18
19 4,3808 3,5219 3,1274 2,8951 2,7401 2,6283 2,5435 2,4768 2,4227 2,3779 2,3402 2,3080 2,2800 19
20 4,3513 3,4928 3,0984 2,8661 2,7109 2,5990 2,5140 2,4471 2,3928 2,3479 2,3100 2,2776 2,2495 20
21 4,3248 3,4668 3,0725 2,8401 2,6848 2,5727 2,4876 2,4205 2,3661 2,3210 2,2829 2,2504 2,2222 21
22 4,3009 3,4434 3,0491 2,8167 2,6613 2,5491 2,4638 2,3965 2,3419 2,2967 2,2585 2,2258 2,1975 22
23 4,2793 3,4221 3,0280 2,7955 2,6400 2,5277 2,4422 2,3748 2,3201 2,2747 2,2364 2,2036 2,1752 23
24 4,2597 3,4028 3,0088 2,7763 2,6207 2,5082 2,4226 2,3551 2,3002 2,2547 2,2163 2,1834 2,1548 24
25 4,2417 3,3852 2,9912 2,7587 2,6030 2,4904 2,4047 2,3371 2,2821 2,2365 2,1979 2,1649 2,1362 25
26 4,2252 3,3690 2,9752 2,7426 2,5868 2,4741 2,3883 2,3205 2,2655 2,2197 2,1811 2,1479 2,1192 26
27 4,2100 3,3541 2,9603 2,7278 2,5719 2,4591 2,3732 2,3053 2,2501 2,2043 2,1655 2,1323 2,1034 27
28 4,1960 3,3404 2,9467 2,7141 2,5581 2,4453 2,3593 2,2913 2,2360 2,1900 2,1512 2,1179 2,0889 28
29 4,1830 3,3277 2,9340 2,7014 2,5454 2,4324 2,3463 2,2782 2,2229 2,1768 2,1379 2,1045 2,0755 29
30 4,1709 3,3158 2,9223 2,6896 2,5336 2,4205 2,3343 2,2662 2,2107 2,1646 2,1256 2,0921 2,0630 30
40 4,0847 3,2317 2,8387 2,6060 2,4495 2,3359 2,2490 2,1802 2,1240 2,0773 2,0376 2,0035 1,9738 40
50 4,0343 3,1826 2,7900 2,5572 2,4004 2,2864 2,1992 2,1299 2,0733 2,0261 1,9861 1,9515 1,9214 50
100 3,9362 3,0873 2,6955 2,4626 2,3053 2,1906 2,1025 2,0323 1,9748 1,9267 1,8857 1,8503 1,8193 100
Estatı́stica 210

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 05 (continuação)

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,05

5%

0 𝐹𝛼 𝐹

D/N 14 15 16 17 18 19 20 25 30 40 50 100 N/D


1 245,3635 245,9492 246,4658 246,9169 247,3244 247,6881 248,0156 249,2598 250,0965 251,1442 251,7736 253,0433 1
2 19,4243 19,4291 19,4332 19,4370 19,4402 19,4432 19,4457 19,4557 19,4625 19,4707 19,4757 19,4857 2
3 8,7149 8,7028 8,6923 8,6829 8,6745 8,6670 8,6602 8,6341 8,6166 8,5944 8,5810 8,5539 3
4 5,8733 5,8578 5,8441 5,8320 5,8211 5,8114 5,8025 5,7687 5,7459 5,7170 5,6995 5,6640 4
5 4,6358 4,6188 4,6038 4,5904 4,5785 4,5678
TA 4,5581 4,5209 4,4957 4,4638 4,4444 4,4051 5
6 3,9559 3,9381 3,9223 3,9083 3,8957 3,8844 3,8742 3,8348 3,8082 3,7743 3,7537 3,7117 6
7 3,5292 3,5107 3,4944 3,4799 3,4669 3,4551 3,4445 3,4036 3,3758 3,3404 3,3189 3,2749 7
8 3,2374 3,2184 3,2016 3,1867 3,1733 3,1612 3,1503 3,1081 3,0794 3,0428 3,0204 2,9747 8
9 3,0255 3,0061 2,9890 2,9737 2,9600 2,9477 2,9365 2,8932 2,8637 2,8259 2,8028 2,7556 9
U
10 2,8647 2,8450 2,8276 2,8120 2,7980 2,7854 2,7740 2,7298 2,6996 2,6609 2,6371 2,5884 10
11 2,7386 2,7186 2,7009 2,6851 2,6709 2,6581 2,6464 2,6014 2,5705 2,5309 2,5066 2,4566 11
IN

12 2,6371 2,6169 2,5989 2,5828 2,5684 2,5554 2,5436 2,4977 2,4663 2,4259 2,4010 2,3498 12
13 2,5536 2,5331 2,5149 2,4987 2,4841 2,4709 2,4589 2,4123 2,3803 2,3392 2,3138 2,2614 13
14 2,4837 2,4630 2,4446 2,4282 2,4134 2,4000 2,3879 2,3407 2,3082 2,2663 2,2405 2,1870 14
M

15 2,4244 2,4034 2,3849 2,3683 2,3533 2,3398 2,3275 2,2797 2,2468 2,2043 2,1780 2,1234 15
16 2,3733 2,3522 2,3335 2,3167 2,3016 2,2880 2,2756 2,2272 2,1938 2,1507 2,1240 2,0685 16
17 2,3290 2,3077 2,2888 2,2719 2,2567 2,2429 2,2304 2,1815 2,1477 2,1040 2,0769 2,0204 17
18 2,2900 2,2686 2,2496 2,2325 2,2172 2,2033 2,1906 2,1413 2,1071 2,0629 2,0354 1,9780 18
19 2,2556 2,2341 2,2149 2,1977 2,1823 2,1682 2,1555 2,1057 2,0712 2,0264 1,9986 1,9403 19
20 2,2250 2,2033 2,1840 2,1667 2,1511 2,1370 2,1242 2,0739 2,0391 1,9938 1,9656 1,9066 20
21 2,1975 2,1757 2,1563 2,1389 2,1232 2,1090 2,0960 2,0454 2,0102 1,9645 1,9360 1,8761 21
22 2,1727 2,1508 2,1313 2,1138 2,0980 2,0837 2,0707 2,0196 1,9842 1,9380 1,9092 1,8486 22
23 2,1502 2,1282 2,1086 2,0910 2,0751 2,0608 2,0476 1,9963 1,9605 1,9139 1,8848 1,8234 23
24 2,1298 2,1077 2,0880 2,0703 2,0543 2,0399 2,0267 1,9750 1,9390 1,8920 1,8625 1,8005 24
25 2,1111 2,0889 2,0691 2,0513 2,0353 2,0207 2,0075 1,9554 1,9192 1,8718 1,8421 1,7794 25
26 2,0939 2,0716 2,0518 2,0339 2,0178 2,0032 1,9898 1,9375 1,9010 1,8533 1,8233 1,7599 26
27 2,0781 2,0558 2,0358 2,0179 2,0017 1,9870 1,9736 1,9210 1,8842 1,8361 1,8059 1,7419 27
28 2,0635 2,0411 2,0210 2,0030 1,9868 1,9720 1,9586 1,9057 1,8687 1,8203 1,7898 1,7251 28
29 2,0500 2,0275 2,0073 1,9893 1,9730 1,9581 1,9446 1,8915 1,8543 1,8055 1,7748 1,7096 29
39 2,0374 2,0148 1,9946 1,9765 1,9601 1,9452 1,9317 1,8782 1,8409 1,7918 1,7609 1,6950 30
40 1,9476 1,9245 1,9038 1,8851 1,8682 1,8529 1,8389 1,7835 1,7444 1,6928 1,6600 1,5892 40
50 1,8949 1,8714 1,8503 1,8313 1,8141 1,7985 1,7841 1,7273 1,6872 1,6337 1,5995 1,5249 50
100 1,7919 1,7675 1,7456 1,7259 1,7079 1,6915 1,6764 1,6163 1,5733 1,5151 1,4772 1,3917 100
Estatı́stica 211

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 1

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,1

1%

0 𝐹𝛼 𝐹

D/N 1 2 3 4 5 6 7 8 9 10 11 12 13 N/D
1 39,8636 49,5002 53,5933 55,8330 57,2400 58,2045 58,9062 59,4391 59,8575 60,1949 60,4728 60,7051 60,9025 1
2 8,5263 9,0000 9,1618 9,2434 9,2926 9,3255 9,3491 9,3668 9,3805 9,3916 9,4006 9,4082 9,4145 2
3 5,5383 5,4624 5,3908 5,3427 5,3091 5,2847 5,2662 5,2517 5,2400 5,2304 5,2224 5,2156 5,2098 3
4 4,5448 4,3246 4,1909 4,1072 4,0506 4,0097 3,9790 3,9549 3,9357 3,9199 3,9067 3,8955 3,8859 4
5 4,0604 3,7797 3,6195 3,5202 3,4530 3,4045TA 3,3679 3,3393 3,3163 3,2974 3,2816 3,2682 3,2567 5
6 3,7760 3,4633 3,2888 3,1808 3,1075 3,0546 3,0145 2,9830 2,9577 2,9369 2,9195 2,9047 2,8920 6
7 3,5894 3,2574 3,0741 2,9605 2,8833 2,8274 2,7849 2,7516 2,7247 2,7025 2,6839 2,6681 2,6545 7
8 3,4579 3,1131 2,9238 2,8064 2,7264 2,6683 2,6241 2,5893 2,5612 2,5380 2,5186 2,5020 2,4876 8
9 3,3603 3,0064 2,8129 2,6927 2,6106 2,5509 2,5053 2,4694 2,4403 2,4163 2,3961 2,3789 2,3640 9
U
10 3,2850 2,9245 2,7277 2,6053 2,5216 2,4606 2,4140 2,3771 2,3473 2,3226 2,3018 2,2841 2,2687 10
11 3,2252 2,8595 2,6602 2,5362 2,4512 2,3891 2,3416 2,3040 2,2735 2,2482 2,2269 2,2087 2,1930 11
IN

12 3,1766 2,8068 2,6055 2,4801 2,3940 2,3310 2,2828 2,2446 2,2135 2,1878 2,1660 2,1474 2,1313 12
13 3,1362 2,7632 2,5603 2,4337 2,3467 2,2830 2,2341 2,1953 2,1638 2,1376 2,1155 2,0966 2,0802 13
14 3,1022 2,7265 2,5222 2,3947 2,3069 2,2426 2,1931 2,1539 2,1220 2,0954 2,0730 2,0537 2,0370 14
M

15 3,0732 2,6952 2,4898 2,3614 12,2730 2,2081 2,1582 2,1185 2,0862 2,0593 2,0366 2,0171 2,0001 15
16 3,0481 2,6682 2,4618 2,3327 2,2438 2,1783 2,1280 2,0880 2,0553 2,0281 2,0051 1,9854 1,9682 16
17 3,0262 2,6446 2,4374 2,3077 2,2183 2,1524 2,1017 2,0613 2,0284 2,0009 1,9777 1,9577 1,9404 17
18 3,0070 2,6239 2,4160 2,2858 2,1958 2,1296 2,0785 2,0379 2,0047 1,9770 1,9535 1,9333 1,9158 18
19 2,9899 2,6056 2,3970 2,2663 2,1760 2,1094 2,0580 2,0171 1,9836 1,9557 1,9321 1,9117 1,8940 19
20 2,9747 2,5893 2,3801 2,2489 2,1582 2,0913 2,0397 1,9985 1,9649 1,9367 1,9129 1,8924 1,8745 20
21 2,9610 2,5746 2,3649 2,2333 2,1423 2,0751 2,0233 1,9819 1,9480 1,9197 1,8956 1,8750 1,8570 21
22 2,9486 2,5613 2,3512 2,2193 2,1279 2,0605 2,0084 1,9668 1,9327 1,9043 1,8801 1,8593 1,8411 22
23 2,9374 2,5493 2,3387 2,2065 2,1149 2,0472 1,9949 1,9531 1,9189 1,8903 1,8659 1,8450 1,8267 23
24 2,9271 2,5383 2,3274 2,1949 2,1030 2,0351 1,9826 1,9407 1,9063 1,8775 1,8530 1,8319 1,8136 24
25 2,9177 2,5283 2,3170 2,1842 2,0922 2,0241 1,9714 1,9292 1,8947 1,8658 1,8412 1,8200 1,8015 25
26 2,9091 2,5191 2,3075 2,1745 2,0822 2,0139 1,9610 1,9188 1,8841 1,8550 1,8303 1,8090 1,7904 26
27 2,9012 2,5106 2,2987 2,1655 2,0730 2,0045 1,9515 1,9091 1,8743 1,8451 1,8203 1,7989 1,7802 27
28 2,8938 2,5028 2,2906 2,1571 2,0645 1,9959 1,9427 1,9001 1,8652 1,8359 1,8110 1,7895 1,7706 28
29 2,8870 2,4955 2,2831 2,1494 2,0566 1,9878 1,9345 1,8918 1,8568 1,8274 1,8024 1,7808 1,7620 29
30 2,8807 2,4887 2,2761 2,1422 2,0492 1,9803 1,9269 1,8840 1,8490 1,8195 1,7944 1,7727 1,7538 30
40 2,8353 2,4404 2,2261 2,0909 1,9968 1,9269 1,8725 1,8280 1,7929 1,7627 1,7369 1,7146 1,6950 40
50 2,8087 2,4120 2,1967 2,0608 1,9660 1,8954 1,8405 1,7963 1,7598 1,7291 1,7029 1,6802 1,6602 50
100 2,7564 2,3564 2,1394 2,0019 1,9057 1,8339 1,7778 1,7324 1,6949 1,9267 1,6360 1,6124 1,5916 100
Estatı́stica 212

Tabela da Distribuição F de Fischer-Snedecor: P (F > Fα ) = 0, 1 (continuação)

𝑃ሺ𝐹 > 𝐹𝛼 ሻ = 0,1

1%

0 𝐹𝛼 𝐹

D/N 14 15 16 17 18 19 20 25 30 40 50 100 N/D


1 61,0726 61,2204 61,3500 61,4646 61,5664 61,6578 61,7401 62,0548 62,2649 62,5291 62,6878 63,0071 1
2 9,4200 9,4247 9,4288 9,4325 9,4358 9,4387 9,4413 9,4513 9,4579 9,4662 9,4713 9,4813 2
3 5,2047 5,2003 5,1964 5,1929 5,1898 5,1870 5,1845 5,1747 5,1681 5,1597 5,1546 5,1443 3
4 3,8776 3,8704 3,8639 3,8582 3,8531 3,8485 3,8443 3,8283 3,8174 3,8036 3,7952 3,7782 4
5 3,2468 3,2380 3,2303 3,2234 3,2172 3,2117
TA 3,2067 3,1873 3,1741 3,1573 3,1471 3,1263 5
6 2,8809 2,8712 2,8626 2,8550 2,8481 2,8419 2,8363 2,8147 2,8000 2,7812 2,7697 2,7463 6
7 2,6426 2,6322 2,6230 2,6148 2,6074 2,6008 2,5947 2,5714 2,5555 2,5351 2,5226 2,4971 7
8 2,4752 2,4642 2,4545 2,4458 2,4380 2,4310 2,4246 2,3999 2,3830 2,3614 2,3481 2,3208 8
9 2,3510 2,3396 2,3295 2,3205 2,3123 2,3050 2,2983 2,2725 2,2547 2,2320 2,2180 2,1892 9
U
10 2,2553 2,2435 2,2330 2,2237 2,2153 2,2077 2,2007 2,1739 2,1554 2,1317 2,1171 2,0869 10
11 2,1792 2,1671 2,1563 2,1467 2,1380 2,1302 2,1230 2,0953 2,0762 2,0516 2,0364 2,0050 11
IN

12 2,1173 2,1049 2,0938 2,0839 2,0750 2,0670 2,0597 2,0312 2,0115 1,9861 1,9704 1,9379 12
13 2,0658 2,0532 2,0419 2,0318 2,0227 2,0145 2,0070 1,9778 1,9576 1,9315 1,9153 1,8817 13
14 2,0224 2,0095 1,9981 1,9878 1,9785 1,9701 1,9625 1,9326 1,9119 1,8852 1,8686 1,8340 14
M

15 1,9853 1,9722 1,9605 1,9501 1,9407 1,9321 1,9243 1,8939 1,8728 1,8454 1,8284 1,7929 15
16 1,9532 1,9399 1,9281 1,9175 1,9079 1,8992 1,8913 1,8603 1,8388 1,8108 1,7934 1,7570 16
17 1,9252 1,9117 1,8997 1,8889 1,8792 1,8704 1,8624 1,8309 1,8090 1,7805 1,7628 1,7255 17
18 1,9004 1,8868 1,8747 1,8638 1,8539 1,8450 1,8368 1,8049 1,7827 1,7537 1,7356 1,6976 18
19 1,8785 1,8647 1,8524 1,8414 1,8314 1,8224 1,8142 1,7818 1,7592 1,7298 1,7114 1,6726 19
20 1,8588 1,8449 1,8325 1,8214 1,8113 1,8022 1,7938 1,7611 1,7382 1,7083 1,6896 1,6501 20
21 1,8412 1,8271 1,8146 1,8034 1,7932 1,7840 1,7756 1,7424 1,7193 1,6890 1,6700 1,6298 21
22 1,8252 1,8111 1,7984 1,7871 1,7768 1,7675 1,7590 1,7255 1,7021 1,6714 1,6521 1,6113 22
23 1,8107 1,7964 1,7837 1,7723 1,7619 1,7525 1,7439 1,7101 1,6864 1,6554 1,6358 1,5944 23
24 1,7974 1,7831 1,7703 1,7587 1,7483 1,7388 1,7302 1,6960 1,6721 1,6407 1,6209 1,5788 24
25 1,7853 1,7708 1,7579 1,7463 1,7358 1,7263 1,7175 1,6831 1,6589 1,6272 1,6072 1,5645 25
26 1,7741 1,7596 1,7466 1,7349 1,7243 1,7147 1,7059 1,6712 1,6468 1,6147 1,5945 1,5513 26
27 1,7638 1,7492 1,7361 1,7243 1,7137 1,7040 1,6951 1,6602 1,6356 1,6032 1,5827 1,5390 27
28 1,7542 1,7395 1,7264 1,7146 1,7039 1,6941 1,6852 1,6500 1,6252 1,5925 1,5718 1,5276 28
29 1,7454 1,7306 1,7174 1,7055 1,6947 1,6849 1,6759 1,6405 1,6155 1,5825 1,5617 1,5169 29
30 1,7371 1,7223 1,7090 1,6970 1,6862 1,6763 1,6673 1,6316 1,6065 1,5732 1,5522 1,5069 30
40 1,6778 1,6624 1,6486 1,6362 1,6249 1,6146 1,6052 1,5677 1,5411 1,5056 1,4830 1,4336 40
50 1,6426 1,6269 1,6128 1,6000 1,5884 1,5778 1,5681 1,5294 1,5018 1,4648 1,4409 1,3885 50
100 1,5731 1,5566 1,5418 1,5283 1,5160 1,5047 1,4943 1,4528 1,4227 1,3817 1,3548 1,2934 100
Estatı́stica 213

Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 1% de probabilidade.
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos

GL\I 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19
1 90,03 135,0 164,3 185,6 202,2 215,8 227,2 237,0 245,6 253,2 260,0 266,2 271,8 277,0 281,8 286,3 290,4 294,3
2 14,04 19,02 22,29 24,72 26,63 28,20 29,53 30,68 31,69 32,59 33,40 34,13 34,81 35,43 36,00 36,53 37,03 37,50
3 8,26 10,62 12,17 13,33 14,24 15,00 15,64 16,20 16,69 17,13 17,53 17,89 18,22 18,52 18,81 19,07 19,32 19,55
4 6,51 8,12 9,17 9,96 10,58 11,10 11,55 11,93 12,27 12,57 12,84 13,09 13,32 13,53 13,73 13,91 14,08 14,24
5 5,70 6,98 7,80 8,42 8,91 9,32 9,70 9,97 10,24 10,48 10,70 10,89 11,08 11,24 11,40 11,55 11,68 11,81
6 5,24 6,33 7,03 7,56 7,97 8,32 8,61 8,87 9,10 9,30 9,48 9,65 9,81 9,95 10,08 10,21 10,32 10,43
7 4,95 5,92 6,54 7,00 7,37 7,68 7,94 8,17 8,37 8,55 8,71 8,86 9,00 9,12 9,24 9,35 9,46 9,55
8 4,75 5,64 6,20 6,62 6,96 7,24 7,47 7,68 7,86 8,03 8,18 8,31 8,44 8,55 8,66 8,76 8,85 8,94
9 4,60 5,43 5,96 6,35 6,66 6,92 7,13 7,32 7,50 7,65 7,78 7,91 8,02 8,13 8,23 8,32 8,41 8,50
10 4,48 5,27 5,77 6,14 6,43 6,67 6,88 7,06 7,21 7,36 7,48 7,60 7,71 7,81 7,91 7,99 8,08 8,15
11 4,39 5,15 5,62 5,97 6,25 6,48 6,67 6,84 6,99 7,13 7,25 7,36 7,46 7,56 7,65 7,73 7,81 7,88
12 4,32 5,05 5,50 5,84 6,10 6,32 6,51 6,67 6,81 6,94 7,06 7,17 7,26 7,36 7,44 7,52 7,59 7,66
13 4,26 4,96 5,40 5,73 5,98 6,19 6,37 6,53 6,67 6,79 6,90 7,01 7,10 7,19 7,27 7,34 7,42 7,48
14 4,21 4,90 5,32 5,63 5,88 6,08 6,26 6,41
TA 6,54 6,66 6,77 6,87 6,96 7,05 7,13 7,20 7,27 7,33
15 4,17 4,84 5,25 5,56 5,80 5,99 6,16 6,31 6,44 6,56 6,66 6,76 6,84 6,93 7,00 7,07 7,14 7,20
16 4,13 4,79 5,19 5,49 5,72 5,92 6,08 6,22 6,35 6,46 6,56 6,66 6,74 6,82 6,90 6,97 7,03 7,09
17 4,10 4,74 5,14 5,43 5,66 5,85 6,01 6,15 6,27 6,38 6,48 6,57 6,66 6,73 6,81 6,87 6,94 7,00
18 4,07 4,70 5,09 5,38 5,60 5,79 5,94 6,08 6,20 6,31 6,41 6,50 6,58 6,66 6,72 6,79 6,85 6,91
U
19 4,05 4,67 5,05 5,33 5,55 5,74 5,89 6,02 6,14 6,25 6,34 6,43 6,51 6,58 6,65 6,72 6,78 6,84
20 4,02 4,64 5,02 5,29 5,51 5,69 5,84 5,97 6,09 6,19 6,28 6,37 6,45 6,52 6,59 6,65 6,71 6,77
IN

24 3,96 4,55 4,91 5,17 5,37 5,54 5,68 5,81 5,92 6,02 6,11 6,19 6,26 6,33 6,39 6,45 6,51 6,56
30 3,89 4,46 4,80 5,05 5,24 5,40 5,54 5,65 5,76 5,85 5,93 6,01 6,08 6,14 6,20 6,26 6,31 6,36
40 3,82 4,37 4,70 4,93 5,11 5,26 5,39 5,50 5,60 5,69 5,76 5,84 5,90 5,96 6,02 6,07 6,12 6,16
60 3,76 4,28 4,60 4,82 4,99 5,13 5,25 5,36 5,45 5,53 5,60 5,67 5,73 5,78 5,84 5,89 5,93 5,97
M

120 3,70 4,20 4,50 4,71 4,87 5,00 5,12 5,21 5,30 5,38 5,44 5,50 5,56 5,61 5,66 5,71 5,75 5,79
Inf 3,64 4,12 4,40 4,60 4,76 4,88 4,99 5,08 5,16 5,23 5,29 5,35 5,40 5,45 5,49 5,54 5,57 5,61
Estatı́stica 214

Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 1% de probabilidade (continuação).
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos

GL\I 20 22 24 26 28 30 32 34 36 38 40 50 60 70 80 90 100
1 298,0 304,7 310,8 316,3 321,3 326,0 330,3 334,3 338,0 341,5 344,8 358,9 370,1 379,4 387,3 394,1 400,1
2 37,95 38,76 39,49 40,15 40,76 41,32 41,84 42,33 42,78 43,21 43,61 45,33 46,70 47,83 48,80 49,64 50,38
3 19,77 20,17 20,53 20,86 21,16 21,44 21,70 21,95 22,17 22,39 22,59 23,45 24,13 24,71 25,19 25,62 25,99
4 14,40 14,68 14,93 15,16 15,37 15,57 15,75 15,92 16,08 16,23 16,37 16,98 17,46 17,86 18,20 18,50 18,77
5 11,93 12,16 12,36 12,54 12,71 12,87 13,02 13,15 13,28 13,40 13,52 14,00 14,39 14,72 14,99 15,23 15,45
6 10,54 10,73 10,91 11,06 11,21 11,34 11,47 11,58 11,69 11,80 11,90 12,31 12,65 12,92 13,16 13,37 13,55
7 9,65 9,82 9,97 10,11 10,24 10,36 10,47 10,58 10,67 10,77 10,85 11,23 11,52 11,77 11,99 12,17 12,34
8 9,03 9,18 9,32 9,45 9,57 9,68 9,78 9,87 9,96 10,05 10,13 10,47 10,75 10,97 11,17 11,34 11,49
9 8,58 8,72 8,85 8,97 9,08 9,18 9,27 9,36 9,44 9,52 9,59 9,91 10,17 10,38 10,57 10,73 10,87
10 8,23 8,36 8,48 8,60 8,70 8,79 8,88 8,97 9,04 9,12 9,19 9,49 9,73 9,93 10,10 10,25 10,39
11 7,95 8,08 8,20 8,30 8,40 8,49 8, 58 8,65 8,73 8,80 8,86 9,15 9,38 9,57 9,73 9,88 10,00
12 7,73 7,85 7,96 8,07 8,16 8,25 8,33 8,40 8,47 8,54 8,60 8,88 9,09 9,28 9,43 9,57 9,69
13 7,55 7,66 7,77 7,87 7,96 8,04 8,12 8,19 8,26 8,33 8,39 8,65 8,86 9,04 9,19 9,32 9,44
14 7,40 7,51 7,61 7,70 7,79 7,87 7,95 8,02
TA 8,08 8,15 8,20 8,46 8,66 8,83 8,98 9,11 9,22
15 7,26 7,37 7,47 7,57 7,65 7,73 7,80 7,87 7,93 7,99 8,05 8,30 8,49 8,66 8,80 8,92 9,04
16 7,15 7,26 7,36 7,44 7,53 7,60 7,67 7,74 7,80 7,86 7,92 8,15 8,35 8,51 8,65 8,77 8,87
17 7,05 7,16 7,25 7,34 7,42 7,49 7,56 7,63 7,69 7,74 7,80 8,03 8,22 8,38 8,51 8,63 8,74
18 6,97 7,07 7,16 7,25 7,32 7,40 7,46 7,53 7,59 7,64 7,70 7,92 8,11 8,26 8,39 8,51 8,61
U
19 6,89 6,99 7,08 7,17 7,24 7,31 7,38 7,44 7,50 7,55 7,60 7,83 8,01 8,16 8,29 8,40 8,50
20 6,82 6,92 7,01 7,09 7,17 7,24 7,30 7,36 7,42 7,47 7,52 7,74 7,92 8,07 8,19 8,30 8,40
IN

24 6,61 6,70 6,79 6,86 6,94 7,00 7,06 7,12 7,17 7,22 7,27 7,48 7,64 7,78 7,90 8,00 8,10
30 6,41 6,49 6,57 6,64 6,71 6,77 6,83 6,88 6,93 6,98 7,02 7,22 7,37 7,50 7,61 7,71 7,80
40 6,21 6,29 6,36 6,43 6,49 6,55 6,60 6,65 6,70 6,74 6,78 6,96 7,10 7,22 7,33 7,42 7,50
60 6,02 6,09 6,16 6,22 6,28 6,33 6,38 6,42 6,47 6,51 6,55 6,71 6,84 6,95 7,05 7,13 7,21
M

120 5,83 5,90 5,96 6,02 6,07 6,12 6,16 6,20 6,24 6,28 6,32 6,47 6,59 6,69 6,78 6,85 6,92
Inf 5,64 5,71 5,77 5,82 5,87 5,91 5,95 5,99 6,03 6,06 6,09 6,23 6,34 6,43 6,51 6,58 6,64
Estatı́stica 215

Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 5% de probabilidade.
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos

GL\I 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20
1 17,97 26,98 32,82 37,08 40,41 43,12 45,40 47,36 49,07 50,59 51,96 53,20 54,33 55,36 56,32 57,22 58,04 58,83 59,56
2 6,09 8,33 9,80 10,88 11,74 12,44 13,03 13,54 13,99 14,39 14,75 15,08 15,38 16,65 15,91 16,14 16,37 16,57 16,77
3 4,50 5,91 6,83 7,50 8,04 8,48 8,85 9,18 9,46 9,72 9,95 10,15 10,35 10,53 10,69 10,84 10,98 11,11 11,24
4 3,93 5,04 5,76 6,29 6,71 7,05 7,35 7,60 7,83 8,03 8,21 8,37 8,53 8,66 8,79 8,91 9,03 9,13 9,23
5 3,64 4,60 5,22 5,67 6,03 6,33 6,58 6,80 7,00 7,17 7,32 7,47 7,60 7,72 7,83 7,93 8,03 8,12 8,21
6 3,46 4,34 4,90 5,31 5,63 5,90 6,12 6,32 6,49 6,65 6,79 6,92 7,03 7,14 7,24 7,34 7,43 7,51 7,59
7 3,34 4,17 4,68 5,06 5,36 5,61 5,82 6,00 6,16 6,30 6,43 6,55 6,66 6,76 6,85 6,94 7,02 7,10 7,17
8 3,26 4,04 4,53 4,89 5,17 5,40 5,60 5,77 5,92 6,05 6,18 6,29 6,39 6,48 6,57 6,65 6,73 6,80 6,87
9 3,20 3,95 4,42 4,76 5,02 5,24 5,43 5,60 5,74 5,87 5,98 6,09 6,19 6,28 6,36 6,44 6,51 6,58 6,64
10 3,15 3,88 4,33 4,65 4,91 5,12 5,31 5,46 5,60 5,72 5,83 5,94 6,03 6,11 6,19 6,27 6,34 6,41 6,47
11 3,11 3,82 4,26 4,57 4,82 5,03 5,20 5,35 5,49 5,61 5,71 5,81 5,90 5,98 6,06 6,13 6,20 6,27 6,33
12 3,08 3,77 4,20 4,51 4,75 4,95 5,12 5,27 5,40 5,51 5,62 5,71 5,80 5,88 5,95 6,02 6,09 6,15 6,21
13 3,06 3,74 4,15 4,45 4,69 4,89 5,05 5,19 5,32 5,43 5,53 5,63 5,71 5,79 5,86 5,93 6,00 6,06 6,11
14 3,03 3,70 4,11 4,41 4,64 4,83 4,99 5,13 5,25
TA 5,36 5,46 5,55 5,64 5,71 5,79 5,85 5,92 5,97 6,03
15 3,01 3,67 4,08 4,37 4,60 4,78 4,94 5,08 5,20 5,31 5,40 5,49 5,57 5,65 5,72 5,79 5,85 5,90 5,96
16 3,00 3,65 4,05 4,33 4,56 4,74 4,90 5,03 5,15 5,26 5,35 5,44 5,52 5,59 5,66 5,73 5,79 5,84 5,90
17 2,98 3,63 4,02 4,30 4,52 4,71 4,86 4,99 5,11 5,21 5,31 5,39 5,47 5,54 5,61 5,68 5,73 5,79 5,84
18 2,97 3,61 4,00 4,28 4,50 4,67 4,82 4,96 5,07 5,17 5,27 5,35 5,43 5,50 5,57 5,63 5,69 5,74 5,79
U
19 2,96 3,59 3,98 4,25 4,47 4,65 4,79 4,92 5,04 5,14 5,23 5,32 5,39 5,46 5,53 5,59 5,65 5,70 5,75
20 2,95 3,58 3,96 4,23 4,45 4,62 4,77 4,90 5,01 5,11 5,20 5,28 5,36 5,43 5,49 5,55 5,61 5,66 5,71
IN

24 2,92 3,53 3,90 4,17 4,37 4,54 4,68 4,81 4,92 5,01 5,10 5,18 5,25 5,32 5,38 5,44 5,49 5,55 5,59
30 2,89 3,49 3,85 4,10 4,30 4,46 4,60 4,72 4,82 4,92 5,00 5,08 5,15 5,21 5,27 5,33 5,38 5,43 5,48
40 2,86 3,44 3,79 4,04 4,23 4,39 4,52 4,64 4,74 4,82 4,90 4,98 5,04 5,11 5,16 5,22 5,27 5,31 5,36
60 2,83 3,40 3,74 3,98 4,16 4,31 4,44 4,55 4,65 4,73 4,81 4,88 4,94 5,00 5,06 5,11 5,15 5,20 5,24
M

120 2,80 3,36 3,69 3,92 4,10 4,24 4,36 4,47 4,56 4,64 4,71 4,78 4,84 4,90 4,95 5,00 5,04 5,09 5,13
Inf 2,77 3,31 3,63 3,86 4,03 4,17 4,29 4,39 4,47 4,55 4,62 4,69 4,74 4,80 4,85 4,89 4,93 4,97 5,01
Estatı́stica 216

Tabela com valores da amplitude total estudentizada (q), para uso no teste de Tukey, ao nı́vel
de 5% de probabilidade (continuação).
Nota: I: Número de tratamentos (incluı́do o controle) e GL: Graus de liberdade dos resı́duos

GL\I 22 24 26 28 30 32 34 36 38 40 50 60 70 80 90 100
1 60,91 62,12 63,22 64,23 65,15 66,01 66,81 67,56 68,26 68,92 71,73 73,97 75,82 77,40 78,77 79,98
2 17,13 17,45 17,75 18,02 18,27 18,50 18,72 18,92 19,11 19,28 20,05 20,66 21,16 21,59 21,96 22,29
3 11,47 11,68 11,87 12,05 12,21 12,36 12,50 12,63 12,75 12,87 13,36 13,76 14,08 14,36 14,61 14,82
4 9,42 9,58 9,74 9,88 10,00 10,12 10,23 10,34 10,44 10,53 10,93 11,24 11,51 11,73 11,92 12,09
5 8,37 8,51 8,64 8,76 8,88 8,98 9,08 9,17 9,25 9,33 9,67 9,95 10,18 10,38 10,54 10,69
6 7,73 7,86 7,98 8,09 8,19 8,28 8,37 8,45 8,53 8,60 8,91 9,16 9,37 9,55 9,70 9,84
7 7,30 7,42 7,53 7,63 7,73 7,81 7,90 7,97 8,04 8,11 8,40 8,63 8,82 8,99 9,13 9,26
8 7,00 7,11 7,21 7,31 7,40 7,48 7,55 7,63 7,69 7,76 8,03 8,25 8,43 8,59 8,72 8,84
9 6,76 6,87 6,97 7,06 7,15 7,22 7,30 7,36 7,43 7,49 7,75 7,96 8,13 8,28 8,41 8,53
10 6,58 6,69 6,78 6,87 6,95 7,02 7,09 7,16 7,22 7,28 7,53 7,73 7,90 8,04 8,17 8,28
11 6,44 6,54 6,63 6,71 6,79 6,86 6,93 6,99 7,05 7,11 7,35 7,55 7,71 7,85 7,97 8,08
12 6,32 6,41 6,50 6,59 6,66 6,73 6,80 6,86 6,92 6,97 7,21 7,39 7,55 7,69 7,80 7,91
13 6,22 6,31 6,40 6,48 6,55 6,62 6,68 6,74 6,80 6,85 7,08 7,27 7,42 7,55 7,67 7,77
14 6,13 6,22 6,31 6,39 6,46 6,53 6,59
TA 6,65 6,70 6,75 6,98 7,16 7,31 7,44 7,55 7,65
15 6,06 6,15 6,23 6,31 6,38 6,45 6,51 6,56 6,62 6,67 6,89 7,07 7,21 7,34 7,45 7,55
16 6,00 6,08 6,17 6,24 6,31 6,37 6,43 6,49 6,54 6,59 6,81 6,98 7,13 7,25 7,36 7,46
17 5,94 6,03 6,11 6,18 6,25 6,31 6,37 6,43 6,48 6,53 6,74 6,91 7,05 7,18 7,28 7,38
18 5,89 5,98 6,06 6,13 6,20 6,26 6,32 6,37 6,42 6,47 6,68 6,85 6,99 7,11 7,21 7,31
U
19 5,85 5,93 6,01 6,08 6,15 6,21 6,27 6,32 6,37 6,42 6,63 6,79 6,93 7,05 7,15 7,24
20 5,81 5,89 5,97 6,04 6,10 6,17 6,22 6,28 6,33 6,37 6,58 6,74 6,88 6,99 7,10 7,19
IN

24 5,68 5,76 5,84 5,91 5,97 6,03 6,09 6,13 6,18 6,23 6,42 6,58 6,71 6,82 6,92 7,01
30 5,56 5,64 5,71 5,77 5,83 5,89 5,94 5,99 6,04 6,08 6,27 6,42 6,54 6,65 6,74 6,83
40 5,44 5,51 5,58 5,64 5,70 5,75 5,80 5,85 5,89 5,93 6,11 6,26 6,38 6,48 6,57 6,65
60 5,32 5,39 5,45 5,51 5,57 5,62 5,66 5,71 5,75 5,79 5,96 6,09 6,21 6,30 6,39 6,46
M

120 5,20 5,27 5,33 5,38 5,43 5,48 5,53 5,57 5,61 5,64 5,80 5,93 6,04 6,13 6,21 6,28
Inf 5,08 5,14 5,20 5,25 5,30 5,35 5,39 5,43 5,46 5,50 5,65 5,76 5,86 5,95 6,02 6,09
Estatı́stica 217

Tabela para o Teste de Duncan, com 1% de probabilidade.


Nota: k: número de médias abrangidas no contraste e GL: Graus de liberdade dos resı́duos.

GL\k 2 3 4 5 6 7 8 9 10
5 5,70 5,89 5,99 6,04 6,06 6,07 6,07 6,07 6,07
6 5,24 5,44 5,55 5,61 5,66 5,68 5,69 5,70 5,70
7 4,95 5,14 5,26 5,33 5,38 5,42 5,44 5,45 5,46
8 4,75 4,94 5,06 5,13 5,19 5,23 5,26 5,28 5,29
9 4,60 4,79 4,90 4,99 5,04 5,08 5,12 5,14 5,16
10 4,48 4,67 4,79 4,87 4,93 4,97 5,01 5,03 5,06
11 4,39 4,58 4,69 4,78 4,84 4,89 4,92 4,95 4,97
12 4,32 4,50 4,62 4,70 4,76 4,81 4,85 4,88 4,90
13 4,26 4,44 4,56 4,64 4,70 4,75 4,79 4,82 4,85
14 4,21 4,39 4,51 4,59 4,65 4,70 4,74 4,77 4,80
15 4,17 4,35 4,46 4,55 4,61 4,66 4,70 4,73 4,76
16 4,13 4,31 4,43 4,51 4,57 4,62 4,66 4,70 4,72
17 4,10 4,28 4,39 4,47 4,54 4,59 4,63 4,66 4,69
18 4,07 4,25 4,36 4,45 4,51 4,56 4,60 4,64 4,66
19 4,05 4,22 4,33 4,42 4,48 4,53 4,58 4,61 4,64
20
25
4,02
3,94
4,20
4,11
4,31
4,22
TA
4,40
4,31
4,46
4,37
4,51
4,42
4,55
4,47
4,59
4,50
4,62
4,53
30 3,89 4,06 4,17 4,25 4,31 4,37 4,41 4,44 4,48
50 3,79 3,95 4,06 4,14 4,20 4,25 4,29 4,33 4,37
U
60 3,76 3,92 4,03 4,11 4,17 4,23 4,27 4,31 4,34
100 3,71 3,87 3,98 4,06 4,12 4,17 4,22 4,25 4,29
Tabela para o Teste de Duncan, com 5% de probabilidade.
IN

GL\k 2 3 4 5 6 7 8 9 10
5 3,64 3,75 3,80 3,81 3,81 3,81 3,81 3,81 3,81
M

6 3,46 3,59 3,65 3,68 3,69 3,69 3,69 3,69 3,69


7 3,34 3,48 3,55 3,59 3,61 3,62 3,62 3,62 3,62
8 3,26 3,40 3,48 3,52 3,55 3,57 3,58 3,58 3,58
9 3,20 3,34 3,42 3,47 3,50 3,52 3,54 3,54 3,54
10 3,15 3,29 3,38 3,43 3,46 3,49 3,50 3,51 3,52
11 3,11 3,26 3,34 3,39 3,43 3,46 3,48 3,49 3,50
12 3,08 3,22 3,31 3,37 3,41 3,44 3,46 3,47 3,48
13 3,05 3,20 3,28 3,35 3,39 3,42 3,44 3,46 3,47
14 3,03 3,18 3,27 3,33 3,37 3,40 3,43 3,44 3,46
15 3,01 3,16 3,25 3,31 3,35 3,39 3,41 3,43 3,44
16 2,99 3,14 3,23 3,30 3,34 3,38 3,40 3,42 3,44
17 2,98 3,13 3,22 3,28 3,33 3,37 3,39 3,41 3,43
18 2,97 3,12 3,21 3,27 3,32 3,36 3,38 3,40 3,42
19 2,96 3,11 3,20 3,26 3,31 3,35 3,38 3,40 3,42
20 2,95 3,10 3,19 3,26 3,30 3,34 3,37 3,39 3,41
25 2,91 3,06 3,15 3,22 3,27 3,31 3,34 3,37 3,39
30 2,89 3,03 3,13 3,20 3,25 3,29 3,32 3,35 3,37
50 2,84 2,99 3,08 3,15 3,21 3,25 3,29 3,32 3,34
60 2,83 2,98 3,07 3,14 3,20 3,24 3,28 3,31 3,33
100 2,81 2,95 3,05 3,12 3,18 3,22 3,26 3,29 3,32
Estatı́stica 218

Tabela para o Teste de Dunnett, com 1% de probabilidade.


Nota: k: número de médias de tratamentos (número de grupos tratados), excluindo o grupo con-
trole e GL: Graus de liberdade dos resı́duos.
GL\k 1 2 3 4 5 6 7 8 9
5 4,03 4,63 4,98 5,22 5,41 5,56 5,69 5,80 5,89
6 3,71 4,21 4,51 4,71 4,87 5,00 5,10 5,20 5,28
7 3,50 3,95 4,21 4,39 4,53 4,64 4,74 4,82 4,89
8 3,36 3,77 4,00 4,17 4,29 4,40 4,48 4,56 4,62
9 3,25 3,63 3,85 4,01 4,12 4,22 4,30 4,37 4,43
10 3,17 3,53 3,74 3,88 3,99 4,08 4,16 4,22 4,28
11 3,11 3,45 3,65 3,79 3,89 3,98 4,05 4,11 4,16
12 3,05 3,39 3,58 3,71 3,81 3,89 3,96 4,02 4,07
13 3,01 3,33 3,52 3,65 3,74 3,82 3,89 3,94 3,99
14 2,98 3,29 3,47 3,59 3,69 3,76 3,83 3,88 3,93
15 2,95 3,25 3,43 3,55 3,64 3,71 3,78 3,83 3,88
16 2,92 3,22 3,39 3,51 3,60 3,67 3,73 3,78 3,83
17 2,90 3,19 3,36 3,47 3,56 3,63 3,69 3,74 3,79
18 2,88 3,17 3,33 3,44 3,53 3,60 3,66 3,71 3,75
19
20
2,86
2,85
3,15
3,13
3,31
3,29
TA
3,42
3,40
3,50
3,48
3,57
3,55
3,63
3,60
3,68
3,65
3,72
3,69
24 2,80 3,07 3,22 3,32 3,40 3,47 3,52 3,57 3,61
30 2,75 3,01 3,15 3,25 3,33 3,39 3,44 3,49 3,52
U
40 2,70 2,95 3,09 3,19 3,26 3,32 3,37 3,41 3,44
60 2,66 2,90 3,03 3,12 3,19 3,25 3,29 3,33 3,37
IN

Tabela para o Teste de Dunnett, com 5% de probabilidade.


GL\k 1 2 3 4 5 6 7 8 9
M

5 2,57 3,03 3,29 3,48 3,62 3,73 3,82 3,90 3,97


6 2,45 2,86 3,10 3,26 3,39 3,49 3,57 3,64 3,71
7 2,36 2,75 2,97 3,12 3,24 3,33 3,41 3,47 3,53
8 2,31 2,67 2,88 3,02 3,13 3,22 3,29 3,35 3,41
9 2,26 2,61 2,81 2,95 3,05 3,14 3,20 3,26 3,32
10 2,23 2,57 2,76 2,89 2,99 3,07 3,14 3,19 3,24
11 2,20 2,53 2,72 2,84 2,94 3,02 3,08 3,14 3,19
12 2,18 2,50 2,68 2,81 2,90 2,98 3,04 3,09 3,14
13 2,16 2,48 2,65 2,78 2,87 2,94 3,00 3,06 3,10
14 2,14 2,46 2,63 2,75 2,84 2,91 2,97 3,02 3,07
15 2,13 2,44 2,61 2,73 2,82 2,89 2,95 3,00 3,04
16 2,12 2,42 2,59 2,71 2,80 2,87 2,92 2,97 3,02
17 2,11 2,41 2,58 2,69 2,78 2,85 2,90 2,95 3,00
18 2,10 2,40 2,56 2,68 2,76 2,83 2,89 2,94 2,98
19 2,09 2,39 2,55 2,66 2,75 2,81 2,87 2,92 2,96
20 2,09 2,38 2,54 2,65 2,73 2,80 2,86 2,90 2,95
24 2,06 2,35 2,51 2,61 2,70 2,76 2,81 2,86 2,90
30 2,04 2,32 2,47 2,58 2,66 2,72 2,77 2,82 2,86
40 2,02 2,29 2,44 2,54 2,62 2,68 2,73 2,77 2,81
60 2,00 2,27 2,41 2,51 2,58 2,64 2,69 2,73 2,77
Estatı́stica 219

Tabela para o Teste de Dunnett, com 1% de probabilidade.


Nota: k: número de médias de tratamentos (número de grupos tratados), incluindo o grupo controle
e GL: Graus de liberdade dos resı́duos.
GL\k 2 3 4 5 6 7 8 9 10
5 4,03 4,63 4,98 5,22 5,41 5,56 5,69 5,80 5,89
6 3,71 4,21 4,51 4,71 4,87 5,00 5,10 5,20 5,28
7 3,50 3,95 4,21 4,39 4,53 4,64 4,74 4,82 4,89
8 3,36 3,77 4,00 4,17 4,29 4,40 4,48 4,56 4,62
9 3,25 3,63 3,85 4,01 4,12 4,22 4,30 4,37 4,43
10 3,17 3,53 3,74 3,88 3,99 4,08 4,16 4,22 4,28
11 3,11 3,45 3,65 3,79 3,89 3,98 4,05 4,11 4,16
12 3,05 3,39 3,58 3,71 3,81 3,89 3,96 4,02 4,07
13 3,01 3,33 3,52 3,65 3,74 3,82 3,89 3,94 3,99
14 2,98 3,29 3,47 3,59 3,69 3,76 3,83 3,88 3,93
15 2,95 3,25 3,43 3,55 3,64 3,71 3,78 3,83 3,88
16 2,92 3,22 3,39 3,51 3,60 3,67 3,73 3,78 3,83
17 2,90 3,19 3,36 3,47 3,56 3,63 3,69 3,74 3,79
18 2,88 3,17 3,33 3,44 3,53 3,60 3,66 3,71 3,75
19
20
2,86
2,85
3,15
3,13
3,31
3,29
TA
3,42
3,40
3,50
3,48
3,57
3,55
3,63
3,60
3,68
3,65
3,72
3,69
24 2,80 3,07 3,22 3,32 3,40 3,47 3,52 3,57 3,61
30 2,75 3,01 3,15 3,25 3,33 3,39 3,44 3,49 3,52
U
40 2,70 2,95 3,09 3,19 3,26 3,32 3,37 3,41 3,44
60 2,66 2,90 3,03 3,12 3,19 3,25 3,29 3,33 3,37
IN

Tabela para o Teste de Dunnett, com 5% de probabilidade.


GL\k 2 3 4 5 6 7 8 9 10
M

5 2,57 3,03 3,29 3,48 3,62 3,73 3,82 3,90 3,97


6 2,45 2,86 3,10 3,26 3,39 3,49 3,57 3,64 3,71
7 2,36 2,75 2,97 3,12 3,24 3,33 3,41 3,47 3,53
8 2,31 2,67 2,88 3,02 3,13 3,22 3,29 3,35 3,41
9 2,26 2,61 2,81 2,95 3,05 3,14 3,20 3,26 3,32
10 2,23 2,57 2,76 2,89 2,99 3,07 3,14 3,19 3,24
11 2,20 2,53 2,72 2,84 2,94 3,02 3,08 3,14 3,19
12 2,18 2,50 2,68 2,81 2,90 2,98 3,04 3,09 3,14
13 2,16 2,48 2,65 2,78 2,87 2,94 3,00 3,06 3,10
14 2,14 2,46 2,63 2,75 2,84 2,91 2,97 3,02 3,07
15 2,13 2,44 2,61 2,73 2,82 2,89 2,95 3,00 3,04
16 2,12 2,42 2,59 2,71 2,80 2,87 2,92 2,97 3,02
17 2,11 2,41 2,58 2,69 2,78 2,85 2,90 2,95 3,00
18 2,10 2,40 2,56 2,68 2,76 2,83 2,89 2,94 2,98
19 2,09 2,39 2,55 2,66 2,75 2,81 2,87 2,92 2,96
20 2,09 2,38 2,54 2,65 2,73 2,80 2,86 2,90 2,95
24 2,06 2,35 2,51 2,61 2,70 2,76 2,81 2,86 2,90
30 2,04 2,32 2,47 2,58 2,66 2,72 2,77 2,82 2,86
40 2,02 2,29 2,44 2,54 2,62 2,68 2,73 2,77 2,81
60 2,00 2,27 2,41 2,51 2,58 2,64 2,69 2,73 2,77
Estatı́stica 220

Referências
[1] M ONTGOMERY, D. C., AND RUNGER , G. C. Estatı́stica Aplicada e Probabilidade para
Engenheiros. LTC, 2021.

[2] M ORETTIN , L. G. Estatı́stica Básica. Pearson, 2010.

TA
U
IN
M

Você também pode gostar