0% acharam este documento útil (0 voto)
4 visualizações9 páginas

Distribuição de Frequências e Medidas Estatísticas

forum estatistica
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato DOCX, PDF, TXT ou leia on-line no Scribd
0% acharam este documento útil (0 voto)
4 visualizações9 páginas

Distribuição de Frequências e Medidas Estatísticas

forum estatistica
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato DOCX, PDF, TXT ou leia on-line no Scribd

2º Forum

Este fórum tem como tema de debate: distribuição de frequências, medidas de tendência
central e medidas de dispersão

I. Distribuição de frequências

 Frequência é a quantidade de vezes que uma determinada variável ocorre.

 Distribuição de frequência refere-se a tabela contendo os dados de acordo com a sua


frequência.

Uma distribuição de frequência é uma série estatística na qual os dados estão organizados em
grupos de classes ou categorias estabelecidas convenientemente.

A distribuição de frequência constitui a maneira pela qual um conjunto de dados é classificado


em diferentes grupos mutuamente exclusivos. Por outras, essa distribuição de frequência pode
ser vista como a maneira pela qual uma serie de observações é organizada em diferentes grupos,
e geralmente de forma ascendente ou descendente.

As distribuições de frequência podem ser divididas em dois tipos: distribuição de frequência


sem intervalos de classe, ou distribuição pontual, onde todos os valores dos dados colectados
são apresentados, e sem perdas de valores. Distribuição de frequência com intervalos de
classe, onde os valores estão representados por faixas de magnitude.

Consideremos o seguinte exemplo

X: 3,5; 5; 4,5; 4; 4,5; 5; 3,5; 4; 4; 5

2; 3; 4,5; 5; 4; 4,5; 3; 4; 3; 4;

3,5; 3,5; 3,5; 4; 4; 3; 4; 4; 5; 3;

Distribuição de frequência
Xi Fi

2 1

3 5

3,5 5

4 10

4,5 4

5 5

Frequência absoluta (fi) são os valores que representam o numero de elementos de cada classe.
O número de vezes que o dado aparece na amostra, ou, no caso de estarmos apresentando uma
distribuição de frequência por classes, o número de elementos pertencentes a uma classe.

Frequências relativas (fri) são valores das razoes entre as frequências simples (fi) de cada
fi
classe e a frequência total . fri=
∑ fi A utilização da frequência relativa facilita as comparações
entre mais de um conjunto de dados com diferentes números de elementos. A soma das
frequências relativas é sempre igual a 1.

X: 2; 2; 3; 3; 3; 4; 5; 5; 6; 6;

X Frequência absoluta - fi Frequência relativa- fri

2 2 2/10 = 0,2

3 3 3/10 = 0,3

4 1 1/10 = 0,1

5 2 2/10 = 0,2

6 2 2/10 = 0,2
Total 10 1,0

Frequência acumulada (Fi) refere-se a soma de frequências simples ou absolutas da classe com
as frequências simples anteriores. É dada pela frequência acumulada (F) da classe, dividida pela
frequência total (∑fi) do conjunto de dados. A frequência acumulada da última classe é igual à
unidade.

Distribuição de frequências com intervalos de classe

150 154 155 157 160 161 162 164 166 169
151 155 156 158 160 161 162 164 167 170
152 155 156 158 160 161 163 164 168 172
153 155 156 160 160 161 163 165 168 173

Tabela de frequencia absoluta

x Fi
150 1
151 1
152 1
153 1
154 1
155 4
156 3
157 1
158 2
160 5
161 4
162 2
163 2
164 3
165 1
166 1
167 1
168 2
169 1
170 1
172 1
173 1
Total 40

Elementos de uma distribuição de frequência

Classe: são os intervalos de variação da variável; é simbolizada por i e o número total de


classes, simbolizada por k. Ex: na tabela anterior, k = 6 e

158 = 162 é a 3ª classe, onde i = 3.

Limites de classe: são os extremos de cada classe. O menor número é o limite inferior de classe
( li ) e o maior número, limite superior de classe (Li). Ex: em 158 =162, l3 = 158 e L3 = 162.

Amplitude do intervalo de classe: é obtida através da diferença entre o limite superior e inferior
da classe e é simbolizada por hi = Li - li. Ex: na tabela anterior, hi = 162 - 158 = 4.

Amplitude total da distribuição: é a diferença entre o limite superior da última classe e o limite
inferior da primeira classe. AT = L(max) - l(min). No nosso exemplo, AT = 174 - 150= 24.

Amplitude total da amostra (ROL): é a diferença entre o valor máximo e o valor mínimo da
amostra (ROL), onde AA = X max – X min. Exemplo, AA = 173 - 150 = 23.
Ponto médio de classe: é o ponto que divide o intervalo da classe em duas partes iguais. No
nosso exemplo, em 158 = 162, xi = (li + Li)/2 ⇒x2 = (158 + 162)/2 = 160

Classe Frequencia

150 ├ 4
154

154 ├ 9
158

158 ├ 11
162

162 ├ 8
166

166 ├ 5
170

170 ├ 3
174

Distribuição de frequências e sua representação gráfica para variáveis quantitativas


contínuas

As variáveis quantitativas contínuas diferem um pouco das discretas na sua forma de


representação gráfica. A diferença mais importante é que as frequências são associadas a
intervalos de valores (classes de frequências) e não a valores individuais da variável em estudo.
Graficamente, podemos representar pelo histograma, pelo polígono de frequência e pelo
polígono de frequência acumulada.

Histograma
O histograma é um gráfico formado por um conjunto de colunas rectangulares. No eixo das
abcissas, marcamos as classes, cujas amplitudes correspondem às bases dos rectângulos. No eixo
das ordenadas, marcamos as frequências absolutas, que correspondem às alturas dos rectângulos.
Os pontos médios dos baseados rectângulos coincidem com os pontos médios dos intervalos de
classes.

Polígono de frequência

É a representação gráfica de uma distribuição por meio de um polígono. É obtido através da


ligação dos pontos médios dos intervalos de classe em um histograma de frequências.
Ogiva

É um polígono de frequências acumuladas no qual elas são localizadas sobre perpendiculares


levantadas nos limites inferiores ou superiores das classes, dependendo se a ogiva representar as
frequências acumuladas abaixo ou acima, respectivamente.

Distribuição de frequência sem intervalo de classes

É a simples condensação dos dados conforme as repetições de seus valores.


Cada valor é tomado como um intervalo de classe tratando-se de variável discreta de variação
relativamente pequena.

II. Medidas de tendência central


Medidas de tendência central são estatísticas utilizadas para resumir e representar um conjunto
de dados, indicando um valor que representa o centro ou a "tendência" dos dados. As principais
medidas de tendência central são a média, a mediana e a moda. As medidas de tendência central
servem para resumir em apenas uma informação a característica de um grupo de dados.

1. Exemplo de dados não agrupados: {10, 15, 12, 18, 20}

 Exemplo de dados agrupados em classes:

Classe 1: 10-15
Classe 2: 15-20

Classe 3: 20-25

 Exemplo de dados não agrupados:

Dados: {15, 12, 18, 22, 20}

Média aritmética corresponde a soma de todas as medições divididas pelo numero de


observações no conjunto de dados.

x 1+ x 2+ x 3+…+ xn
x=
n

12+15+18+20+22
x=
5

87
x=
5

x=17 , 4

Mediana é uma medida de localização do centro da distribuição dos dados, definida da seguinte
maneira: ordenados os elementos da amostra, a mediana é o valor que a divide ao meio, isto é,
a mediana indica exactamente o valor central de uma amostra de dados.

12, 15, 18, 20, 22

Mediana: 18

Moda: corresponde ao valor que aparece ou se repete com maior frequência no conjunto de
dados observados. Essa é a única medida de tendência central que pode ser usada com dados
nominais, os quais tem atribuições de categoria puramente qualitativa.

A moda pode ser: amodal quando na serie de dados não existem valores repetidos. Unimodal
quando tem apenas uma moda. Bimodal com duas ou três modas.

No caso do nosso exemplo, não temos moda sendo amodal.

III. Medidas de dispersão


Existem situações em que as medidas de tendência central não são as mais adequadas para a
analise de uma amostra de valores, sendo, necessário nesse caso usar as medidas de dispersão.

Medir a dispersão é analisar o quanto os valores de um conjunto se afastam de uma regularidade.


É verificar o quanto os elementos de um conjunto respeitam um padrão.

 Variância é uma medida estatística que indica a dispersão dos valores em relação a
medida de um conjunto de dados. Ela é denotada por s2 e encontrada pela formula

2
s=
∑ (xi−x 2)
2

Xi representa cada elemento do conjunto de dados x corresponde a média do conjunto e n


representa o número de elementos do conjunto.

 Desvio padrão é uma medida que indica a dispersão dos valores em relação a medida de
um conjunto de dados, sendo a raiz quadrada da variância. O desvio padrão corresponde a
medida de dispersão mais utilizada por apontar de forma mais precisa a dispersão dos
valores em relação a media aritmética (NAZARETH, 2003). Representa-se por S . s= √ s2

Exemplo: considere a serie de dados não agrupados

18, 22, 15, 17, 19, 21, 16

1º Procura-se a média

18+22+15+17+19+ 21+ 16
x= =18.2
7

2º Encontrar valores de Xi , Xi− X

Xi Xi−x

18 -0,2

22 3,8

15 -3,2

17 -1,2
19 0,8

21 2,8

16 -2,2

∑ (xi−x )2=(0 ,6)2=0 ,3 6

Aplicando a formulado desvio padrão: s=


√ ∑ ( xi−x 2)2 ↔
n √ 0 , 36
7
↔ √ 0 , 05=0 , 02

O desvio padrão sempre é um valor positivo e quanto maior for, maior será a dispersão
entre os elementos.

 Desvio médio é uma medida que calcula a media das distâncias entre cada valor de um
conjunto de dados e a media desse conjunto.

A variância e o desvio padrão são medidas que levam em consideração a totalidade dos valores
da variável em estudo, e não apenas valores externos ( CRESPO, 2002).

Exemplo de dados não agrupados:

Dados: {10, 12, 14, 16, 18}

Média: (10 + 12 + 14 + 16 + 18) / 5 = 14

(10-14), (12-14), (14-14), (16-14), (18-14) = -4, -2, 0, 2, 4

Valor absoluto de cada diferença: 4, 2, 0, 2, 4

Some todos os valores absolutos: 4 + 2 + 0 + 2 + 4 = 12

Dividindo a soma pelo número total de dados: 12 / 5 = 2.4

Desvio Médio = 2.4

Você também pode gostar