Distribuição de frequência
Este artigo explica o que são distribuições de frequência e como elas são alcançadas.
Você também encontrará exemplos passo a passo de distribuições de frequência e, além
disso, poderá praticar com exercícios resolvidos.
O que é uma distribuição de frequência?
Na bioestatísticas, a distribuição de frequência é uma tabela na qual os diferentes
valores de uma amostra são agrupados em linhas e em cada coluna é exibido um tipo de
frequência de cada valor. Portanto, a distribuição de frequência é usada para mostrar
todos os tipos de frequências em um conjunto de dados.
Mais especificamente, uma distribuição de frequência inclui frequência absoluta,
frequência absoluta cumulativa, frequência relativa e frequência relativa cumulativa.
Uma das características das distribuições de frequência é que elas são muito úteis para
resumir uma amostra estatística de uma variável quantitativa e de uma variável
qualitativa.
Como fazer uma distribuição de frequência
Para realizar uma distribuição de frequência, você deve seguir os seguintes passos:
1. Organize os dados em diferentes categorias e crie uma tabela em que cada linha
corresponda a uma categoria.
2. Calcule a frequência absoluta de cada categoria na segunda coluna da tabela.
3. Calcule a frequência absoluta acumulada de cada categoria na terceira coluna da
tabela.
4. Calcule a frequência relativa de cada categoria na quarta coluna da tabela.
5. Calcule a frequência relativa acumulada de cada categoria na quinta coluna da
tabela.
6. Opcionalmente, podem ser adicionadas duas colunas nas quais a frequência
relativa e a frequência relativa acumulada são calculadas como uma percentagem,
para isso basta multiplicar ambas as colunas por 100.
Exemplo de distribuição de frequência
Depois de vermos a definição de distribuição de frequência e a teoria de como ela é
construída, vamos resolver um exemplo passo a passo.
As idades de um grupo de paciente do hospital geral de Luanda são as seguintes.
Construa uma distribuição de frequência do conjunto de dados.
31 32 27
25 31 27
30 32 20
29 31 32
20 27 31
21 22 34
Como todas as idades só podem ser inteiros, é uma variável quantitativa discreta.
Organizamos os dados em diferentes categorias e crie uma tabela em que cada linha
corresponda a uma categoria
20 27 31
20 27 31
21 29 32
22 30 32
25 31 32
27 31 34
Então, para fazer uma distribuição de frequência, precisamos construir uma tabela na
qual cada valor diferente será uma linha, e então precisamos encontrar a frequência
absoluta de cada valor:
FA
20 2
21 1
22 1
25 1
27 3
29 1
30 1
31 4
32 3
34 1
18
Observe que a soma de todas as frequências absolutas é igual ao número total de dados.
Se esta regra não for respeitada, significa que você se esqueceu de fornecer algumas
informações.
Agora que sabemos a frequência absoluta, precisamos calcular a frequência absoluta
acumulada.
Para este cálculo temos duas opções: ou somamos a frequência absoluta do valor mais
todas as frequências absolutas dos menores valores, ou pelo contrário, somamos a
frequência absoluta do valor mais a frequência absoluta acumulada do valor anterior.
FA FAA
20 2 2
21 1 3
22 1 4
25 1 5
27 3 8
29 1 9
30 1 10
31 4 14
32 3 17
34 1 18
18
A frequência absoluta acumulada do último valor sempre corresponde ao número total de dados, você
pode usar este truque para verificar se os cálculos estão correctos.
A seguir, precisamos determinar a frequência relativa, que é calculada dividindo a frequência absoluta
pelo número total de idades (18):
Idade FA FAA FR
2
20 2 2 X100=11,11%
18
1
21 1 3 X100=5,56 %
18
1
22 1 4 X100=5,56%
18
1
25 1 5 X100=5,56%
18
3
27 3 8 X100=16,67%
18
1
29 1 9 X100=5,56%
18
1
30 1 10 X100=5,56%
18
4
31 4 14 X100=22,22%
18
3
32 3 17 X100=16,67%
18
1
34 1 18 X100=5,56%
18
18
Tenha em mente que a soma de todas as frequências relativas é sempre igual a 100,
caso contrário significa que um determinado cálculo da distribuição de frequências está
errado.
Finalmente, precisamos apenas extrair a frequência relativa acumulada. Para isso, deve-
se somar a frequência relativa do valor em questão mais todas as frequências relativas
anteriores ou, o que dá no mesmo, a frequência relativa acumulada anterior:
Idade FA FAA FR FRA
2
20 2 2 11,11% X100=11,11%
18
3
21 1 3 5,56% X100=16,67%
18
4
22 1 4 5,56% X100=5,56%
18
5
25 1 5 5,56% X100=22,22%
18
8
27 3 8 16,67% X100=44,44%
18
9
29 1 9 5,56% X100=50,00%
18
10
30 1 10 5,56% X100=55,56%
18
14
31 4 14 22,22% X100=77,78%
18
17
32 3 17 16,67% X100=94,44%
18
18
34 1 18 5,56% X100=100,00%
18
18 100,00%
Resumindo, a distribuição de frequência com todas as frequências dos dados do problema
é a seguinte:
Idade FA FAA FR FRA
20 2 2 11,11% 11,11%
21 1 3 5,56% 16,67%
22 1 4 5,56% 22,22%
25 1 5 5,56% 27,78%
27 3 8 16,67% 44,44%
29 1 9 5,56% 50,00%
30 1 10 5,56% 55,56%
31 4 14 22,22% 77,78%
32 3 17 16,67% 94,44%
34 1 18 5,56% 100,00%
18 100,00%
Distribuição de frequência para dados agrupados
Para fazer uma distribuição de frequência para dados agrupados em intervalos ou em classes , a única
diferença é que primeiro o conjunto de dados deve ser agrupado em intervalos diferentes, mas o resto dos
cálculos são feitos da mesma forma que em uma distribuição de frequência sem agrupar os dados.
Em um inquérito realizado se obtém as idades de um grupo de alunos do ISPEKA e os resultados abaixo
foram obtidos. Crie uma distribuição de frequência separando os dados em intervalos.
19 22 26 27 29 31
20 23 26 27 30 32
20 23 26 28 30 32
21 24 26 28 31 32
22 24 27 28 31 34
22 25 27 29 31 35
Como todas as idades só podem ser inteiros, é uma variável quantitativa discreta
Embora existam diversas regras matemáticas para a criação dos intervalos de uma amostra, neste caso
utilizaremos a Regra de Sturges para calcular a quantidade de intervalos ou classes,
O que é a Regra de Sturges?
A regra de Sturges, desenvolvida pelo estatístico Herbert Sturges em 1
926, é uma técnica amplamente utilizada em estatística descritiva. Ela
fornece uma abordagem prática para organizar grandes conjuntos de d
ados, transformando informações brutas em uma estrutura clara e fácil
de interpretar. A fórmula para calcular o número de classes (k) é:
K=1+3.322 x log (n), onde n
Procuramos
n =36 numero de dados
MV= 35 maior valor das idades
mv = 19 menor valor das idades
A =MV-mv amplitude do intervalo
A =35-19=16
n 36 19 22 4 4 11,11% 11,11%
MV 35 22 25 7 11 19,44% 30,56%
mv 19 25 28 9 20 25,00% 55,56%
A 16 28 31 7 27 19,44% 75,00%
6,1
31 34 7 34 19,44% 94,44%
K 7 6
2,6 100,00
34 37 2 36 5,56%
7 3 %
36 100,00%