Estatística e Probabilidade
[Link]
AULA 8: Uma introdução ao software estatístico R
Apostila de R do DEST/UFMG.
Statistical Analysis with R for Dummies. John Wiley & Sons, 2017.
Prof. Thiago Rezende
Depto. Estatística - UFMG
Roteiro:
1. Uma introdução da linguagem R para ciência de dados.
2. Ambiente R;
3. Distribuições de probabilidade.
Distribuições de Probabilidade
Distribuições de probabilidade
Distribuições contínuas Distribuições discretas
Assumem valores em uma escala contínua. Assumem um número finito de valores.
Exemplo: Altura. Exemplo: Número de filhos
Distribuições de probabilidade
Distribuições contínuas Distribuições discretas
• sample: Uniforme • unif: Uniforme
• binom: Binomial • norm: Normal
• multinom: Multinomial • exp: Exponencial
• pois: Poisson • chisq: Qui-quadrado
• geom: Geométrica • t: t-student
• nbinom: Binomial negativa • f: F de snedecor
• ... • ...
O uso de uma distribuição de probabilidade depende da natureza da
variável em análise. Para isso, é interessante conhecer os possíveis
valores que uma variável tendo determinada das distribuição de
probabilidade pode assumir.
Distribuições de probabilidade
Existem muitas (Muitas mesmo) distribuições de probabilidade. Na prática
algumas delas são mais utilizadas (como as citadas no slide anterior).
Distribuições de probabilidade
No R as distribuições são utilizadas com um dos prefixos abaixo.
Distribuições de probabilidade no R
• Prefixo d: Densidade.
• Prefixo q: Quantil.
• Prefixo p: Probabilidade.
• Prefixo r: Números aleatórios.
Distribuições de probabilidade - O prefixo d
O prefixo ‘d’ seguido do nome de uma distribuição corresponde à densidade da variável.
> x <- seq(-3, 3, [Link] = 100)
> densidade <- dnorm(x = x, mean = 0, sd = 1)
> plot(x = x, y = densidade, type = "l",
+ xlab = "", ylab = "Densidade")
Distribuições de probabilidade - O prefixo q
O prefixo ‘q’ seguido do nome de uma distribuição corresponde ao quantil da variável.
> quantil1 <- qnorm(p = 0.025, mean = 0, sd = 1)
> quantil1
[1] -1.959964
> quantil2 <- qnorm(p = 0.975, mean = 0, sd = 1)
> quantil2
[1] 1.959964
Distribuições de probabilidade - O prefixo p
O prefixo ‘p’ seguido do nome de uma distribuição corresponde à probabilidade acumulada até
determinado quantil.
> prob1 <- pnorm(q = quantil1, mean = 0, sd = 1)
> prob1
[1] 0.025
> prob2 <- pnorm(q = quantil2, mean = 0, sd = 1)
> prob2
[1] 0.975
Distribuições de probabilidade - O prefixo r
O prefixo ‘r’ seguido do nome de uma distribuição permite a geração de
números aleatórios.
> amostra <- rnorm(n = 10000, mean = 0, sd = 1)
> hist(amostra, probability = T, breaks = 30)
> curve(dnorm, from = -5, to = 5, add = T,
+ col = "steelblue", lwd = 3)
Distribuições de probabilidade - O prefixo d
O prefixo ‘d’ seguido do nome de uma distribuição corresponde à densidade da variável.
> x <- seq(-3, 3, [Link] = 100)
> densidade <- dnorm(x = x, mean = 0, sd = 1)
> plot(x = x, y = densidade, type = "l",
+ xlab = "", ylab = "Densidade")
Agora, tente você!
Entendendo os prefixos ‘d’, ‘q’, ‘p’ e ‘r’
Gráficos de uma distribuição
Utilizando os prefixos ’d’, ’q’, ’p’ e ’r’ e se valendo dos nomes das distribuições
vistas no slide Distribuições de probabilidade:
• Gere 1.000 observações de duas distribuições à sua escolha.
• Faça o histograma e a curva da distribuição (ao mesmo tempo).
• Encontre o quantil 0.025 e o quantil 0.975 destas distribuições.
• Qual a proporção de observações maiores e menores que estes quantis (2.5% e 97.5%, resp.)
• Qual a probabilidade de observarmos valores entre -1 e 1?
• Qual a proporção encontrada na nossa amostra?
Mais informações e materiais podem ser encontrados
no website, Face e Youtube do LST:
[Link]
[Link]
[Link]