0% acharam este documento útil (0 voto)
4 visualizações14 páginas

Geração de Variáveis Aleatórias em Simulações

O capítulo aborda a geração de variáveis aleatórias para simulações de Monte Carlo, destacando o método de transformação inversa e sua aplicação em distribuições como a normal e exponencial. Também discute o uso de funções do Excel para gerar variáveis aleatórias e a importância de testes estatísticos, como o qui-quadrado, para validar a distribuição dos dados gerados. Por fim, menciona a aplicação de variáveis aleatórias na estimativa de áreas e números irracionais.

Traduzido por

ScribdTranslations
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd
0% acharam este documento útil (0 voto)
4 visualizações14 páginas

Geração de Variáveis Aleatórias em Simulações

O capítulo aborda a geração de variáveis aleatórias para simulações de Monte Carlo, destacando o método de transformação inversa e sua aplicação em distribuições como a normal e exponencial. Também discute o uso de funções do Excel para gerar variáveis aleatórias e a importância de testes estatísticos, como o qui-quadrado, para validar a distribuição dos dados gerados. Por fim, menciona a aplicação de variáveis aleatórias na estimativa de áreas e números irracionais.

Traduzido por

ScribdTranslations
Direitos autorais
© All Rights Reserved
Levamos muito a sério os direitos de conteúdo. Se você suspeita que este conteúdo é seu, reivindique-o aqui.
Formatos disponíveis
Baixe no formato PDF, TXT ou leia on-line no Scribd

Chapter 3

GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Para realizar uma simulação de Monte Carlo, seja manualmente ou por meio de computador, técnicas devem ser
desenvolvido para gerar valores de variáveis aleatórias com distribuições conhecidas. Esses valores
são frequentemente chamados de variáveis aleatórias. Como foi o caso no exemplo da janela do drive-in acima,
o ponto de partida para a geração de variáveis aleatórias é geralmente a geração de números aleatórios, que
são variáveis aleatórias que são uniformemente distribuídas no intervalo de 0 a 1 (uniforme [0, 1]).

3.1 Método de Transformação Inversa


A técnica de "consulta à tabela" que usamos anteriormente pode ser utilizada sempre que a simulação estiver
sendo feito à mão ou usando uma planilha. Também é utilizado em algumas linguagens de simulação devido
à velocidade com que pode ser implementado em um computador digital. Uma de suas desvantagens é
que leva um grande esforço para implementar em um computador e, portanto, raramente é usado sempre que
a simulação é escrita em uma linguagem de alto nível, como C ou FORTRAN. O procedimento
basicamente usa o inverso da função de distribuição acumulada F dada em uma tabela em vez de um
fórmula. Um número aleatório, , é gerado e então o valor (inverso) de isso daria
como o valor de ( ) é determinado. Dependendo da precisão desejada, a interpolação linear pode
ser usado.
Como exemplo, suponha que desejássemos gerar valores com uma distribuição normal padrão.
(média 0 e desvio padrão 1) usando uma planilha. Primeiro, devemos decidir a precisão
desejado. Suponha que 1 casa decimal é suficiente. Em seguida, geraríamos os valores de em
a faixa apropriada, digamos de -3 a 3. Gostaríamos de colocá-los em uma coluna com uma coluna em branco para
à esquerda. Na coluna da esquerda, colocaríamos então a fórmula para o padrão cumulativo
distribuição normal (mudando o valor na primeira célula para zero e o último para um). Desde
a planilha tem uma função embutida para essa distribuição, usaríamos a sintaxe
=NORMSDIST(A2), se a coluna for A e começar na segunda linha. O A2 refere-se à célula
contendo , o valor a ser avaliado. Por exemplo, parte da tabela é dada abaixo na Tabela
3.1.

3-1
3-2 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Tabela 3.1: Tabela da Distribuição Normal Padrão

Se uma coluna de números aleatórios for gerada, então a função de pesquisa vertical pode ser usada
para gerar os valores de uma variável aleatória que possui a distribuição normal padrão. Isso
técnica foi usada para gerar 100 valores dessa variável aleatória. Um histograma dos resultados é
dado na Figura 3.1.

Figura 3. 1 Histograma de 100 Variáveis Aleatórias Distribuídas Normalmente

Valores de uma variável aleatória normalmente distribuída, , tendo média e desvio padrão
pode ser encontrado usando a transformação usual

= , ou seja. = + ,
NOTAS DE SIMULAÇÃO 3-3

onde possui uma distribuição normal padrão ou, no caso de uma planilha, utilizando o
função de distribuição normal cumulativa (como acima) com média e desvio padrão .
Colocando a coluna para à direita da coluna para no procedimento acima de forma eficaz
produz o inverso da função de distribuição cumulativa. Sempre que o inverso do
a função de distribuição acumulada para a variável aleatória a ser gerada pode ser encontrada de forma fechada
a função inversa está disponível no software utilizado ou pode ser apresentada em uma tabela
técnica pode ser usada. Esta técnica é baseada na observação de que se o cumulativo
função de distribuição para é , se é contínua e injetora, e se é uma variável aleatória
que possui uma distribuição uniforme[0, 1], então !! ( ) tem a mesma distribuição que . Figura 3.2
abaixo ilustra a técnica, que também é chamada de método de transformação inversa.
Suponha que queremos gerar variáveis aleatórias com umuniforme[ , ] distribuição. A linear
funçãoℎ dado porℎ( ) = + ( − ) mapeia o intervalo [0, 1] no intervalo[ , ].
Uma possível maneira de gerar um valor para seria gerar um número aleatório então para usar
ℎ( ) = + ( − ) como o valor. A técnica de transformação inversa, ilustrada abaixo, deve
dê o mesmo gerador.
Figure 3.2: Inverse Transform Method

1
0,9
0,8
0,7
0,6
0,5
0,4
0,3
0,2
0.1

-6 -4 -2 0 2 4 6

A função densidade de probabilidade (pdf), , e a função de distribuição acumulada (cdf), ,


para ouniform[ , ] variável aleatória , são dados por
0 se < ,
1
se ≤ ≤ , −
= − e = se ≤ ≤ ,

0 caso contrário,
1 se > .
Resolvendo =( − )/( − ) para em termos de rende

= + − .
3-4 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Assim, o gerador fornecido pela técnica da função inversa seria

= + − ,

onde é um número aleatório, e é o mesmo que foi obtido acima usando um mapeamento linear de
o intervalo [0, 1] sobre o intervalo[ , ].
Outro gerador de variável aleatória útil que pode ser obtido usando a transformação inversa
o método é aquele para variáveis aleatórias distribuídas exponencialmente. Um é necessário sempre que um
a simulação de um processo de Poisson deve ser feita, uma vez que o tempo entre as ocorrências de um Poisson
o processo tem uma distribuição exponencial. Deixe seja uma variável aleatória que possui uma exponencial
distribuição com média = 1/ ( é chamado de parâmetro de taxa). Então a cdf de é dado por
1− !! ! se ≥ 0, !!" se
= = 1− ≥ 0,
0 caso contrário 0 caso contrário.

Resolvendo = 1− !" para em termos de rendimentos


ln1−
=− .

Assim, um gerador de variáveis aleatórias para é


ln1−
=− = − em1− ,

sempre que é distribuído exponencialmente com média = 1/ . Observe que desde ≤ 1, ln( ) ≤ 0.
Assim– ln( ) ≥ 0, e ≥ 0como deveria ser.
Considere a variável aleatória com pdf dada por

se0≤ ≤ 1,
2
= 3
se1< ≤ 2,
4

0caso contrário.
! !
Este é um pdf desde ≥ 0para todos e!! ( ) = ! /2! + 3/4 !
= 1. Primeiro nós
deve determinar a cdf . Se < 0, então ( ) = 0. Se0≤ ≤ 1, então
! ! ! !! !
= = 0 + = 0+ =.
!! !! ! 2 4 !
4
NOTAS DE SIMULAÇÃO 3-5

Se1≤ ≤ 2, então
! ! ! !3
= = 0 + +
!! !! ! 2 4
!
!
1 3 13 3 −2
= 0+ + =+ − 1=
4 4 ! 44 4

Verifique isso 1= (31− 2)/4= 1/4e 2= (32− 2)/4= 1, e assim os valores em


os pontos finais correspondem. Em resumo,

0 se < 0,
!
se0≤ ≤ 1,
4
=
3 −2
se1< ≤ 2,
4

1 se > 2.
Restringimos o domínio de to [0, 2] to obtain a one-to-one, and therefore, invertible, function.
Deixe = ( ). Se0≤ ≤ 1/4, então deve ser a imagem de algum entre 0 e 1. Se
1/4< ≤ 1, então deve ser a imagem de alguma coisa entre 1 e 2. Portanto, se0≤ ≤ 1/4, então
= ! /4. Resolvendo para dá = ± 4 = ±2 e nós pegamos o + uma vez que sabemos mentiras
entre 0 e 1. Se1/4< ≤ 1, então = (3 − 2)/4. Resolvendo para dá = (4 + 2)/3.
Assim, nosso gerador de variáveis aleatórias é

2 se0≤ ≤ 1/4,
= 4 +2
se1/4< ≤ 1.
3
3.2 Usando as Funções do Excel
Existem várias funções de probabilidade cujos inversos estão incorporados no Excel. Assim, eles podem ser
usado com o método de transformação inversa para gerar variáveis aleatórias. Dois dos mais utilizados são
a inversa da distribuição Normal e a inversa da distribuição Gama. Cuidado deve ser
levado em consideração ao usar uma função inversa no Excel, porque a função nem sempre é a
inverso da função de distribuição acumulada.
A distribuição Normal leva dois parâmetros, a média e o desvio padrão do
variável aleatória. A exibição de Ajuda do Excel para a função é mostrada na Figura 3.3. O formato para
a chamada de função éNORMINV(número_aleatório, média, desvio_padrão). Assim para
gerar uma variável aleatória com média 2 e desvio padrão 0,5, nós deveríamos inserir
=NORMINV(RAND(),2,0.5)
3-6 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Figura 3.3: Ajuda do Excel sobre NORMINV

na célula do Excel onde desejamos que o valor apareça. É uma boa prática em planilhas nunca usar
parâmetros específicos em fórmulas, mas para dar a cada parâmetro sua própria célula e usar referências de célula.
Assim, devemos inserir a fórmula conforme mostrado na Figura 3.4. Note que o $ nas fórmulas que
corrige as referências às células de parâmetro.

Figura 3.4: Gerando Variáveis Aleatórias Normais


NOTAS DE SIMULAÇÃO 3-7

A distribuição Gamma também requer dois parâmetros. Esses dois parâmetros não são tão bem
conhecidos como aqueles para a distribuição Normal. Os dois parâmetros são normalmente denotados por e
Eles estão relacionados à média e o desvio padrão da distribuição pelo
fórmulas seguintes:
= e != !.

Se = 1temos a distribuição exponencial com = 1/ . Se é um número inteiro positivo, o


distribution is called an Erlang distribution. The Gamma distribution is often used to model
waiting time distributions. See Appendix B for a discussion of the relationship between the
distribuição exponencial e o tempo entre ocorrências de um fenômeno aleatório.
A tela de ajuda do Excel para a função GAMMAINV é mostrada na Figura 3.5. Assim, para
gerar uma variável aleatória com parâmetros e , nós entramos=GAMMAINV(RAND(),α, β)
na célula do Excel onde desejamos que o valor apareça. Um exemplo é mostrado na Figura 3.6.

Figure 3.5: Excel Help on GAMMAINV

3.3 Teste de aderência do qui-quadrado


Assim como um gerador de números aleatórios, um gerador de variáveis aleatórias deve produzir valores que
satisfazer testes estatísticos que indiquem se os valores gerados são ou não os desejados
distribuição. O primeiro teste que usaremos é um teste Qui-quadrado, semelhante ao usado no Capítulo 2.
As diferenças surgem porque o número esperado de ocorrências em um subintervalo pode ser tão pequeno
que os cálculos resultantes estão distorcidos. Por essa razão, exigiremos que o esperado
o número de ocorrências em um subintervalo deve ser pelo menos 5 (ou próximo disso).
Para ilustrar, 100 valores foram gerados a partir de uma variável aleatória Normal usando a técnica
ilustrado na Figura 3.4. A ferramenta de histograma foi utilizada para contar o número de ocorrências em cada
de 10 subintervalos que foram determinados pela ferramenta. Os resultados estão mostrados na Figura 3.7.
3-8 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Figura 3.6: Gerando Variáveis Aleatórias Gamma

Figura 3.7: Frequência Observada - Distribuição Normal

Precisamos determinar a probabilidade de um valor estar em cada um dos intervalos. Para fazer isso, nós
use a função NORMDIST do Excel, conforme mostrado na Figura 3.8, para encontrar a cumulativa
probabilidade da variável aleatória ser menor que o valor do bin. Esses valores estão na Coluna G em
Figura 3.8. A probabilidade da variável aleatória estar no subintervalo é então encontrada por
subtraindo o valor cumulativo do ponto de extremidade esquerda do valor cumulativo do ponto de extremidade direita
ponto. Esses valores estão na coluna H na Figura 3.8. O número esperado de valores em um
o subintervalo pode então ser calculado multiplicando a probabilidade pelo número total de
observações (coluna I).
NOTAS DE SIMULAÇÃO 3-9

Figure 3.8: Expected Calculations

Como os números esperados de valores nas três primeiras células são menores que 5, a combinação é
necessário. Para atingir o mínimo requerido de 5, agrupamos as três primeiras células com a quarta.
Pelos mesmos motivos, juntamos as últimas quatro células. As mesmas células são agrupadas nas observadas.
(frequência) dados. Os resultados estão mostrados na Figura 3.9. Observe que todos os valores esperados são
agora maior que 5.
O cálculo da estatística qui-quadrado prossegue como no Capítulo 2. Os graus de liberdade
o parâmetro é calculado como o número de células menos um menos o número de parâmetros
estimado. Neste caso, não estimamos nenhum parâmetro, pois conhecíamos a média e o desvio padrão
desvio da população no início. Como terminamos com 6 células, o grau de liberdade é 5.
Os resultados estão mostrados na Figura 3.10. Aceitamos a hipótese nula de que os dados foram obtidos
de uma distribuição Normal com um valor p de 0,896.
Em uma configuração mais geral, quando a média e o desvio padrão são estimados a partir dos dados,
os graus de liberdade seriam 6 - 1 - 2 = 3. Isso faria nosso valor crítico a 90%
confiança = 0.10) igual a 6,25 e nosso p-valor igual a 0,65. Assim, ainda teríamos
aceitou a hipótese nula de que os dados vieram da distribuição Normal com média 2 e
desvio padrão 1/2.
3-10 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Figura 3.9: Resultados de Agrupamento

Figura 3.10: Cálculos do Qui-quadrado


NOTAS DE SIMULAÇÃO 3-11

3.4 Usando Números Aleatórios para Estimar Área


Uma das aplicações da geração de variantes aleatórias é a estimativa de áreas e o uso de
!
esses para obter estimativas de números irracionais. Por exemplo, lembre-se de queem2=! 1/ éo
área sob a curva = 1/ entre = 1e = 2. Se gerarmos um grande número de pares
de números aleatórios( , ), onde é uniformemente distribuído em [1, 2] e é uniformemente
distribuídos em [0, 1], então a proporção do número de pares que estão sob a curva, , ao total
número de pares gerados, deve ser aproximadamente o mesmo que a razão da área sob o
Area
curva para a área total no retângulo [1, 2]×[0, 1]. That is, Total área≈ !. Neste exemplo, o
!
a área do retângulo que envolve, Área Total, é igual a um.
Para ilustrar, use o Excel para gerar 30 valores de usando o gerador = 1+ RAND() e
30 valores de usando o gerador = RAND()Veja a Figura 3.11. O par ordenado( , ) vontade
deite-se sob a curva sempre que < 1/ Isto é o mesmo que < 1. Assim, usamos a fórmula
=SE(D2<1;1;0) para registrar 1 sempre que o ponto estiver abaixo da curva e 0 sempre que o ponto estiver
sobre ou acima da curva. O número de pontos na área desejada é então encontrado somando os
valores na coluna E.

Figura 3.11: Estimativa de

Com apenas 30 pontos de dados, a estimativa deln2pode não ser preciso o suficiente. Mesmo com 1000
pares, a precisão pode ser de apenas um decimal (veja a Tabela 3.1).
3-12 GERAÇÃO DE VARIÁVEIS ALEATÓRIAS

Tabela 3.1: Estimativa de com 1000 pares


m= 697
n= 1000
Estimate= 0,697
ln(2)= 0,693147
error= 0.003853

Problemas
1. Use uma planilha ou um programa de computador para gerar 100 valores de uma exponencial
variável aleatória distribuída com média 0,5. Conte o número de valores da aleatória
varie em cada subintervalo de comprimento 0,25 e obtenha um histograma dos resultados.
2. Desenvolver um gerador de variáveis aleatórias para uma variável aleatória com o pdf
!! se < 0,
=
!!! se ≥ 0.

3. Considere uma variável aleatória que possui pdf

se0≤ ≤ 1,
= 2− se1≤ ≤ 2,
0 caso contrário.
Esta distribuição é chamada de distribuição triangular com pontos finais em 0 e 2 e modo em 1.
Desenvolva um gerador de variáveis aleatórias para esta variável aleatória.

4. Um esquadrão de bombardeiros está tentando destruir um depósito de munições que tem um formato retangular
tem forma e é de 1000 metros por 500 metros. O ataque aéreo seguirá pelo longo centro
eixo do depósito. Se uma bomba cair em qualquer lugar do depósito, um acerto é registrado. Caso contrário, o
a bomba é uma falha. Há dez bombardeiros em cada esquadrão. Um ataque a bomba consiste em cada um de
os 10 bombardeiros deixando suas bombas no depósito. O ponto de mira é o centro do depósito.
O ponto de impacto é assumido ter uma distribuição normal bivariada em torno do ponto de mira
com um desvio padrão de 600 metros na direção do alcance e 200 metros em
direção cruzada. Simule 100 ataques aéreos e obtenha uma estimativa do esperado
número de acertos em uma corrida. Quantas corridas de bombardeio devem ser simuladas para garantir que a estimativa seja
preciso para duas casas decimais com 90% de confiança?

5. Generate 100 random variates having a Normal distribution with mean 5 and standard
desvio 2. Obtenha um histograma dos valores gerados e compare sua forma com isso
esperado de uma distribuição Normal. Certifique-se de incluir a simetria do histograma em seu
discussão.

6. Gere 100 variáveis aleatórias com distribuição Gamma com média 5 e desvio padrão
NOTAS DE SIMULAÇÃO 3-13

desvio 2. Obtenha um histograma dos valores gerados e compare sua forma com a
esperado de uma distribuição Gamma. Certifique-se de incluir a simetria do histograma em seu
discussão.

7. Use um teste qui-quadrado para testar a adequação dos valores gerados no Problema 1 a um
distribuição exponencial.

8. Use um teste qui-quadrado para testar a qualidade de ajuste dos valores gerados no Problema 5 para um
Distribuição normal.

9. Use um teste qui-quadrado para testar a adequação dos valores gerados no problema 6 a um
Distribuição gamma.

10. Use simulação para aproximarln3= ! 1/ !


Use 1.000 pontos na sua simulação.

11. Use simulação para aproximar a área no primeiro quadrante que está dentro do círculo com
raio 1 e centro na origem. Use sua estimativa para encontrar uma estimativa de Use 1.000 pontos
em sua simulação.

12. Um grande varejista de catálogo está planejando ter uma promoção especial de móveis em um ano a partir de
agora. Para fazer isso, a empresa deve fazer seu pedido de móveis agora. Ela planeja assinar um
contrato com o fabricante para 3.000 cadeiras a um custo de $175 por unidade, que a empresa
planos para oferecer inicialmente por $250 por unidade. A promoção durará oito semanas, após o que
todas as unidades restantes serão oferecidas para venda a metade do preço inicial, ou $125 por unidade.
a empresa acredita que 2.000 unidades serão vendidas durante as primeiras oito semanas.

a. Com base nessas suposições, crie um modelo de planilha no Excel e determine o lucro
que a empresa espera da promoção.

Pesquisas sugerem que a demanda pela cadeira durante as primeiras oito semanas tem uma distribuição normal
(Gaussiana) distribuição com uma média de 2.000 cadeiras e desvio padrão de 500 cadeiras. O
o número de cadeiras encomendadas e o preço por unidade são conhecidos, mas o preço de venda real do
as cadeiras podem ser facilmente trocadas. O preço de venda inicial será definitivamente entre $200 e
$300, mas não temos razões para acreditar que um valor seja mais provável do que outro neste caso.
portanto, assumimos que o preço de venda inicial das cadeiras tem uma distribuição uniforme
entre $200 e $300.

b. Simule a promoção de móveis especiais e obtenha uma estimativa do lucro líquido.


a empresa pode receber.

c. Obtenha tanto estimativas pontuais quanto intervalos de confiança da média de lucro que a
a empresa pode esperar da promoção. Discuta quaisquer diferenças entre o
estimates usando as variáveis aleatórias contínuas (este exercício) e as estimativas
obtido anteriormente usando variáveis aleatórias discretas.
3-14 GERAÇÃO DE VARIÁVEL ALEATÓRIA

d. Em seguida, desejamos apresentar graficamente (histograma) as probabilidades estimadas


para os possíveis lucros líquidos que a empresa pode obter com a promoção de móveis especiais.
Primeiro, determine os maiores e menores valores que sua simulação produziu. Selecione um
nice round number smaller and one larger than your values and generate 10-15 values
entre esses números para uso no gráfico.

e. Finalmente queremos estimar a probabilidade que a empresa perderá dinheiro com o


promoção. Para obter a estimativa pontual, simplesmente dividimos o número de simulações
valores que são negativos pelo número total. Isso nos dá uma estimativa da probabilidade.
Agora use a Tabela do Excel para gerar pelo menos 30 estimativas de A média desses valores
é , a estimativa pontual de A fórmula para uma estimativa de intervalo de confiança de um
a proporção pode ser encontrada em qualquer texto introdutório de estatísticas ou online na Wikipedia sob
intervalo de confiança da proporção binominal

1−
± !!! !

onde é a proporção de sucessos em um processo de teste de Bernoulli estimada a partir do


amostra estatística !!! ! é o(1− !!) percentil de uma distribuição normal padrão, e
é o tamanho da amostra.

Soluções Parciais
ln(2 ) /2 se0≤ ≤ 1/2,
2. =
−ln(21− )/2se1/2< ≤ 1.

2 se0≤ ≤ 1,
3. =
2− 21− se1< ≤ 2.

Você também pode gostar