Licenciatura em Ensino da Matemática
__ @ __
Análise Numérica com R
Í NDICE G ERAL
1 Ajuste de curvas e interpolação 2
1.1 Introdução . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 2
1.2 Ajuste de Curvas . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 3
1.3 Ajuste de curvas com equações lineares . . . . . . . . . . . . . . . . . . . 3
1.3.1 Método dos mínimos quadrados para estimar β0 e β1 . . . . . . . 4
1
CAPÍTULO 1
A JUSTE DE CURVAS E INTERPOLAÇÃO
Índice do Capítulo
1.1 Introdução . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 2
1.2 Ajuste de Curvas . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . 3
1.3 Ajuste de curvas com equações lineares . . . . . . . . . . . . . . . . . 3
1.3.1 Método dos mínimos quadrados para estimar β0 e β1 . . . . . . 4
1.1 Introdução
Muitas observações científicas e de engenharia são feitas em experimentos nos
quais grandezas físicas são medidas e gravadas. Tais registos são denominados de
dados ou pontos experimentais. Grande parte desses dados são utilizados para
formular modelos que possam representá-los. Isso é feito com traçado de curvas
nas quais se assume uma forma de equação específica, com base ou não de de teoria,
e com a determinação dos parâmetros dessa equação de forma que as curvas traçadas
representem da melhor forma possível o conjunto de dados. Para estimar o(s) valor(es)
esperado(s), pode-se usar o procedimentos chamado de interpolação. Na predição de
como esses dados poderiam ser estendidos além do intervalo no qual foram medidos,
um procedimento possível chama-se extrapolação.
2
1.2 Ajuste de Curvas
O ajuste de curvas é um procedimento no qual um modelo matemático (equação)
é usado para produzir uma curva que melhor represente um conjunto de dados.
Objectivo: Encontrar uma equação (um modelo) que possa fazer isso de forma geral.
Isso significa que a função não tem fornecer o valor exacto em cada ponto, mas sim
representar o conjunto de dados de forma satisfatória como um todo.
Por exemplo, a Figura 1.1 mostra os dados de consumo diário de electricidade
na cidade de Cabinda, e uma curva descrita por uma função polinomial de grau 12
(P (x) = a0 xn + a1 xn−1 + · · · + an−1 x + an ; n = 12), que melhor se ajusta a esse conjunto
de dados. Pode-se observar que curva reproduz a tendência geral dos dados, embora
não seja exactamente igual a nenhum dos pontos medidos.
●
●
●
●●●●● ●●●
●●
●
● ●●●
●
●● ●
● ●●●● ●●●●●●
●●● ●●● ●●
[Link] ●●●● ●●●
● ●● ● ●●●● ●●●
● ●
●●●
● ●
●● ●
31
● ●● ●●● ●●●● ●●●●●●●
●● ●
pol.grau12 ● ●● ●● ● ●
● ●●● ●●● ●
● ●●●●●
● ●● ●●● ●● ● ● ●
● ●
● ● ●● ●
●●●● ●●●●●●● ● ●●●●● ●
●● ●
● ●●●●● ●●● ●●● ● ●●●● ●●●●● ●● ●● ●
●● ● ● ● ●● ● ●
●●●●●●
● ●
● ●●
● ●●●● ●● ● ● ● ●● ● ●●● ● ● ●
●
● ● ● ●●●●● ●● ● ● ●● ●●● ●● ●●
●
●
●
●●●●●●
●
●●●
● ●●
●
●● ●● ● ●● ● ●●
●●
●●
●●●●
●
●●
●
●● ●
●●
● ●●
●● ●
●
● ●●
●● ●● ●●● ●●●●
●
●
●
●
●
●●●●●
● ●
●
●● ● ● ●
● ●● ● ● ● ●
●● ●●● ●●●●
●●● ● ● ●● ●●
●●● ● ●●●
●
● ● ● ●● ● ● ●● ● ●
● ● ● ● ●●
●
30
● ●● ●●●●●●● ●●● ● ● ●
●●● ●●●● ●●
●
●
●●●
●●● ● ●● ●
●●●● ●●● ● ●●
● ●●
●● ●● ●●●● ●
●●●
●●
●● ●● ●
●●●
●
●● ●●●
●
● ●●
●
●
●
●●
●●●●
●●
● ●● ● ●
●●●●●●
●● ●●
●●● ●●
●● ●●
●● ●●●●
●●● ●● ● ●●●●●
●●●●●
●●●● ●
● ●
●●● ●● ●
● ●
● ● ●● ● ● ●●●●●● ● ● ●
●●●●●●● ●
●● ●● ● ●●
consumo (MW)
●●●●●● ● ● ●● ●●●●●
●● ●
●● ●● ●● ●
29
● ● ●
●●●● ● ● ●● ●
●● ● ● ●● ●
●
●
● ● ●●● ● ● ●●
●
● ● ●
● ●●● ● ●●
● ● ●● ●●
● ●
● ●
● ● ●●● ●●
●● ●● ●●●● ●●● ● ●●
●● ● ●
●●●● ●●
● ●● ● ●● ● ● ●●
28
●●● ●● ●
●
● ● ● ● ● ● ● ●●
●● ●● ●
●●●● ● ● ●● ●●
●●● ● ●●●●●● ● ●●● ● ●●● ●
●●● ●● ●
● ●
●●
● ●●● ● ● ● ●● ●●●●●● ●
●●●
● ● ●● ●
● ● ● ● ●
●
●●
● ● ●● ●●●
●●●
●● ●● ● ●● ● ●● ●●●● ●●●
●
●●●● ● ●●● ● ● ●● ●●●● ●●● ●● ●
● ●● ●●●●●● ●●●●●
●
●●●●● ● ●●●●● ● ●● ●●
●●● ●●
● ●
● ●
● ●●●●
●●●● ●● ●● ● ●● ●
27
●● ● ● ●●
●● ●●●
● ●●●● ●●●●● ●●● ●●
●
●●●●●
●●● ●●●●● ● ● ●
●
●● ●
● ● ● ● ●● ● ●●
● ●●●● ● ● ● ●● ●
●● ●●● ● ●●
●●● ●● ●● ●●●
●●
●
●
● ● ● ●● ●●●
● ●●● ●● ●● ● ●●
●●●
● ●
●● ● ●
●●
●●●●●● ●●●● ● ●
●●●●●
●●● ● ● ●● ●●●●
●●●
●●●●●●
●●●●
●●
●
●●●●●
● ●
●● ●
●●
●
● ● ●●
● ●●●●●
●● ●●●●●
●●
●● ●●
●
●
● ●● ●●● ●●●
●●● ● ●●
● ●●●●●●●● ●●● ● ●●
● ● ●●●
●●●● ● ●●● ● ●●●● ●
● ●● ●● ●● ●● ●●●
26
●● ●●
●●●
●●●● ●● ●●●
●●
●● ●
●●
● ● ● ● ●
● ● ● ●●● ● ● ●● ●
● ●● ●● ●● ●●●● ● ●●●
●●
● ● ●●
●●●●●●●●●● ●
●●●●●●● ● ●●
●
●
●●●●
● ●
●● ●● ●●
● ● ●
●●●
●●
●●● ●●● ●● ●●●
● ●●●
0 500 1000 1500
período
Figura 1.1: Ajuste de curvas.
O ajuste de curvas é tipicamente utilizado quando os valores dos dados medidos
apresentam algum erro ou dispersão. No entanto, é também usado para determinar os
valores dos parâmetros (coeficientes) dos modelos especificados.
1.3 Ajuste de curvas com equações lineares
A equação linear da forma
y = β1 x + β0 (1.1)
é usada para promover o melhor ajuste de um conjunto de pontos. Isso é feito com a
determinação (estimação) das constantes (coeficientes) β 0 e β 1 que fornecem o menor
3
erro quando os pontos medidos são substituídos na Eq. (1.1). Do ponto de vista prático,
a Eq. (1.1) reflete o modelo estatístico denominado Regressão Linear Simples.
Quando os dados consistirem em mais de dois pontos, obviamente, uma linha
recta não pode passar por todos os pontos. Nesse caso, os coeficientes β 0 e β 1 são
determinados de tal forma que a linha recta promova o melhor ajuste como um todo,
conforme ilustrado na Fig. (1.2).
Figura 1.2: Vários pontos medidos.
1.3.1 Método dos mínimos quadrados para estimar β0 e β1
(x,y)
Figura 1.3: Resíduos como desvios verticais.
A regressão linear por mínimos quadrados é um procedimento no qual os
coeficientes β0 e β1 da função linear Y i = β0 + β1 xi + ei são determinados minimizando
a soma dos quadrados dos erros (sqe) de tal forma que essa função leve ao melhor
4
ajusto aos pontos observados. Estes erros de ajuste são os resíduos êi = yi − ŷi , cujo
significado geométrico é a distância vertical das observações yi à recta de regressão. O
melhor ajusto é definido como o menor Erro (E) calculado com a soma dos quadrados
dos resíduos dado como
n
X n
X
E= ê2i = [yi − (β1 xi + β0 )]2
i=1 i=1
Como todos os valores xi e yi são conhecidos, E é uma função não-linear de duas
variáveis, β1 e β0 , e tem um mínimo nos valores β1 e β0 nos quais as derivadas parciais
de E em relação a cada variável são iguais a zero. Calculando as derivadas parciais e
as igualando a zero, obtém-se:
n
∂E X
= −2 (yi − β1 xi − β0 ) = 0 (1.2)
β0 i=1
n
∂E X
= −2 (yi − β1 xi − β0 )xi = 0 (1.3)
β1 i=1
As equações (1.2) e (1.3) formam um sistema de duas equações. Rearranjando os
termos, obtemos as designadas equações normais na forma:
n
X n
X
nβ0 + xi β1 = yi (1.4)
i=1 i=1
n
X Xn Xn
xi β 0 + x2i β1 = x i yi (1.5)
i=1 i=1 i=1
A solução do sistema é:
Pn Pn Pn
n xi y i −
i=1 i=1 xi i=1 yi
β̂1 = 2 (1.6)
n ni=1 x2i −
P Pn
i=1 xi
n n
1X 1X
β̂0 = yi − βˆ1 xi (1.7)
n i=1 n i=1
Como as Eqs. (1.6) e (1.7) contêm somas idênticas, é conveniente calculá-las
primeiramente para então substituí-las nas equações. Para fazer isso, tais somas são
definidas como:
n
X n
X n
X n
X
Sx = xi , Sy = yi , Sxy = xi y i , Sxx = x2i (1.8)
i=1 i=1 i=1 i=1
5
Com essas definições, as equações dos coeficientes β 0 e β 1 são dados por:
Sxx Sy − Sxy Sx nSxy − Sx Sy
β0 = e β1 = (1.9)
nSxx − (Sx )2 nSxx − (Sx )2
As Eqs. (1.9) fornecem os valores (as estimativas) de β 0 e β 1 na função y = β1 x+β0
que levam ao melhor ajuste dos n pontos do conjunto de dados.
Exemplo 1 Suponha que estamos interessados em estudar a resistência de um cabo de aço
em função do seu diâmetro. A partir de uma amostra coletada, percebemos que as variáveis
Y e X são, aproximadamente, proporcionais, isto é, Y = θX em que θ é o coeficiente de
proporcionalidade. O nosso objetivo é estimar o parâmetro θ, baseado nas medidas disponíveis
na amostra de 10 unidades mostradas na tabela a seguir
Y
X
0 0 0.04 0.09 0.12 0.25
1 0.01 0.06 0.08 0.11 0.26
Y 2 0.01 0.08 0.08 0.08 0.25
3 0.01 0.06 0.09 0.08 0.24
fX (x) 0.03 0.24 0.34 0.39