Mat 2 Cap 3
Mat 2 Cap 3
6. Teorema de Weierstrass
9. Programas convexos/cóncavos
Introducción
Los conceptos de conjuntos convexos y funciones cóncavas/convexas tienen un papel funda-
mental en el estudio de la existencia de óptimos (máximos/mínimos). Como ya se ha visto, si una
función cóncava de una variable tiene un punto crítico, en dicho punto alcanza un máximo. De igual
manera, una función convexa de una variable alcanza un mínimo en los puntos críticos. Se verá cómo
estas propiedades se siguen cumpliendo para más variables, y se analizarán propiedades adicionales
(teorema local-global, teorema de unicidad).
combinación lineal de estos puntos a todo punto z 2 Rn que se puede expresar como
z = ∏x + µy ∏, µ 2 R cualesquiera
combinación lineal no negativa de estos puntos a todo punto z 2 Rn que se puede expresar como
z = ∏x + µy ∏, µ 2 R ∏ ∏ 0, µ ∏ 0
55
CAPÍTULO 3: CONVEXIDAD. OPTIMIZACIÓN LIBRE
combinación convexa de estos puntos a todo punto z 2 Rn que se puede expresar como
z = ∏x + µy ∏, µ 2 R ∏ ∏ 0, µ ∏ 0 ∏ + µ = 1
Nota 1 Se observa que las combinaciones convexas son un caso particular de las combinaciones no
negativas que, a su vez, son un tipo de combinación lineal. Las combinaciones convexas pueden expre-
sarse, de manera equivalente, de la forma
Gráficamente, como se observa en la figura 3.1, las combinaciones convexas de dos puntos se corres-
ponden con los puntos del segmento que los une
£ § © ™
x, y = z 2 Rn : z = ∏x + (1 ° ∏)y; ∏ 2 [0, 1]
Cuando se hace ∏ = 0 en la expresión anterior, entonces z = y, con lo que se está en un extremo del
segmento; al hacer ∏ = 1 queda z = x con lo que se trata del otro extremo del segmento. Cuando ∏ = 00 5
el punto z es justo el punto medio del segmento.
Ejemplo 1 Las combinaciones convexas de los puntos (2, 2) y (6, 4) (es decir, el segmento que une estos
puntos; véase la figura 3.1) son:
[(2, 2), (6, 4)] = {∏(2, 2) + (1 ° ∏)(6, 4); ∏ 2 [0, 1]} = {(6 ° 4∏, 4 ° 2∏); ∏ 2 [0, 1]}
[(2, 2), (5, 2)] = {∏(2, 2) + (1 ° ∏)(5, 2); ∏ 2 [0, 1]} = {(5 ° 3∏, 2); ∏ 2 [0, 1]}
Nota 2 Para obtener gráficamente las combinaciones no negativas de dos puntos, basta unir estos pun-
tos con el origen mediante rectas y quedarse con la zona determinada por estas semirrectas.
Ejemplo 3 Las combinaciones lineales no negativas de los puntos (2, 2) y (6, 4) son:
© ™ © ™
K [(2, 2), (6, 4)] = ∏(2, 2) + µ(6, 4); ∏ ∏ 0, µ ∏ 0 = (2∏ + 6µ, 2∏ + 4µ); ∏ ∏ 0, µ ∏ 0
Gráficamente, como se observa en la figura 3.2, se corresponde con lo que se denomina el cono deter-
minado por estos puntos.
Estos conceptos se pueden extender de manera inmediata para más de dos puntos.
combinación lineal de estos puntos a todo punto z 2 Rn que se puede expresar como
z = ∏1 x 1 + ∏2 x 2 + . . . + ∏k x k ∏i 2 R cualesquiera 8i
combinación lineal no negativa de estos puntos a todo punto z 2 Rn que se puede expresar como
z = ∏1 x 1 + ∏2 x 2 + . . . + ∏k x k ∏i 2 R ∏i ∏ 0 8i
combinación convexa de estos puntos a todo punto z 2 Rn que se puede expresar como
k
X
z = ∏1 x 1 + ∏2 x 2 + . . . + ∏k x k ∏i 2 R ∏i ∏ 0 8i , ∏i = 1
i =1
Ejemplo 4 La combinación convexa de los puntos (1, 3), (4, 4) y (5, 2) se corresponde con los puntos del
triángulo que aparece en la figura 3.3. En general, las combinaciones convexas de k puntos serán un
politopo (si está en el plano, se tratará de un polígono). La figura 3.4 muestra un poliedro (cubo) en R3
que resulta de la combinación convexa de ocho puntos.
La idea geométrica es que se puede ir en línea recta entre dos puntos cualesquiera del conjunto,
sin salirse de dicho conjunto.
Ejemplo 5 Obsérvese gráficamente si los subconjuntos de R2 en las figuras 3.5 y 3.6 son convexos o no.
© ™
Ejemplo 6 ¿Es convexo el conjunto S = (x, y) 2 R2 : x ° 2y ∑ 1 ? Su imagen gráfica es la que aparece
en la figura 3.7 en la que se observa que efectivamente se trata de un conjunto convexo. Para verlo
formalmente (utilizando la definición) se consideran dos puntos (x, y), (x 0 , y 0 ) en el conjunto S y un
escalar ∏ 2 [0, 1]; esto es,
x ° 2y ∑ 1 x 0 ° 2y 0 ∑ 1 ∏ 2 [0, 1]
Entonces,
° ¢
∏(x, y) + (1 ° ∏)(x 0 , y 0 ) = ∏x + (1 ° ∏)x 0 , ∏y + (1 ° ∏)y 0 = (x 00 , y 00 )
que debe averiguarse si pertenece al conjunto S (es decir, si cumple la condición que define al conjunto)
° ¢ ° ¢ ° ¢
x 00 ° 2y 00 = ∏x + (1 ° ∏)x 0 ° 2 ∏y + (1 ° ∏)y 0 = ∏ x ° 2y + (1 ° ∏) x 0 ° 2y 0 ∑ ∏ · 1 + (1 ° ∏) · 1 = 1
© ™
Figura 3.7: S = (x, y) 2 R2 : x ° 2y ∑ 1 es un conjunto convexo
Propiedades
1. La intersección de conjuntos convexos es un conjunto convexo.
Ejemplo 8 La figura 3.9 muestra distintos casos de puntos extremos en conjuntos convexos.
Figura 3.9: Todos los puntos de la circunferencia son puntos extremos en el círculo. Los puntos ex-
tremos del pentágono son los vértices, denotados por A, B, C, D, E
Ejemplo 9 Si un subconjunto de R2 está definido por intersección de semiplanos, para calcular los
puntos extremos se calculan los puntos de corte de las rectas y se tienen los candidatos que hay que ver
© ™
si están en el conjunto. Por ejemplo, S = (x, y) 2 R2 : x + 2y ∑ 4, 2x + y ∑ 5, x ∏ 0, y ∏ 0 . Tomando
las rectas de dos en dos, se tiene:
Nota 3 a) Las funciones lineales cumplen f (∏x + (1 ° ∏)y) = ∏ f (x) + (1 ° ∏) f (y), luego son cóncavas y
convexas a la vez.
b) En general, como ocurre con las funciones de una variable, las funciones pueden tener zonas en las
que son convexas y otras en las que son cóncavas.
c) Es importante señalar que existen funciones cóncavas y funciones convexas. Pero no ocurre lo mismo
con los conjuntos: no existe el concepto de conjunto cóncavo. Los conjuntos serán convexos, o no
convexos.
estrictamente convexa si 8x, y 2 S, x 6= y 8∏ 2 (0, 1), f (∏x + (1 ° ∏)y) < ∏ f (x) + (1 ° ∏) f (y)
4. Si la función f es cóncava y h(t ) es una función de una variable cóncava y creciente, entonces la
función '(x) = h( f (x)) es cóncava.
5. Si la función f es cóncava y h(t ) es una función de una variable convexa y decreciente, entonces
la función '(x) = h( f (x)) es convexa.
Ejemplo 10 Las últimas propiedades son útiles porque permiten descomponer el estudio en funcio-
p
nes más sencillas. Por ejemplo, la función '(x, y) = x + y, se puede poner como la composición de
p
f (x, y) = x + y que es lineal, por tanto cóncava (y también convexa), y la función h(t ) = t que es una
función real cóncava y creciente en su dominio: se puede ver que h 0 (t ) > 0 (creciente) y que h 00 (t ) < 0
p
(cóncava). Así, aplicando la propiedad 4, la función '(x, y) = x + y es cóncava.
4. Si la función f es convexa y h(t ) es una función de una variable convexa y creciente, entonces la
función '(x) = h( f (x)) es convexa.
5. Si la función f es convexa y h(t ) es una función de una variable cóncava y decreciente, entonces
la función '(x) = h( f (x)) es cóncava.
Ejemplo 11 Como antes, las últimas propiedades son útiles porque permiten descomponer el estudio
en funciones más sencillas. Por ejemplo, la función '(x, y) = e 2x°3y se puede poner como:
La función f (x, y) = 2x ° 3y es lineal y, por tanto, es convexa (también es cóncava). Por otro lado,
Demostración Se verá solo el primer apartado, ya que el otro es totalmente análogo. Para ello, en
primer lugar se supone que la función es cóncava y se quiere demostrar que el conjunto Hip( f ) es un
conjunto convexo. Sean (x, y), (x 0 , y 0 ) 2 Hip( f ) y sea ∏ 2 [0, 1]. Hay que probar que
° ¢
∏(x, y) + (1 ° ∏)(x 0 , y 0 ) = ∏x + (1 ° ∏)x 0 , ∏y + (1 ° ∏y 0 2 Hip( f ),
es decir,
° ¢
f ∏x + (1 ° ∏)x 0 ∏ ∏y + (1 ° ∏)y 0 .
Como la función f es cóncava, y los puntos están en Hip( f ) se cumple que
° ¢
f ∏x + (1 ° ∏)x 0 ∏ ∏ f (x) + (1 ° ∏) f (x 0 ) f (x) ∏ y f (x 0 ) ∏ y 0
Hay que probar ahora que si Hip( f ) es un conjunto convexo, entonces la función es cóncava.
° ¢ ° ¢
Sean x, x 0 2 S, ∏ 2 [0, 1]. Entonces, los puntos x, f (x) , x 0 , f (x 0 ) están en Hip( f ). Al ser convexo,
° ¢ ° 0 ¢
∏ x, f (x) + (1 ° ∏) x , f (x 0 ) 2 Hip( f ), lo que significa
° ¢ ° ¢
∏x + (1 ° ∏)x 0 , ∏ f (x) + (1 ° ∏) f (x 0 ) 2 Hip( f ) ) ∏ f (x) + (1 ° ∏) f (x 0 ) ∑ f ∏x + (1 ° ∏)x 0
Figura 3.14: Hipografo de una función cóncava y Epigrafo de una función convexa
Nota 4 El resultado anterior es muy útil para demostrar la convexidad de conjuntos, siempre que es-
tos se puedan poner como hipografos o epigrafos de funciones cóncavas o convexas, respectivamente (o
como intersección de conjuntos de esta forma, aplicando después la propiedad que dice que la inter-
sección de conjuntos convexos es un conjunto convexo).
© ™
Ejemplo 12 Prueba que el conjunto S = (x, y) 2 R2 : y ∏ x 2 es convexo.
Este conjunto es el epigrafo de la función f (x) = x 2 , que es convexa (es una función de una variable
real cuya segunda derivada es positiva, f 00 (x) = 2 > 0). Por tanto, aplicando el teorema 3 se trata de un
conjunto convexo.
Nota 5 En el capítulo anterior se vio el concepto de conjunto de contorno (superior e inferior) que no
hay que confundir con los conceptos de epigrafo e hipografo de una función. Si la función es de dos
variables, f (x, y), los conjuntos de contorno superior e inferior son subconjuntos de R2 , mientras que
el epigrafo y el hipografo son subconjuntos de R3
© ™ © ™
UC ( f ) = (x, y) 2 R2 : f (x, y) ∏ C ; LC ( f ) = (x, y) 2 R2 : f (x, y) ∑ C
© ™ © ™
Epi( f ) = (x, y, z) 2 R3 : z ∏ f (x, y) ; Hip( f ) = (x, y, z) 2 R3 : z ∑ f (x, y)
La diferencia entre estos conceptos se ve muy clara con funciones de una variable que se pueden repre-
sentar gráficamente. El siguiente ejemplo ilustra este hecho.
Ejemplo 13 Dada la función f (x) = x 3 °x, el conjunto de contorno superior de nivel C = 0 serían todos
los puntos x 2 R de manera que f (x) ∏ 0 y con la desigualdad al contrario para el conjunto de contorno
inferior. Si se observa la gráfica de esta función (figura 3.15), resulta claro que
Mientras que el epigrafo son todos los puntos de R2 que están por encima de la gráfica, y el hipografo
los que están por debajo.
II ) convexa, entonces para todo nivel C , el conjunto de contorno inferior de nivel C , LC ( f ) es un con-
junto convexo.
Demostración Las dos partes son análogas y se verá solo la segunda. Hay que probar que, para todo
© ™
C , el conjunto LC = x 2 Rn : f (x) ∑ C es convexo. Si se consideran dos puntos x, x 0 2 LC y un escalar
∏ 2 [0, 1], debe cumplirse que z = ∏x + (1 ° ∏)x 0 2 LC . Es decir que f (z) ∑ C .
Si la función es convexa, se cumple
° ¢
f ∏x + (1 ° ∏)x 0 ∑ ∏ f (x) + (1 ° ∏) f (x 0 ).
Además, como los puntos están en el conjunto de contorno inferior, f (x) ∑ C y f (x 0 ) ∑ C . Por tanto,
° ¢
f (z) = f ∏x + (1 ° ∏)x 0 ∑ ∏ f (x) + (1 ° ∏) f (x 0 ) ∑ ∏C + (1 ° ∏)C = C .
El siguiente ejemplo muestra que el recíproco de la propiedad anterior no es cierto. Es decir, pue-
de ser que los conjuntos de contorno (superior y/o inferior) sean conjuntos convexos, pero la función
no sea ni cóncava, ni convexa.
Ejemplo 14 Sea la función f (x) = x 3 . Entonces, el conjunto de contorno superior de nivel C serían los
£p3
¢ ° p
3
§
números reales del intervalo C , +1 , mientras que el inferior sería °1, C . Ambos son conjuntos
convexos, pero la función no es ni cóncava, ni convexa en toda la recta real, S = R. Nótese que ni el
epigrafo, ni el hipografo son conjuntos convexos.
Pero como ya se ha visto, el recíproco no es cierto. La función de distribución normal N (µ, æ) (cuya
gráfica se denomina coloquialmente Campana de Gauss, ver figura 3.17), muy utilizada en Estadística
y Probabilidad, es otro ejemplo de función cuasi-cóncava que no es cóncava.
Una definición alternativa que es más útil para comprobar en la práctica la cuasi-concavidad o
cuasi-convexidad de funciones es la siguiente. Esta definición también permite introducir la cuasi-
concavidad/cuasi-convexidad estricta.
Como con las funciones cóncavas y convexas, si las desigualdades son estrictas, entonces la fun-
ción se dice que es estrictamente cuasi-cóncava o estrictamente cuasi-convexa.
La Campana de Gauss (figura 3.17) es la gráfica de una función estrictamente cuasi-cóncava. Las
funciones cuasi-cóncavas/cuasi-convexas tienen propiedades parecidas a las de las funciones cón-
cavas/convexas.
Ejemplo 15 La función f (x) = °2x 2 es cuasi-cóncava (por ser cóncava, ya que su segunda derivada es
siempre negativa, f 00 (x) = °4) y la función h(t ) = e t es creciente. Por tanto, la función compuesta '(x) =
2 2
h( f (x)) = e °2x es cuasi-cóncava. La segunda derivada de esta función, '00 (x) = (°4 + 16x 2 )e °2x , es
° ¢ ° ¢ ° ¢
positiva en el conjunto °1, ° 12 [ 12 , +1 , y negativa en el intervalo ° 12 , 12 , luego no es cóncava en
R. Su gráfica es similar a la campana de Gauss.
Para funciones de dos variables f (x, y), como muestra la figura 3.19, la propiedad es análoga con
respecto al plano tangente a la gráfica de dicha función en un punto cualquiera (a, b, f (a, b)), cuya
ecuación es z = f (a, b) + r f (a, b) · (x ° a, y ° b). Se tiene que:
El siguiente teorema recoge esta propiedad para el caso general de funciones con n variables.
III ) estrictamente cóncava si, y solo si, f (x) < f (a) + r f (a) · (x ° a) 8x, a 2 S, x 6= a.
IV ) estrictamente convexa si, y solo si, f (x) > f (a) + r f (a) · (x ° a) 8x, a 2 S, x 6= a.
Aunque en teoría el resultado anterior puede servir para identificar gráficamente funciones cón-
cavas/convexas, al no poder dibujar funciones de varias variables en la práctica no posee mucha
utilidad. Usando la fórmula de Taylor de orden 2,
1
f (x) = f (a) + r f (a) · (x ° a) + (x ° a)0 H f (z)(x ° a) z 2 B (a, ≤)
2
se deduce que para saber si se cumplen las condiciones del teorema 6 basta con identificar el signo
de (x ° a)0 H f (z)(x ° a), que es una forma cuadrática de matriz H f (z). De este modo se deduce el
siguiente teorema que es el que se utiliza en la práctica para saber si una función de varias variables
es cóncava o convexa.
Teorema 7 Sea S µ Rn un conjunto convexo. Una función f : S ! R, que tiene parciales primeras y
segundas continuas, es:
I) cóncava si, y solo si, para todo x 2 S, H f (x) tiene asociada una forma cuadrática semidefinida
negativa o definida negativa.
II ) convexa si, y solo si, para todo x 2 S, H f (x) tiene asociada una forma cuadrática semidefinida
positiva o definida positiva.
III ) estrictamente cóncava si, y solo si, para todo x 2 S, H f (x) tiene asociada una forma cuadrática
definida negativa.
IV ) estrictamente convexa si, y solo si, para todo x 2 S, H f (x) tiene asociada una forma cuadrática
definida positiva.
Nota 6 Estas condiciones son (básicamente) las mismas que se usan para identificar funciones cónca-
vas/convexas de una variable: cóncava cuando la segunda derivada es menor o igual a cero (definida
negativa); convexa cuando la segunda derivada es mayor o igual a cero (definida positiva).
Ejemplo 16 Analiza la concavidad/convexidad de las siguientes funciones.
a) f (x, y) = 2x 2 + 2x y + 5y 2
@f @f @2 f @2 f @2 f
= 4x + 2y = 2x + 10y 2
=4 2
= 10 =2
@x @y @x @y @x@y
µ ∂
4 2
H f (x, y) =
2 10
La forma cuadrática es definida positiva ya que D 1 = 4 > 0, D 2 = 36 > 0.
Por tanto, la función es estrictamente convexa.
b) f (x, y, z) = °2x 2 + 2x y ° 5y 2 ° xz ° z 2
@f @f @f
= °4x + 2y ° z = 2x ° 10y = °x ° 2z
@x @y @z
@2 f @2 f @2 f @2 f @2 f @2 f
= °4 = °10 = °2 = 2 = °1 =0
@x 2 @y 2 @z 2 @x@y @x@z @y@z
0 1
°4 2 °1
H f (x, y, z) = @ 2 °10 0 A
°1 0 °2
D 1 = °4 < 0, D 2 = 36 > 0, D 3 = °62 < 0, luego la forma cuadrática es definida negativa.
Por tanto, la función es estrictamente cóncava.
c) f (x, y) = x 4 + 2x 2 y 2
@f @f @2 f @2 f @2 f
= 4x 3 + 4x y 2 = 4x 2 y = 12x 2 + 4y 2 = 4x 2 = 8x y
@x @y @x 2 @y 2 @x@y
µ ∂
12x 2 + 4y 2 8x y
H f (x, y) =
8x y 4x 2
D 1 = 12x 2 + 4y 2 ∏ 0, D 2 = 48x 4 ° 48x 2 y 2 = 48x 2 (x 2 ° y 2 ) que a veces es positivo (por ejemplo,
en el punto (2, 1)) y a veces negativo (por ejemplo, en el punto (1, 2)). La forma cuadrática es
entonces indefinida.
Por tanto, la función no es, en general, ni cóncava, ni convexa.
De igual manera que las funciones cóncavas/convexas se pueden identificar fácilmente con la
hessiana de la función, hay también un método similar para las funciones cuasi-cóncavas/cuasi-
convexas.
Teorema 8 Dada una función con dos variables f (x, y) que tiene parciales segundas continuas se con-
sideran los determinantes
0 1
@f @f
B 0
0 1 B @x @y C C
@f B C
B 0 C B C
B @x C B @ f @2
f @ 2
f C
B C
Q 1 = det B
B
C
C Q 2 = det B 2 C
@ @f B @x @x @x@y C
@2 f A B C
B C
@x @x 2 B C
@ @f @2 f @2 f A
@y @x@y @y 2
Entonces:
Nota 7 Estas condiciones son solo suficientes. Si no se cumplen, hay que usar la definición para com-
probar si una función es cuasi-cóncava o cuasi-convexa.
Ejemplo 17 Como aplicación del resultado anterior, se puede ver que una función de producción de ti-
po Cobb-Douglas es siempre cuasi-cóncava (de hecho, con rendimientos constantes o decrecientes a es-
cala es cóncava, mientras que si tiene rendimientos crecientes a escala es simplemente cuasi-cóncava).
Las derivadas parciales primera y segunda de una función Cobb-Douglas f (x, y) = x Æ y Ø , Æ, Ø > 0, son :
@f @f
= Æx ư1 y Ø = Øx Æ y ذ1
@x @y
@2 f @2 f @2 f
= Æ(Æ ° 1)x ư2 y Ø = Ø(Ø ° 1)x Æ y ذ2 = ÆØx ư1 y ذ1
@x 2 @y 2 @x@y
Entonces, la matriz hessiana es
0 1
@2 f @2 f
B C 0 Æ(Æ ° 1)x ư2 y Ø ÆØx ư1 y ذ1
1
B @x 2 @x@y C
B C @ A
H f (x, y) = B C=
B C
@ @2 f 2
@ f A ÆØx ư1 y ذ1 Æ Ø°2
Ø(Ø ° 1)x y
@x@y @y 2
En general se usa la palabra óptimo para referirse tanto a máximo como a mínimo. Optimizar
una función es buscar sus máximos y mínimos (locales o globales). Las figuras siguientes 3.20 y 3.21
muestran ejemplos de funciones con múltiples máximos y mínimos (locales y globales), la primera
con una función de una variable, y la segunda con una función de dos variables.
x sen(x)
Figura 3.20: Máximos y mínimos de la función de una variable f (x) =
5
Figura 3.21: Función de dos variables con múltiples máximos y mínimos, f (x, y) = sen(x °y)°2 cos(x)
6. Teorema de Weierstrass
Este teorema (como el de funciones de una variable) da condiciones que garantizan la existencia
de óptimos globales, aunque no da información sobre cómo calcularlos, o de dónde están situados.
La existencia de máximo y mínimo global está garantizada por el teorema de Weierstrass, ya que la
función es polinómica (luego es continua) y el conjunto es compacto: cerrado (contiene a toda su fron-
tera) y acotado (está contenido en la bola B ((0, 0), 10)). El mínimo global se alcanza en el punto (0, 0) y
vale f mı́n = 0. El máximo global se alcanza en los puntos (3, 3), (3, °3), (°3, 3), (°3, °3) y vale f máx = 18.
Ejemplo 19 Calcula los máximos y mínimos globales de la función f (x, y) = x + y en el conjunto com-
© ™
pacto S = (x, y) 2 R2 : x 2 + y 2 ∑ 4 .
p p
Como se observa en la figura 3.23 el pmáximo se alcanza en el punto ( 2, p2) y el
pvalor máximo de la
función en el conjunto S es f máx = 2 2. El mínimo
p se alcanza en el punto (° 2, ° 2) y el valor mínimo
de la función en el conjunto S es f mı́n = °2 2.
El siguiente resultado es de mucha utilidad cuando se utilizan las curvas de nivel para obtener los
óptimos globales.
El razonamiento sería como en funciones de una variable: en un punto en el que la función al-
canza un óptimo local el plano tangente (en general, hiperplano tangente) debe ser horizontal, con lo
que su ecuación es z = C . Como la ecuación general del plano tangente a la gráfica de una función de
dos variables es z = f (a, b) + r f (a, b) · (x ° a, y ° b), entonces el vector r f (a) debe ser nulo.
a) f (x, y) = x 2 + 3x y + y
@f @f
= 2x + 3y = 3x + 1
@x @y
1 2
2x + 3y = 0 3x + 1 = 0 ) x = ° y=
3 9
µ ∂
1 2
Solo hay un punto crítico (x § , y § ) = ° ,
3 9
b) f (x, y, z) = 5x 2 + x y + y + z 2
@f @f @f
= 10x + y = x +1 = 2z
@x @y @z
10x + y = 0 x + 1 = 0 2z = 0 ) x = °1 y = 10 z = 0
Hay un único punto crítico (x § , y § , z § ) = (°1, 10, 0)
c) f (x, y) = x ln(y)
@f @f x
= ln(y) =
@x @y y
x
ln(y) = 0 =0 ) x =0 y =1
y
Solo hay un punto crítico (x § , y § ) = (0, 1)
@f @f
= 2(x ° 1) = 2(y + 2)
@x @y
2(x ° 1) = 0 2(y + 2) = 0 ) x = 1 y = °2
Hay un único punto crítico (x § , y § ) = (1, °2)
e) f (x, y) = °x 2 ° (y ° 3)2
@f @f
= °2x = °2(y ° 3)
@x @y
°2x = 0 ° 2(y ° 3) = 0 ) x = 0 y = 3
Solo hay un punto crítico (x § , y § ) = (0, 3)
f) f (x, y) = x 2 ° y
@f @f
= 2x = °1
@x @y
2x = 0 ° 1 = 0 ) no tiene solución
Por tanto, no hay puntos críticos
g) f (x, y) = x 2 ° y 2
@f @f
= 2x = °2y
@x @y
2x = 0 ° 2y = 0 ) x = 0 y = 0
Solo hay un punto crítico (x § , y § ) = (0, 0)
h) f (x, y) = (x ° y)2
@f @f
= 2(x ° y) = °2(x ° y)
@x @y
2(x ° y) = 0 ° 2(x ° y) = 0 ) x = y y = cualquier valor
En este caso hay infinitos puntos críticos: todos los puntos de la forma
(x § , y § ) = (a, a) a : cualquier valor, a 2 R
Como tanto los máximos como los mínimos locales de una función son puntos críticos, harán
falta condiciones de segundo orden (con las parciales segundas) para discriminar los puntos estacio-
narios. Además, puede haber puntos críticos que no sean ni máximo, ni mínimo. A los puntos críticos
que no son óptimos se les denomina puntos de silla.
La figura 3.24 presenta el ejemplo típico (al que se debe el nombre de punto de silla). Como se
observa en la gráfica, en el punto crítico (0, 0) se maximiza la función cuando la aproximación al
punto es de abajo arriba, y se minimiza cuando la aproximación se hace de izquierda a derecha. En el
apartado g ) de los ejemplos 21 i 22 se discute formalmente esta función.
Teorema 12 (Condición suficiente de óptimo local) Sea f : S ! R una función con parciales segundas
continuas en un conjunto S µ Rn abierto, y sea a 2 S un punto crítico de dicha función. Entonces,
1. Si H f (a) es definida positiva, la función alcanza un mínimo local en a.
2. Si H f (a) es definida negativa, entonces f (x) ° f (a) < 0, es decir f (x) < f (a) y en a se alcanza
un máximo local.
Nota 9 Cuando la forma cuadrática es semidefinida hay un caso de duda. Si es semidefinida positiva,
puede tratarse de un mínimo local o de un punto de silla. Si es semidefinida negativa, puede ser un
máximo local o un punto de silla. En ambos casos para clasificar el punto crítico se debe hacer un
estudio local, comparando el valor de la función en el punto crítico con el valor en otros de su entorno
tomados en distintas direcciones.
Ejemplo 22 Clasifica los puntos críticos o estacionarios de las funciones del ejemplo 21.
a) f (x, y) = x 2 + 3x y + y
µ ∂
2 3
La matriz hessiana es H f (x, y) =
3 0
µ ∂ µ ∂
1 2 2 3
En el punto crítico vale H f ° , =
3 9 3 0
µ ∂
1 2
D 1 = 2 D 2 = °9 ) indefinida, luego en ° , hay un punto de silla
3 9
b) f (x, y, z) = 5x 2 + x y + y + z 2
0 1
10 1 0
La matriz hessiana es H f (x, y, z) = @ 1 0 0 A
0 0 2
0 1
10 1 0
En el punto crítico vale H f (°1, 10, 0) = @ 1 0 0 A
0 0 2
D 1 = 10 D 2 = °1 D 3 = °2 ) indefinida, luego en (°1, 10, 0) hay un punto de silla
c) f (x, y) = x ln(y)
0 1
1
B 0 y C
La matriz hessiana es H f (x, y) = B @ 1 x A
C
° 2
y y
µ ∂
0 1
En el punto crítico vale H f (0, 1) =
1 0
En este caso, como D 1 = 0 se deben calcular todos los menores principales. Los de orden 1 son
H1 = {0, 0} y solo hay uno de orden 2, H2 = {°1}. Por tanto, la forma cuadrática es indefinida,
luego en (0, 1) hay un punto de silla
e) f (x, y) = °x 2 ° (y ° 3)2
µ ∂
°2 0
La matriz hessiana es H f (x, y) =
0 °2
µ ∂
°2 0
En el punto crítico vale H f (0, 3) =
0 °2
D 1 = °2 D 2 = 4 ) definida negativa, luego en (0, 3) se alcanza un máximo local, y el valor
máximo de la función es f máx = f (0, 3) = 0
f) f (x, y) = x 2 ° y
Como en este caso no existen puntos críticos, la función no posee ni máximos ni mínimos
locales
g) f (x, y) = x 2 ° y 2
µ ∂
2 0
La matriz hessiana es H f (x, y) =
0 °2
µ ∂
2 0
En el punto crítico vale H f (0, 0) =
0 °2
D 1 = 2 D 2 = °4 ) indefinida, luego en (0, 0) hay un punto de silla
h) f (x, y) = (x ° y)2
µ ∂
°22
La matriz hessiana es H f (x, y) =
°22
µ ∂
2 °2
En un punto crítico (a, a) vale H f (a, a) =
°2 2
Figura 3.25: Una función con infinitos puntos críticos, todos mínimos, f (x, y) = (x ° y)2
9. Programas convexos/cóncavos
En el caso particular en que la función que se quiere optimizar es convexa (para mínimos) o cón-
cava (para máximos) la discusión es más fácil y, además, se obtienen resultados adicionales. El primer
resultado indica que no es necesario comprobar las condiciones de segundo orden.
Como el gradiente en el punto crítico se anula, se tiene que para todo x, a 2 S, f (x) ∑ f (a), con lo que
en a se alcanza un máximo. ⇤
Este resultado es útil en casos como el apartado h) del ejemplo 22. Como la matriz hessiana
µ ∂
2 °2
H f (x, y) =
°2 2
es semidefinida positiva en cualquier punto (x, y), la función es convexa. Entonces todos los puntos
críticos son mínimos (como se había visto, ver figura 3.25) y no hace falta realizar el estudio local.
@f @f
= °4x + 2y = 0 = °6y + 2x = 0
@x @y
1. Si la función f es estrictamente convexa y tiene mínimo, dicho valor mínimo (global) se alcanza
en un único punto.
2. Si la función f es estrictamente cóncava y tiene máximo, dicho valor máximo (global) se alcanza
en un único punto.
2
°y 2
Figura 3.26: Gráfica de la función f (x, y) = e °x