Tema 1. Introducción A Vectores: Información Tamaño Dirección Es Vector
Tema 1. Introducción A Vectores: Información Tamaño Dirección Es Vector
Introducción a vectores
Introducción
Los vectores son una de las herramientas matemáticas más utilizadas en la ingeniería.
Son utilizados en todos los ámbitos en donde existan fuerzas, movimientos, aceleraciones
o tensiones.
Se le llama vectores a todo aquello que tenga un tamaño (magnitud) y una dirección.
Si sólo tiene un tamaño se llama escalar, magnitud o valor absoluto, pero no es un vector.
Si únicamente se tiene la dirección, sin magnitud, se le llama vector unitario o sentido,
pero no es un vector.
Explicación
Eso da un total de 2 unidades hacia la derecha. Alguien puede pensar que los valores se
suman directamente, sin embargo los movimientos a la izquierda son contrarios a los de
la derecha, por lo tanto éstos deben restarse. No es necesario poner el signo negativo
pues ya sabemos que izquierda es lo contrario a la derecha.
Para los matemáticos es confuso usar izquierda o derecha y recordar que una es positiva
y otra negativa, por lo que prefieren llamarle a todo con un sólo nombre. De este modo, la
derecha seguirá siendo derecha:
Lo cual se entiende mucho más fácil, pero lo puedes simplificar todavía más. Estar
escribiendo “derecha” y “-derecha” puede ser muy cansado, así que los matemáticos le
llaman î, que es una “i” con un “gorrito”. Ese “gorrito” significa que la “i” está indicando una
dirección. Los matemáticos utilizan la “i” para referirse a izquierda-derecha, la “j” para
referirse a arriba-abajo y la “k” para referirse a “adelante y atrás”. A cada uno de esas
partes se le llama componente.
Por lo tanto, 2 î es un vector. El tamaño es “2” y la dirección es “î”. Y con esto se llega a la
primera regla que aprendemos de los vectores:
A los vectores les importa la dirección
Quiere decir que si me muevo a la derecha y luego a la derecha tengo que sumar. Si me
muevo a la derecha y luego a la izquierda, tengo que restar.
Ahora, supón que empiezas desde cero y que me muevo 5 unidades a la derecha, por lo
que la posición será:
Ahora, me muevo 3 unidades hacia arriba. Como no me he movido nada hacia la derecha
o izquierda la parte de “5i” se mantiene igual y se le agrega el movimiento hacia arriba,
quedando:
Debe notarse que el componente “5 ” se mantiene igual. Por lo que, puedes deducir la
siguiente regla de los vectores:
El vector:
Simplemente se suman los componentes “ ” con los “ ”, los “ ”, con los “ ” y los “ ”
Hasta ahora solo has visto cómo se representan los vectores en “ ”, “ ” y “ ”, es decir,
utilizando el plano cartesiano como referencia. Pero los vectores también se pueden
representar en coordenadas esféricas, cilíndricas, coloidales, etc. En este curso verás
únicamente coordenadas cartesianas, cilíndricas y esféricas.
En las coordenadas cartesianas ya viste que las tres direcciones son “x”, “y” y “z”. En
coordenadas cilíndricas se tienen r, θ y z. Mientras que en coordenadas esféricas se
tiene: ρ, θ y φ.
Cilíndricas a cartesianas
Cartesianas a esféricas
Cilíndricas a esféricas
Esféricas a cilíndricas
Cierre
Sumar y restar vectores es fácil, ya que sólo se suman las “x” con “x”, las “y” con “y” y las “z”
con “z” y listo. Pero la multiplicación es diferente. ¿Se multiplica todo contra todo? ¿Solo
las componentes que sean iguales? Para esto se tienen dos operaciones distintas, con
distinta metodología y resultado y que significan cosas muy diferentes.
Explicación
Se multiplican las “x” con “x”, las “y” con “y” y las “z” con “z” y el resultado se suma. Hay que
hacer notar que el resultado de un producto punto entre dos vectores, no es un vector,
pues se tiene un resultado numérico, pero no indica ninguna dirección.
Si un vector no tiene algún componente se considera que ese componente es igual a cero,
y por lo tanto desaparece de la suma. Por ejemplo:
Una utilidad del producto punto es obtener el ángulo entre dos vectores con la siguiente
ecuación:
El producto punto es utilizado cuando se quiere que los vectores estén sobre la misma
línea. Un ejemplo de esto es cuando se tiene un tren en una vía recta y se aplica una
vector de fuerza sobre el tren. El trabajo realizado por la fuerza va a ser el resultado del
producto punto entre la dirección de la fuerza y la dirección de la vía.
El producto cruz, también conocido como producto vectorial, es una forma de multiplicar
vectores que da como resultado otro vector. Este tipo de multiplicación es un poco más
compleja de realizar.
El producto cruz se basa en una serie de reglas que indican los resultados de las
multiplicaciones entre “ ”, “ ” y “ ”.
Las multiplicaciones de dos índices distintos, siempre tienen como resultado un índice
distinto a los multiplicados y tres de estas multiplicaciones son positivas y tres son
negativas, quedando:
Por lo tanto, un producto cruz entre dos vectores quedaría de la siguiente forma:
Se multiplican todos los términos de un lado contra todos los términos del otro:
El producto cruz da como resultado un vector que es perpendicular a los dos vectores
originales. Esto quiere decir que el nuevo vector está a 90° tanto del vector A como del
vector B.
El producto cruz puede ser interpretado como la magnitud del área entre el
paralelogramo de los dos vectores originales. Dicho de otra manera, si obtienes el valor
absoluto del resultado del producto cruz te dará el área que existe si se dibuja un
paralelogramo con los dos vectores originales, como se muestra en la siguiente figura:
Por lo tanto, del resultado del ejemplo anterior:
En caso de que se quiera el área del triángulo que hay entre los dos vectores originales y
que se muestra en la figura, sólo se tiene que dividir entre dos el resultado:
El triple producto escalar, es una operación que te permite obtener el volumen entre tres
vectores, siendo su ecuación:
En donde los vectores A y B forman el área y el vector C la altura.
En este caso si es importante el orden de las operaciones. Primero hay que hacer el
producto cruz y después se obtiene el producto punto con el resultado. Veamos el
siguiente ejemplo.
Cierre
Las operaciones de producto punto y producto cruz son un par de herramientas básicas
que serán de mucha utilidad para temas más avanzados. Con ellas se podrá obtener
ángulos entre vectores arbitrarios, áreas, volúmenes, fuerzas, etc. Aunque son temas
fáciles de comprender en teoría, requieren dominar muchos pasos sencillos y en caso de
alguna desconcentración, pueden ocurrir errores de procedimiento, por lo que hay que
trabajar de forma cuidadosa y metódica.
Tema 3. Funciones vectoriales básicas
Introducción
Las funciones vectoriales son funciones que dan el resultado en forma de vector. Son muy
útiles para situaciones en donde los vectores cambian a través del tiempo o del espacio.
Las funciones vectoriales se utilizan en análisis de fluidos, electricidad y magnetismo,
mecánica vectorial, diseño de mecanismos, etc. Siempre que se tenga un vector con una
representación física se podrán utilizar las funciones vectoriales para analizarlo.
Explicación
Supón que tienes un carro que va en línea recta en dirección “i”. El carro va cambiando su
velocidad de acuerdo a la ecuación:
V t
3[m/s] 0
7[m/s] 1
11[m/s] 2
15[m/s] 3
19[m/s] 4
En caso que se tenga la velocidad y se quiera saber en qué tiempo ocurrió, simplemente
se despeja la variable “t”. Supón que quieres saber cuándo el carro va a tener la velocidad
de 25[m/s]:
A los 5.5 segundos se tiene la velocidad deseada.
Una función vectorial también puede depender de la posición. Piensa en el ejemplo del
resorte. La función de fuerza de un resorte está dada por la ecuación:
En donde “k” es una constante cualquiera. Supón que k= 5, para que la ecuación sea:
Esta ecuación indica cual es la fuerza en “i” según la posición “x”. Por lo tanto, si conoces la
posición de “x” sabrás el valor y la dirección de la fuerza.
No siempre el valor de “i” tiene que estar junto con “x”, puede estar junto con “y” o con “z”.
Por ejemplo, el viento que sopla en una ciudad tiene una ecuación como esta:
Lo que quiere decir, que el viento va en dirección “i” (derecha) y que aumenta conforme
aumenta la altura. Para una altura de y = 10 se tiene que:
3.2 Funciones vectoriales en dos y tres dimensiones
Ahora piensa que tienes el valor del vector y que quieres obtener los valores de “x”, “y”, y
“z”:
Para resolver esta ecuación lo que hay que hacer es resolver cada componente de
manera individual, quedando:
Ahora, tienes un sistema de 3 ecuaciones con 3 incógnitas, por lo tanto lo puedes resolver
por sustitución:
Cierre
Esto tiene una aplicación directa con todo lo que tenga que ver con
movimiento, mecánica y sistemas con aceleración constante; por lo
que es base matemática en la que se fundamenta la exploración
espacial, la aerodinámica y la robótica precisión.
Explicación
Las ecuaciones de movimiento en tres dimensiones, tienen por lo regular sólo una
variable independiente que es el tiempo. Las funciones vectoriales del
movimiento muestran cuál es la posición o la velocidad de algún objeto en las tres
dimensiones espaciales, según va cambiando el tiempo.
Para saber la posición de dicho objeto en un tiempo dado, sólo hay que sustituir el valor
de “t”. Si quieres saber cuál es la posición en t=2, haces lo siguiente:
Una ventaja de tener sólo una variable es que al saber el valor de alguna componente, se
puede saber el valor del tiempo y por lo tanto el valor de las demás componentes. Por
ejemplo, si se sabe que el valor de la componente “i” es 6 y se desconocen los otros dos,
se puede despejar el valor de “t”:
Sabiendo que el valor del tiempo es 3, se puede sustituir en los otros dos componentes y
obtener la posición completa del objeto:
Si se tienen dos tiempos, se puede obtener cuál fue el desplazamiento total y la velocidad
promedio entre las dos posiciones. Para obtener el desplazamiento primero hay que
evaluar los puntos según los tiempos dados. Supón que quieres conocer el
desplazamiento y la velocidad promedio que ocurre entre el t=1 y el t=5. Primero obtienes
los puntos en los tiempos indicados:
Una vez teniendo el desplazamiento, para obtener la velocidad promedio entre estos dos
puntos se divide entre el tiempo:
Para obtener la velocidad promedio entre dos puntos se puede utilizar el método anterior
u obtener directamente el promedio de las velocidades a partir de la ecuación de
velocidad. Supón que quieres conocer la velocidad promedio de t=1 a t=2.
También se puede obtener calculando la velocidad en t=1 y en t=2.
Y el resultado debe de ser el mismo, en caso de que no lo sea, quiere decir que la
ecuación de la velocidad está incorrecta.
Cierre
El movimiento en el espacio es una función vectorial de una sola variable, por lo que es
uno de los casos más simples. Es importante comprender cómo se trabaja con funciones
vectoriales y recordar las ecuaciones de movimiento.
Tema 5. Campos vectoriales
Introducción
Los campos vectoriales son un caso particular de las funciones vectoriales. Si se entiende
un campo vectorial, se pueden saber los valores de los vectores de cada punto en el
espacio. Esto tiene aplicación directa con electrodinámica, mecánica de fluidos, topología,
etc. Imaginemos el océano y la velocidad de sus mareas. Cada punto en el océano tiene
una velocidad determinada y esta velocidad cambia con el tiempo. Si le tomáramos una
“foto” a las velocidades en un momento fijo se obtendría el campo vectorial de las
velocidades del océano, aplicando las ecuaciones matemáticas se puede ver en dónde hay
fuentes de agua, en dónde hay corrientes fuertes y en dónde están los remolinos.
Explicación
La palabra campo quiere decir, en matemáticas, un espacio en el que todos los puntos
tienen un valor. Por lo tanto, un campo vectorial es un espacio en el que todos los puntos
dentro de este espacio tienen un vector asignado.
Un claro ejemplo puede ser la velocidad del agua en el océano, no importa en qué punto
del océano te encuentres, puedes encontrar el vector de velocidad del agua en ese punto.
Incluso en donde el agua está completamente quieta, se le puede asignar un valor
vectorial de cero. Lo anterior se muestra en la ilustración 1:
Ilustración 1: Espacio vectorial de las corrientes marinas
Imagen obtenida de [Link] Solo
para fines educativos.
Los campos vectoriales se expresan utilizando las variables “x”, “y” y “z” para describir las
posiciones y la notación vectorial para describir el valor del vector. Por ejemplo:
Esto quiere decir, que el vector tendrá un componente “i” que dependerá de “x” y de “y”,
un componente “j” que dependerá de “y” y de “z” y un componente en “k” que dependerá
sólo de “z”. Si te colocas en el punto (3, 1, 4), se harán las siguientes operaciones:
Cuando se tienen dos campos vectoriales al mismo tiempo, el campo vectorial resultante
será la suma de los dos campos. Por ejemplo, si se tienen los dos campos:
Cierre
Las funciones de múltiples variables son más cercanas a la realidad que las funciones de
una sola variable. Por ejemplo, el consumo de gasolina de un carro no sólo depende de la
distancia que recorra, sino de la masa que lleve y la velocidad a la que se maneja.
Explicación
Una función multivariable es una función que tiene dos o más variables independientes.
Esto quiere decir que para conocer el consumo total de combustible debo de conocer el
valor de estas tres variables.
Se llama derivada de orden superior a las derivadas que se aplican dos o más veces sobre
una misma función. Por ejemplo, la aceleración es una derivada de orden superior de la
posición, porque hay que derivar la posición dos veces para obtener la aceleración.
Todas las “y” se toman como constante. Para obtener la segunda derivada con respecto a
“x”, simplemente se vuelve a derivar de la misma forma.
También es posible obtener la doble derivada de una función, al derivarla primero con
respecto a una variable y después con respecto a la otra. Por ejemplo, derivar primero
con respecto a “x”, para después derivar con respecto a “y”, como se muestra aquí:
Ahora, si derivamos en el otro orden, primero derivado con respecto a “y” para después
derivar con respecto a “x”, obtendremos:
Si se observa los dos resultados son exactamente iguales. Esto sucederá con todas las
funciones que sean continuas y que sean derivables. No importa en qué orden se hagan
las derivadas, se tiene que obtener el mismo resultado. Esto es conocido como el teorema
de Schwartz.
Cierre
Los procesos básicos de las derivadas parciales serán la base de todo el conocimiento que
se adquirirá en el resto del curso. Se utilizarán las mismas reglas que las derivadas de
funciones de una variable, pero aplicadas en funciones multivariables.
Regresando al ejemplo del consumo de gasolina, con las herramientas vistas, se puede
saber cómo cambia el consumo con respecto a un cambio de la velocidad, pero también
cómo cambia el consumo de gasolina con respecto a un cambio en dos variables distintas,
como pueden ser la velocidad y el peso.
Tema 7. Derivada direccional y vector gradiente
Introducción
Cuando se tiene un campo escalar, este campo puede tener cambios en distintas
coordenadas. Los cambios de un campo escalar pueden ser vistos como vectores; para
obtener estos vectores se utiliza una herramienta llamada gradiente.
Explicación
Cuando tenemos una función de una variable la derivada indica el cambio de esta función,
como se muestra en la siguiente gráfica.
Sin embargo, si tenemos una función de dos o más variables se tendrán distintas
derivadas por cada variable. En este caso, el cambio de función va a ser una combinación
de las derivadas de cada función.
La respuesta a esta pregunta es que la derivada de una función de dos o más variables
debe ser vectorial, y los vectores pueden ser negativos en una dirección y positivos en
otra.
Esto quiere decir que se obtendrán las derivadas parciales de las tres coordenadas, y se
les asignará el vector correspondiente a cada una de ellas.
Por ejemplo:
Si tomamos la siguiente función:
El operador nabla se puede aplicar en funciones vectoriales, ya sea como producto punto
o como producto cruz.
El resultado sería:
7.2 Rotacional
El rotacional es el producto cruz del operador nabla con la función. Como todos los
productos cruz, el resultado debe ser también un vector que sea perpendicular a los
vectores y a su cambio.
El rotacional representa algo así como los remolinos que existen en un campo vectorial,
por lo que si vemos un campo vectorial en donde los vectores están dando vuelta
alrededor de un mismo punto, el rotacional debe ser distinto de cero. En caso que en un
campo vectorial no existan remolinos, el rotacional debe ser igual a cero.
Cierre
Las derivadas de funciones multivariables pueden ser obtenidas de distintas formas y con
diversos significados. Estos resultados son la base de todas las leyes de Maxwell, que
rigen las interacciones electrodinámicas, así como lo relacionado con electrónica,
electricidad y magnetismo. Estas herramientas son muy utilizadas en todo lo que tiene
que ver con fluidos, ya sean gaseosos o líquidos.
Tema 8. Mínimos y máximos
Introducción
Explicación
Cuando una función está en un máximo, esto quiere decir que si la función se mueve un
poco hacia cualquier parte, el valor de esta va a disminuir. Cuando esto sucede sabemos
que la derivada debe de ser cero en cualquier dirección.
Cuando una función está en un mínimo, esto quiere decir que si la función se mueve un
poco hacia cualquier parte, el valor de esta va a aumentar. En este caso también la
derivada es igual a cero.
Incluso hay ocasiones en que la derivada en todas direcciones puede ser cero y no ser un
máximo ni un mínimo. A estos puntos se les conoce como puntos silla.
Se sabe de los cursos de cálculo básico que cuando la derivada es cero se encuentra un
máximo, un mínimo o un punto silla, también llamados puntos críticos, así que se iguala la
derivada a cero:
Esto quiere decir que cuando esa función se cumpla, la derivada en “x” será cero. Pero
existe un número infinito de puntos que tienen esas características: (1,-1), (1.25,-2), (2.6,-
5), etc. Estos puntos no son necesariamente el máximo o el mínimo de la función.
Ahora tendremos que determinar si estos puntos críticos son un máximo, un mínimo o un
punto silla.
En una derivada de una variable, para determinar eso, se obtiene la segunda derivada. En
este caso tenemos tres derivadas dobles: derivada doble con respecto a “x”, derivada
doble con respecto a “y” y derivada con respecto a “x” y “y”. Para saber si los puntos
encontrados son máximos o mínimos, se tiene que obtener estas tres derivadas y luego
hacer una operación con ellas:
Ahora con esto se evalúa en los puntos encontrados y se siguen las siguientes reglas:
a. Si D>0, es un mínimo
b. Si D>0, es un máximo
c. Si D<0 es un punto silla
d. Si D=0 no se puede saber si es un máximo, mínimo o punto silla
Aquí también “D” es negativo, por lo que este punto también es punto silla.
Cierre
Los máximos y mínimos vectoriales son la primera gran aplicación que se puede obtener
de las derivadas parciales. Esto nos permite optimizar resultados, lo cual es muy útil en la
vida laboral de cualquier ingeniero. No importa qué industria o en qué área se trabaje,
siempre se buscarán obtener los mejores resultados posibles con el mínimo gasto
necesario.
Tema 9. Integración múltiple
Introducción
Explicación
Hay que hacer notar que la antiderivada genera una constante, pero dado que se
considera a las “y” como constante en la operación, esta constante puede ser una función
de “y”.
A partir de las antiderivadas se pueden hacer las integrales. La diferencia entre una
antiderivada y una integral es que la integral tiene valores definidos a evaluar y la
antiderivada no. Tomando la misma función con la que se trabajó anteriormente:
Se obtendrá la integral de 2 a 6:
Dado que no se tiene un valor fijo de “y”, el resultado se queda expresado en función de
esta variable.
Supongamos ahora que se hace una integral doble que va de 2 a 6 en “x” y de 0 a 3 en "y".
9.3 Integrales múltiples con relación de variables
Las integrales pueden tener los límites definidos en función de otra variable. Por ejemplo,
se puede tomar una función e integrar en “x” de 0 hasta “3y” de la siguiente forma:
Cierre
Explicación
Para obtener la integral en coordenadas cartesianas (x, y, z), se utilizan los diferenciales de
cada variable (dx, dy, dz). Cuando se cambia de coordenadas se tiene que cambiar
también de diferenciales.
Aquí se mostrará cómo son los diferenciales de las coordenadas cilíndricas, también
conocidas como polares.
Y de cilíndricas a cartesianas:
Sabemos que:
Con esta información se puede saber que la derivada de área en coordenadas cartesianas
se representa de cualquiera de las siguientes formas:
Y la derivada de volumen:
Siempre que se vaya a realizar una integral en coordenadas cilíndricas se tienen que
utilizar estos diferenciales. Por lo tanto, si quiero integrar la siguiente función en un
cilindro completo de radio 3 y altura 4 quedaría expresado de la siguiente manera:
Cierre
Las integrales cilíndricas se basan en los mismos principios que las integrales cartesianas.
La característica que hace especial a las integrales cilíndricas es que su diferencial es
distinto al de las cartesianas. Es a partir de este principio que se pueden obtener
volúmenes de cilindros y áreas de superficies curvas o con simetría radial.
Tema 11. Integrales en coordenadas esféricas
Introducción
Todos los días nos encontramos ante fenómenos como luz y sonido
sin pensar mucho en ello. La cantidad de luz que emite un foco, la
cantidad de sonido que emite una bocina o cómo se expande el aire
en una explosión son algunas situaciones que se pueden estudiar
con las integrales esféricas.
Explicación
Las integrales esféricas se definen como aquellas integrales en las que se utilizan las
coordenadas esféricas como coordenadas base. Esto hace que las variables con que se
trabaje sean r, θ, φ. También provoca que el diferencial de área y de volumen tenga
características propias de este sistema de coordenadas.
Las integrales esféricas siguen las mismas reglas de integración que todas las otras
integrales, la diferencia está en cómo plantear el diferencial de área y el diferencial de
volumen.
Recordando brevemente:
Cuando las coordenadas esféricas se mueven en “r” indican el radio de la esfera, pero
cuando los movimientos son en “θ” o “φ” se indican las coordenadas de la esfera.
Si se tiene una esfera hay tres diferenciales de área que se pueden obtener. El primero es
el área de una superficie con un radio constante. Este diferencial de área se expresa así:
Esto indica que si se tiene que integrar una función sobre la superficie de una esfera, se
tiene que utilizar todo ese diferencial para realizar la integral. En este caso la variable "r"
es una constante y no se verá afectada por la integral.
Si se desea hacer una integral sobre una pared lateral de la esfera, es decir, con \theta
constante, la integral de área será:
En este caso la variable θ al ser constante deberá tener un valor específico, mientras que
"r" será una variable que se verá afectada por la integral también.
En el caso que φ sea constante el diferencial de área se expresará de la siguiente forma:
Como ejemplo podemos calcular la masa de una esfera de cierto material cuya densidad
este dada por la ecuación:
Esto quiere decir que es muy denso en el centro cuando la “r” es muy pequeña y menos
denso en la superficie, cuando la “r” es grande. Supongamos que tenemos una esfera de 2
metros de radio, entonces la ecuación quedaría de la siguiente manera:
En otro ejemplo podemos calcular la energía total que hay en una explosión cuando la
onda expansiva es de 5 metros y la función de la energía es 1/r2 joule.
Cierre
A través de estas integrales se puede obtener la energía total que emite un foco o cuánto
aire es desplazado en una explosión. Cualquier fenómeno que tenga características
radiales puede ser analizado con las integrales esféricas.
Tema 12. Teorema de Green
Introducción
Explicación
La integral lo que indica es una integral sobre todo el perímetro de una figura
cerrada.
El teorema de Green muestra cómo hacer una integral de línea sobre todo un perímetro a
través de una integral de área.
Como se ve se llega a la misma solución por los dos métodos. El primer método es más
largo, pero todas las integrales son sencillas, en el segundo método se hacen menos
operaciones pero son integrales de área.
Una matriz es una forma de representar las ecuaciones lineales de forma compacta y
ordenada. El determinante es el valor absoluto de una matriz, en otras palabras, es
reducir toda la matriz a un solo número. Esto sirve para obtener ciertas propiedades de la
matriz y es un valor muy utilizado en distintos métodos de solución de matrices. Por
ejemplo, en el tema 2 y 7 utilizaste el producto cruz entre dos vectores, o bien entre el
operador nabla y una función vectorial, el producto cruz es básicamente un determinante,
esto es un ejemplo de su basta importancia en el mundo de las matemáticas, la física y la
ingeniería.
La matriz inversa es una matriz que al multiplicarse por la matriz original da una matriz
identidad. Es decir, una matriz cuyo determinante sea 1.
Explicación
El determinante es un número que indica el valor total de una matriz y solo puede
obtenerse de matrices cuadradas.
Obtener el determinante de una matriz es sencillo pero conlleva muchos pasos.
Para una matriz 2X2 es muy fácil obtenerlo, solo hay que seguir la fórmula.
Su determinante será:
Para matrices de orden superior a 3 hay ciertos métodos más avanzados para obtener el
determinante, que no se verán en este curso. Lo importante es hacer notar que toda
matriz cuadrada tiene un determinante único.
Con las matrices se trabaja sobre la misma idea aunque la aplicación es un poco más
complicada.
La inversa de una matriz es aquella que al multiplicarse por la matriz original de cómo
resultó la matriz identidad (que es una matriz con únicamente unos en su diagonal
mayor).
Para poder identificar la matriz identidad demos un repaso de cómo multiplicar matrices.
• Para multiplicar matrices la primera matriz tienen que tener la misma cantidad de
columnas que los renglones de la segunda matriz. Si se van a multiplicar matrices
cuadradas, únicamente pueden ser del mismo tamaño.
Por ejemplo:
Cierre
El determinante de una matriz 2X2 se puede obtener de manera casi trivial y el de una
matriz 3X3 requiere un poco más de cálculos. Los determinantes de matrices muy
grandes se pueden obtener, pero se requieren métodos que salen de los alcances de este
curso.
El determinante es un valor fundamental que sirve para poder encontrar los valores de las
incógnitas en las variables que representan las matrices. La matriz inversa es importante
porque sirve también para encontrar los valores de la matriz original.
D.R.© Universidad Tecmilenio®
Tema 14. Método de la inversa y Regla de Cramer
Introducción
Explicación
Ya sabemos lo que significa la inversa de una matriz. Ahora vamos a ver cómo obtener el
valor de dicha matriz inversa. Para esto se debe entender antes qué es la transpuesta y
qué son los cofactores.
La transpuesta es una operación matricial muy sencilla que consiste en cambiar los
renglones por las columnas. Por ejemplo si tengo la matriz:
Su transpuesta será:
Ahora se explicarán los cofactores. El cofactor de una matriz, es una matriz del mismo
tamaño, en donde cada elemento se sustituye por el determinante de los elementos que
no estén en el renglón ni en la columna del elemento original. Por ejemplo, si se tiene la
matriz:
Para obtener la matriz de cofactores se comienza por la posición (1,1) y se sustituye por el
determinante de todo lo que no esté en el renglón 1 ni en la columna 1, es decir:
Luego, si la suma del renglón más la columna del elemento a sustituir es par se deja como
está el resultado y si es no se le cambia de signo. En este caso estamos en el renglón 1 y
en la columna 1 por lo que la suma es 2. Entonces se deja el signo tal cual. Por lo tanto el
primer elemento quedaría.
Para encontrar el valor de cada variable la regla de Cramer indica que hay que obtener el
determinante de la matriz sustituyendo la columna de la variable deseada con la columna
de resultados y dividirlo entre el determinante de la matriz original.
Por ejemplo para obtener el valor de las x, se sustituye la primera columna, que es la de
las x con la columna de resultados y se obtiene el determinante:
Entonces:
Por lo tanto:
Cierre
El método de la inversa sirve para obtener la inversa de una matriz cuadrada. Esto es de
gran utilidad para encontrar ciertas propiedades de las matrices. El hecho de que una
matriz sea invertible quiere decir que las ecuaciones lineales que representan la matriz
tienen una solución única, no nula.
El método de Gauss es uno de los métodos más sencillos y eficientes para encontrar la
solución a las matrices, esto lo hace el método más utilizado para resolver matrices a nivel
de software, debido a que los pasos a seguir son altamente predecibles. Requiere de
únicamente operaciones básicas a diferencia de otros métodos y encuentra las soluciones
exactas.
El método utiliza el mismo principio del método de la eliminación que se utiliza para
resolver sistemas de ecuaciones lineales
Explicación
El método de Gauss nos permite resolver ecuaciones lineales con muchas incógnitas de
manera eficiente.
Lo primero que debemos hacer es tomar el elemento (1,1) y dividir todo el renglón para
que sea 1
Lo siguiente es multiplicar por algo para que el elemento (1,1) de el mismo valor que los
elementos que están debajo y luego restar los renglones. La idea es hacer que todos los
números debajo del elemento (1,1) sean 0.
Vamos a hacerlo para el segundo renglón. Como debajo hay un 1 no hay que multiplicar
nada, solo vamos a restar los valores del segundo renglón menos los del primero
Ahora hagamos lo mismo para el tercer renglón. Aquí el número que está debajo es un 3
por lo que vamos a multiplicar el primer renglón por 3 y restárselo al tercer renglón.
Ahora se buscarán hacer 0 todos los elementos que estén arriba y debajo de (2,2), para
esto se utilizará la misma técnica que antes de multiplicar el segundo renglón por un
factor y restar el segundo renglón a todos los demás.
Ahora se multiplicará todo el tercer renglón para que el elemento (3,3) sea igual a 1.
Ahora se buscará que todos los elementos que estén arriba del (3,3) sean 0. Para esto se
multiplicará el tercer renglón por el factor correspondiente y se restará a los renglones
uno y dos. Hagamos esto con el segundo renglón, primero multiplicamos al tercer renglón
por 3/5 y luego se lo sumamos al segundo renglón.
Siendo el resultado
Cierre
Un ejemplo de esto es analizar el flujo de tráfico en una red de calles que se cruzan unas
con otras. Conociendo el porcentaje de coches que suelen pasar de una calle a otra en
cada intersección, se puede montar un sistema de ecuaciones lineales que, siendo
resuelto mediante el método de Gauss, permite hacer un cálculo de la cantidad de tráfico
que va a soportar cada calle y tomar las medidas oportunas (temporización de los
semáforos, colocación de pasos de cebra o señales de stop).