1 Conceptos Fundamentales
En esta sección, esbozamos los conceptos fundamentales de la fı́sica newtoniana
sin utilizar ningún sistema de coordenadas o vectores base. Este es el punto de
vista geométrico que abogamos.
El espacio para las leyes de Newton de la fı́sica es un espacio-tiempo com-
puesto del familiar espacio euclidiano tridimensional de la experiencia cotidiana
(al que llamamos espacio 3D) y un tiempo universal t. Denotamos puntos (ubi-
caciones) en el espacio tridimensional mediante letras mayúsculas en cursiva,
como P y Q. Estos puntos y el espacio tridimensional en el que viven no re-
quieren coordenadas para su definición.
Un escalar es un número único. Nos interesan especialmente los escalares
que representan directamente cantidades fı́sicas (por ejemplo, la temperatura
T ). Ası́, son números reales, y cuando son funciones de una ubicación P en el
espacio (por ejemplo, T (P)), los llamamos campos escalares. Sin embargo, a
veces trabajaremos con números complejos, sobre todo en la mecánica cuántica,
pero también en varias representaciones de Fourier de la fı́sica clásica.
Un vector en el espacio tridimensional euclidiano puede considerarse como
un segmento recto (o más formalmente como un segmento de lı́nea dirigido) que
se extiende de un punto, P, a otro, Q (por ejemplo, la flecha ∆x en la Fig.
1.1a). De manera equivalente, ∆x puede considerarse como una dirección en P
y un número, la longitud del vector. A veces seleccionamos un punto O en el
espacio tridimensional como un “origen” e identificamos todos los otros puntos,
por ejemplo, Q y P, mediante sus separaciones vectoriales ⃗xQ y ⃗xP desde ese
origen.
La distancia euclidiana ∆σ entre dos puntos P y Q en el espacio tridimen-
sional puede medirse con una regla y, por supuesto, no requiere ningún sistema
de coordenadas para su definición. (Si uno tiene un sistema de coordenadas
cartesiano, entonces ∆σ puede calcularse con la fórmula pitagórica, un precur-
sor del intervalo invariante del espacio-tiempo plano; Sec. 2.2.3.) Esta distancia
∆σ es también la longitud |∆x| del vector ∆x que se extiende desde P hasta Q,
y el cuadrado de esa longitud se denota como
|∆x|2 = (∆x)2 = (∆σ)2 .
De particular importancia es el caso en el que P y Q son puntos vecinos y ∆x
es una cantidad diferencial (infinitesimal) dx. Este desplazamiento infinitesimal
es una cantidad fı́sica más fundamental que el ∆x finito. Para crear un vector
finito a partir del ...
Para sumar varios vectores infinitesimales, se deben agregar varios vectores
infinitesimales de cola a cabeza, y ası́ sucesivamente, y luego tomar un lı́mite.
Esto implica trasladar un vector de un punto al siguiente. No hay ambigüedad
al hacer esto en el espacio euclidiano plano utilizando la noción geométrica de
paralelismo.1 Podemos unir la cola de un segundo vector a la cabeza del primero
1 Esta simple propiedad del espacio euclidiano nos permite sumar (y restar) vectores en un
punto.
1
y luego construir la suma como el vector desde la cola del primero hasta la cabeza
del segundo, o viceversa, como deberı́a ser bastante familiar. El punto es que
no necesitamos agregar los componentes cartesianos para sumar vectores.
También podemos rotar los vectores sobre sus colas apuntándolos a lo largo
de una dirección diferente en el espacio. Tal rotación puede especificarse por
dos ángulos. El espacio definido por todos los posibles cambios de longitud y
dirección en un punto se llama el espacio tangente en ese punto. Nuevamente,
en general, vemos la rotación como aquella de un vector fı́sico en el espacio, y no
como, a menudo se imagina, la rotación de algunos vectores base de un sistema
de coordenadas, mientras que el propio vector elegido permanece fijo.
También podemos construir una trayectoria a través del espacio colocando
una secuencia de desplazamientos infinitesimales, de cola a cabeza, uno tras
otro. El resultado es una curva a la que estos desplazamientos dx son tangentes
(Fig. 1.1b). La curva puede denotarse P(λ), con λ un parámetro a lo largo
de la curva y P(λ) el punto en la curva cuyo valor del parámetro es λ, o ⃗x(λ)
donde ⃗x es la separación vectorial de P desde el origen arbitrario O. Los vec-
tores infinitesimales que trazan la curva son dx = (dP/dλ) dλ = (dx/dλ) dλ, y
dP/dλ = dx/dλ, que es el vector tangente a la curva.
Si la curva seguida es la de una partı́cula, y el parámetro λ es el tiempo t, en-
tonces hemos definido la velocidad ⃗v = dx/dt. En efecto, estamos multiplicando
el vector dx por el escalar 1/dt y tomando el lı́mite. Realizar esta operación en
cada punto P del espacio ocupado por un fluido define el campo de velocidad
del fluido ⃗v (⃗x). Multiplicando la velocidad ⃗v de la partı́cula por su masa da su
momento p⃗ = m⃗v . De manera similar, la diferencia de ...
de dos mediciones de velocidad durante un intervalo de tiempo dt, multipli-
cado por 1/dt, genera la aceleración de la partı́cula ⃗a = dv/dt. Multiplicar por
la masa de la partı́cula da la fuerza F⃗ = m⃗a que produjo la aceleración; dividir
la fuerza generada eléctricamente por la carga de la partı́cula q da el campo
eléctrico E⃗ = F⃗ /q. Y ası́ sucesivamente.
Podemos definir productos internos [ver Ec. (1.4a) abajo] y productos cruza-
dos [Ec. (1.22a)] de pares de vectores en el mismo punto geométricamente; us-
ando esos vectores podemos definir, por ejemplo, la tasa de trabajo realizado
por una fuerza y el momento angular de la partı́cula respecto a un punto.
Estos dos productos pueden expresarse geométricamente de la siguiente man-
era. Si permitimos que los dos vectores definan un paralelogramo, entonces su
producto cruzado es el vector ortogonal al paralelogramo con longitud igual al
área del paralelogramo. Si primero rotamos un vector a través de un ángulo
recto en un plano que contiene al otro, y luego definimos el paralelogramo, su
área es el producto interno de los vectores.
También podemos definir derivadas espaciales. Asociamos la diferencia de
un escalar entre dos puntos separados por dx al mismo tiempo con un gradiente
y, de igual manera, podemos definir la divergencia escalar y el rizo vectorial.
La libertad de trasladar vectores de un punto a otro también subyace en la
asociación de un solo vector (p. ej., momento) con un grupo de partı́culas o
un cuerpo extendido. Simplemente se suman todos los momentos individuales,
2
tomando un lı́mite cuando sea necesario.
De esta manera (que deberı́a ser familiar para el lector y será elucidada, for-
malizada y generalizada más adelante), podemos construir todos los escalares
y vectores estándar de la fı́sica newtoniana. Lo importante es que estas can-
tidades fı́sicas no requieren un sistema de coordenadas para su definición. Son
objetos geométricos (independientes de coordenadas) que residen en el espacio
euclidiano 3D en un instante particular.
Es un principio fundamental (aunque a menudo ignorado) de la fı́sica que las
leyes fı́sicas newtonianas son todas expresables como relaciones geométricas en-
tre estos tipos de objetos geométricos, y estas relaciones no dependen de ningún
sistema de coordenadas u orientación de ejes, ni de ningún marco de referencia
(es decir, de algún marco supuestamente válido del espacio euclidiano en el que
se realizan las mediciones).2
1.1 1.3 Álgebra Tensorial sin un Sistema de Coordenadas
En preparación para desarrollar nuestra visión geométrica de las leyes fı́sicas,
ahora introducimos, de una manera libre de coordenadas, algunos conceptos
fundamentales de geometrı́a diferencial: tensores, el producto interno, el tensor
métrico, el producto tensorial y la contracción de tensores.
Ya hemos definido un vector A como una flecha recta desde un punto, dig-
amos P , en nuestro espacio a otro, digamos Q. Debido a que nuestro espacio
es plano, hay una manera única y obvia de transportar tal flecha de una ubi-
cación a otra, manteniendo su longitud y dirección. Esto nos permite ignorar la
cuestión de dónde en el espacio reside realmente un vector; está completamente
determinado por su dirección y su longitud.
Un tensor de rango n es, por definición, una función real lineal de n vectores.
Un tensor T tiene n slots, en el cual se insertan los vectores, y una salida, que
produce un único número real: el valor que el tensor T tiene cuando se evalúa
como una función de los n vectores insertados. Notacionalmente denotamos el
tensor por una letra sans-serif en negrita T:
T (,,,) (1)
n slots en los que poner los vectores
Esta definición de un tensor es muy diferente (y mucho más simple) que la
que se encuentra en la mayorı́a de los libros de texto de fı́sica estándar (por
ejemplo, Marion y Thornton, 1995; Jackson, 1999; Griffiths, 1999). Allı́, un
tensor es una matriz de números que se transforman de una manera particular
bajo rotaciones. Veremos la conexión entre estas definiciones en la Sección 1.6
a continuación.
Para ilustrar este enfoque, si T es un tensor de rango 3 (tiene 3 slots) como
en la Fig. 1.2, entonces su valor en los vectores A, B, C se denota T(A, B, C).
2 A este principio lo llamamos el Principio Geométrico para las leyes de la fı́sica, y lo
usamos a lo largo de este libro. Es el análogo newtoniano del Principio de Relatividad de
Einstein (Sec. 2.2.2).
3
La linealidad de esta función se puede expresar como
T(eE + f F, B, C) = eT(E, B, C) + f T(F, B, C). (2)
donde e y f son números reales, y de manera similar para el segundo y tercer
slots.
Ya hemos definido la longitud al cuadrado (A)2 ≡ A2 de un vector A como
el cuadrado de la distancia entre los puntos en su cola y su punta. El producto
interno (también llamado producto punto) A · B de dos vectores se define en
términos de esta longitud al cuadrado por
1
A·B≡ [(A + B)2 − (A − B)2 ]. (3)
4
En el espacio euclidiano, este es el producto interno estándar, familiar de
la geometrı́a elemental y discutido anteriormente en términos del área de un
paralelogramo.
2 El tensor métrico y operaciones tensoriales
Se puede demostrar que el producto interno (1.4a) es una función lineal real de
cada uno de sus vectores. Por lo tanto, podemos considerarlo como un tensor
de rango 2. En otras palabras, el producto interno se denota como g( , ) y se
llama tensor métrico. Es decir, el tensor métrico g es esa función lineal de dos
vectores cuyo valor está dado por:
g(A, B) ≡ A · B. (4)
Nótese que, debido a que A · B = B · A, el tensor métrico es simétrico en sus
dos ranuras: se obtiene el mismo número real independientemente del orden en
que se inserten los dos vectores en las ranuras:
g(A, B) = g(B, A). (5)
Con la ayuda del producto interno, podemos considerar cualquier vector A
como un tensor de rango uno: el número real que se produce cuando un vector
arbitrario C se inserta en la única ranura de A es:
A(C) ≡ A · C. (6)
En fı́sica newtoniana, rara vez encontramos tensores de rango superior a
dos. Sin embargo, los tensores de segundo rango aparecen frecuentemente, a
menudo en roles donde se inserta un solo vector en la segunda ranura y se deja
la primera ranura vacı́a, produciendo ası́ una entidad de una sola ranura, un
vector. Un ejemplo que encontramos en la Sección 1.1.1 es el tensor de inercia
I( , ) de un cuerpo rı́gido, que nos da el momento angular J( ) = I( , Ω) del
cuerpo cuando se inserta su velocidad angular Ω en su segunda ranura. Otro
ejemplo es el tensor de tensiones de un sólido, un fluido, un plasma, o un campo
(Sección 1.9 a continuación).
4
A partir de tres vectores A, B, C, podemos construir un tensor, su producto
tensorial (también llamado producto exterior en contraposición al producto in-
terno A · B), definido como sigue:
A ⊗ B ⊗ C(E, F, G) ≡ A(E)B(F )C(G) = (A · E)(B · F )(C · G). (7)
Aquı́, la primera expresión es la notación para el valor del nuevo tensor
A ⊗ B ⊗ C evaluado en los tres vectores E, F , G; la expresión del medio es el
producto ordinario de tres números reales, el valor de A en E, el valor de B en
F , y el valor de C en G; y la tercera expresión es ese mismo producto con los
tres números reescritos como productos escalares. Se pueden dar definiciones
similares (y deberı́an ser obvias) para el producto tensorial de cualquier número
de vectores, y de dos o más tensores de cualquier rango; por ejemplo, si T tiene
rango 2 y S tiene rango 3, entonces
T ⊗ S(E, F, G, H, I) ≡ T (E, F )S(G, H, I). (8)
Un último concepto geométrico (es decir, independiente del sistema de co-
ordenadas) que necesitaremos es la contracción. Ilustraremos este concepto
primero con un ejemplo simple, y luego daremos la definición general.
A partir de dos vectores A y B podemos construir el producto tensorial
A ⊗ B (un tensor de segundo rango), y también podemos construir el producto
escalar A·B (un número real, es decir, un escalar), que se puede obtener a partir
del tensor de rango cero A ⊗ B. El proceso de contracción es la construcción de
A · B a partir de A ⊗ B:
contracción(A ⊗ B) = A · B. (9)
Se puede demostrar fácilmente utilizando técnicas de componentes (Sección
1.5 a continuación) que cualquier tensor de segundo rango T puede expresarse
como una suma de productos tensoriales de vectores, T = A ⊗ B + C ⊗ D +
· · ·. Nótese que esta definición del proceso de contracción de T corresponde a
contracción(T) = A · B + C · D + · · ·. Es natural que esta contracción baje el
rango del tensor en dos, de 2 a 0. Similarmente, para un tensor de rango n se
puede construir un tensor de rango n − 2 por contracción, pero en este caso uno
debe especificar qué slots son a ser contraı́dos. Por ejemplo, si T es un tensor
de tercer rango, expresable como T = A ⊗ B ⊗ C + E ⊗ F ⊗ G + · · ·, entonces
la contracción de T en sus primeros y tercer slots es la contracción 1 de T (un
vector):
13contracción(A ⊗ B ⊗ C + E ⊗ F ⊗ G + · · ·) = (A · C)B + (E · G)F + · · · . (10)
Desafortunadamente, no existe una notación simple e independiente de ı́ndices
para la contracción en uso común. Todos los conceptos desarrollados en esta
sección (vector, tensor, tensor métrico, producto interno, producto tensorial y
contracción de un tensor) pueden ser llevados, sin ningún cambio, a cualquier
5
espacio vectorial que esté dotado de un concepto de longitud al cuadrado (por
ejemplo, al espacio-tiempo de cuatro dimensiones de la relatividad especial (sigu-
iente capı́tulo)).
3 Representación en Componentes del Álgebra
Tensorial
En el espacio euclidiano tridimensional de la fı́sica newtoniana, hay un con-
junto único de vectores base ortonormales {ex , ey , ez } ≡ {e1 , e2 , e3 } asociado
con cualquier sistema de coordenadas cartesianas {x, y, z} ≡ {x1 , x2 , x3 } ≡
{x1 , x2 , x3 }. (En coordenadas cartesianas en el espacio euclidiano, usualmente
colocamos los ı́ndices abajo, pero ocasionalmente los colocamos arriba. No
importa. Por definición, en coordenadas cartesianas, un vector es el mismo in-
dependientemente de si su ı́ndice está abajo o arriba.) El vector base ej apunta
a lo largo de la coordenada xj , tiene la misma dirección que esta coordenada, es
ortogonal a todas las demás direcciones coordenadas y tiene longitud unitaria
(Fig. 1.3), por lo que
ej · ek = δjk , (11)
donde δjk es la delta de Kronecker.
Cualquier vector A en el espacio tridimensional puede ser expandido en
términos de esta base:
A = Aj ej . (12)
Aquı́, y a lo largo de este libro, adoptamos la convención de suma de Ein-
stein: ı́ndices repetidos (en este caso j) deben ser sumados (en este caso de 3
dimensiones sobre j = 1, 2, 3), a menos que se indique lo contrario. Por virtud
de la ortonormalidad de la base, los componentes Aj de A pueden ser calculados
como el producto escalar
Aj = A · e j . (13)
[La prueba de esto es sencilla: A·ej = (Ak ek )·ej = Ak (ek ·ej ) = Ak δkj = Aj ]
Cualquier tensor, digamos, el tensor de tercer rango T ( , , ), puede ser
expandido en términos de productos tensoriales de los vectores base:
T = Tijk ei ⊗ ej ⊗ ek . (14)
Los componentes Tijk de T pueden ser calculados a partir de T y los vectores
base por la generalización de la Ec. (1.9c):
Tijk = T (ei , ej , ek ). (15)
[Esta ecuación puede ser derivada usando la ortonormalidad de la base de la
misma manera que la Ec. (1.9c) fue derivada.] As un ejemplo importante, los
6
componentes del tensor métrico gjk = g(ej , ek ) = ej · ek = δjk , donde la primera
igualdad es el método (1.9e) de computar componentes de un tensor, la segunda
es la definición (1.4b) de la métrica, y la tercera es la ortonormalidad, relación
(1.9a):
gjk = δjk . (16)
Los componentes de un producto tensorial (e.g., T ( , , )⊗S( , )) are fácilmente
deducidos insertando los vectores base en los slots [Eq. (1.9e)]: T (ei , ej , ek ) ⊗
S(el , em ) = Tijk Slm [cf. Eq. (1.5a)]. En otras palabras, los componentes de un
producto tensorial son igual al ordinario producto aritmético de los componentes
de los tensores individuales.
Cuando se insertan vectores, el producto interno de dos vectores y el valor
de un tensor en vectores son notación, los productos internos de dos vectores y
el valor de un tensor cuando se insertan vectores en sus slots están dados por
A · B = Aj B j , T (A, B, C) = Tijk Ai Bj Ck , (17)
como se puede fácilmente mostrar usando ecuaciones previas. Finalmente,
la contracción de un tensor (say, el tensor de cuarto rango R( , , , )) en dos
de sus slots (say, el primero y el tercero) has componentes que son fácilmente
computados de los tensor’s own components:
components of [13 contracción de R] = Rijik .
Note que Rijik es sumado en el ı́ndice i, ası́ que solo tiene dos ı́ndices libres,
j y k, y thus es el componente de un tensor de segundo rango, como debe ser si
es para representar la contracción de un tensor de cuarto rango.
1.5.1 Notación de Índice con Nombres de Slots
Introducimos una muy importante nueva visión de la versión en componentes
del álgebra tensorial...
4 Box 1.2. Vectores y Tensores en Teorı́a Cuántica
Las leyes de la teorı́a cuántica, al igual que todas las leyes de la Naturaleza,
pueden expresarse como relaciones geométricas entre objetos geométricos. La
mayorı́a de los objetos geométricos en la teorı́a cuántica son vectores y tensores:
el estado cuántico |ψ⟩ de un sistema fı́sico (por ejemplo, una partı́cula en un
oscilador armónico) es un vector en un espacio de Hilbert, una generalización
de un vector euclidiano. Existe un producto interno, denotado por ⟨ϕ|ψ⟩, entre
dos estados |ϕ⟩ y |ψ⟩, análogo al producto punto A · B en el espacio euclidiano,
pero ⟨ϕ|ψ⟩ es un número complejo, mientras que A · B es un número real.
El hamiltoniano y otros operadores que representan observables (por ejemplo,
el hamiltoniano H para una partı́cula en un potencial) son operadores de dos
ranuras (segundo rango), funciones complejas de vectores; ⟨ϕ|H|ψ⟩ es el número
complejo que obtenemos al insertar los vectores |ϕ⟩ y |ψ⟩ en la primera y segunda
ranura de H. De esta manera, cuando insertamos el vector |ψ⟩ en la segunda
ranura de H, en teorı́a cuántica obtenemos un nuevo vector (el estado final)
7
H|ψ⟩. Esto nos lleva a ver a H como una transformación lineal que lleva vectores
de un espacio de Hilbert a otros vectores de un espacio de Hilbert, y ası́, en
general, los operadores como transformaciones lineales entre estados.
Para el electrón en el átomo de hidrógeno, ...
Consideremos un tensor de rango 2, F ( , ). Podemos definir un nuevo tensor
G( , ) que sea el mismo que F , pero con las ranuras intercambiadas; es decir,
para cualquier par de vectores A y B, se cumple que G(A, B) = F (B, A).
Necesitamos una forma sencilla y compacta de indicar que F y G son iguales
excepto por el intercambio de ranuras. La mejor manera es asignar nombres a
las ranuras, digamos a y b, y reescribir F (a, b) o, de manera más conveniente,
como Fab , y luego escribir la relación entre G y F como Gab = Fba .
might object. This notation is indistinguishable from our notation for com-
ponents on a particular basis. ”GOOD!” a more astute reader will exclaim. The
relation Gab = Fba is true if and only if ”G = F with slots interchanged” is
true. So why not use the same notation to symbolize both? In fact, we shall
do this. We ask our readers to look at any ”index equation,” such as Gab =
Fba, like they would look at an Escher drawing: momentarily think of it as a
relationship between components of tensors in a specific basis; then do a quick
mind-flip and regard it quite differently, as a relationship between geometric,
basis-independent tensors with the indices playing the roles of slot names. This
mind-flip approach to tensor algebra will pay substantial dividends.
As an example of the power of this slot-naming index notation, consider the
contraction of the first and third slots of a third-rank tensor T. In any basis, the
components of 13contraction(T) are Taba; cf. Eq. (1.9h). Correspondingly, in
slot-naming index notation we denote 13contraction(T) by the simple expression
Taba. We can think of the first and third slots as annihilating each other by the
contraction, leaving free only the second slot (named b) and therefore producing
a rank-1 tensor (a vector).
You are unlikely to find that the phrase ”slot-naming index notation” is
unconventional. We should caution that in any other textbooks. However, we
like it, it says precisely what we want it to say.
1.5.2 Particle Kinetics in Index Notation
As an example of slot-naming index notation, we can rewrite the equations
of particle kinetics (1.7) as follows:
dxi
vi = ,
dt
dvi d2 xi
ai = = ,
dt dt2
1
E = mvj vj ,
2
dpi
= q(Ei + ϵijk vj Bk ).
dt
(In the last equation, ϵijk is the so-called Levi-Civita tensor, which is used to
produce the cross product; we shall learn about it in Sec. 1.7. And note that
the scalar energy E must not be confused with the electric field vector E.)
8
Equations (1.10) can be viewed in either of two ways: (i) as the basis-
independent geometric laws v = dx/dt, p = mv, a = dv/dt = d2 x/dt2 , E =
1 2
2 mv , and dp/dt = q(E + v × B), written in slot-naming index notation; or
(ii) as equations for the components of v, p, a, E, and B in some particular
Cartesian coordinate system.
Exercise 1.3 Derivation: Component Manipulation Rules
Derive the component manipulation rules (1.9g) and (1.9h).
Exercise 1.4 Example and Practice: Numerics of Component Manipulations
The third-rank tensor S and vectors A and B have as their only nonzero
components S123 = S231 = S312 = +1, A1 = 3, B1 = 4, B2 = 5. What are the
9
a
Franciasco Cañedo
October 2024
10