Nociones de Fotogrametría Digital
Nociones de Fotogrametría Digital
Introducción.
Según los métodos utilizados, la fotogrametría se puede clasificar en:
Fotogrametría Geométrica
Fotogrametría Analógica
Fotogrametría Analítica
Fotogrametría Digital
La fotogrametría digital, actualmente en auge, surge como consecuencia del gran desarrollo
de la computación, que permitió realizar todos los procesos fotogramétricos mediante el
uso de computadores. Con la fotogrametría digital crecen las posibilidades de explotación
de las imágenes, a la vez que se simplifican las tecnologías, permitiendo con ello la
generación automática de modelos de elevación del terreno, ortoimágenes y
estereortoimágenes, generación y visualización de modelos tridimensionales etc. Para
llevar a cabo la restitución digital, las imágenes digitales son ingresadas en el computador,
y mediante visualización en pantalla de las mismas, el operador ingresa los puntos
necesarios para realizar el proceso de orientación en forma matemática. La restitución
puede ser un proceso iterativo con el operador o ser realizada en forma automática por
2
Tabla 1.1
PRIMERA PARTE
LA IMAGEN DIGITAL
1.1 Generalidades.
El inicio de la era espacial, que permitió colocar en órbita satélites de observación de La
Tierra, impulsó el desarrollo de tecnologías conducentes a reemplazar la imagen fotográfica
por imágenes de carácter digital. La necesidad de crear (desde el punto de vista
operacional) un nuevo tipo de imagen, diferente al producido por la película fotográfica,
provino de la necesidad de transmitir la imagen captada en el espacio, a las estaciones de
control de los satélites. No era conveniente traer la película expuesta en el espacio a La
tierra, como fue el caso de los primeros satélites espías (por ejemplo, el Agena). Para lograr
la transmisión de los datos era necesario enviarlos colocados digitalmente sobre una onda
portadora, generada por el satélite. Por ello, se desarrolló esta nueva tecnología, que se fue
perfeccionando aceleradamente, hasta que por el aumento de su resolución y el
abaratamiento de los dispositivos captadores de imagen se hizo accesible a la fotogrametría.
En las imágenes digitales las diferencias en luminancia del objeto captado se registran por
medios físicos, mediante voltajes convertidos en valores digitales, y almacenados en discos
magnéticos o en chips de memoria que permiten la recuperación inmediata de la
información (la imagen), a diferencia de las imágenes fotográficas, donde las diferentes
luminancias provenientes del objeto se registran a través de cambios químicos en una
película fotográfica.
Estas diferentes formas de registro pictórico hacen necesaria la diferenciación entre imagen
y fotografía. Puesto que el término imagen se refiere a un producto de carácter pictórico,
todas las fotografías son imágenes. Sin embargo, no todas las imágenes son fotografías, ya
que éstas son producidas mediante un procedimiento específico, inherente a su naturaleza.
Por ser una imagen numérica, su análisis puede hacerse en forma rigurosa por tratamientos
matemáticos mediante el uso de computadoras. (wolf, 2000). Esta característica le otorga
una gran ventaja respecto a la imagen fotográfica, ya que puede ser manipulada
5
ny Xmétrico
(0,0)
Py
Y’pixel Px
Las imágenes digitales son producidas mediante muestreo discreto. En este proceso, una
pequeña área en el plano focal es tomada para determinar la cantidad de energía
electromagnética que es recibida por la correspondiente superficie del objeto.
El muestreo discreto posee dos características fundamentales: la resolución espacial y la
resolución radiométrica.
La resolución espacial se refiere al tamaño físico que un pixel de la imagen representa en el
terreno; cuanto mayor sea la cantidad de pixeles que cubren un área determinada, mayor
resolución geométrica de la imagen, ya que el píxel representará una menor superficie del
objeto.
La resolución radiométrica implica la conversión de la amplitud de la energía
electromagnética original en un número de niveles discretos. Mayores niveles de
cuantización resultan en mejores representaciones de la señal análoga, y por lo tanto mayor
resolución radiométrica, por cuanto se discriminan diferencias mas pequeñas de la energía
que llega al sensor.
La imagen digital es de carácter binario, es decir, está constituida por bites, los cuales sólo
pueden tener dos estados: alto o bajo, representados respectivamente como 1 ó 0. El
número de bites disponibles para registrar la imagen determina su resolución radiométrica.
6
De este modo, una imagen de 4 bites dará una resolución de 24 es decir, 16 tonos diferentes.
Una imagen de 8 bites dará una resolución de 28 es decir, 256 tonos diferentes. Estos tonos
son desplegados como grises, donde su mínimo valor (0) se representará pictóricamente
como negro, y su máximo valor 255 (en el caso de una imagen de 28 bites) se representará
como blanco.
Figura 1.2. Imagen digital del edificio del rectorado ULA, y ampliación mostrando los
pixeles.
Tabla 1.1. Valores radiométricos de los seis primeros pixeles horizontales y verticales de
la ampliación en la figura 10.1.
1.3 El pixel
Es la unidad de los elementos pictóricos que constituyen una imagen digital. Es comparable
a la resolución puntual de una película fotográfica. La dimensión física del elemento captor
(en la actualidad de 9 a 15 µm) y la longitud focal del sistema óptico empleado,
determinan un ángulo sólido, que se prolonga hasta la superficie del terreno. La altitud a la
cual se utiliza el dispositivo de captación de la imagen, determina entonces el tamaño del
área del terreno que el pixel representa. El ángulo sólido determinado por el transistor y el
sistema óptico es mejor conocido con el nombre de IFOV, por sus siglas en inglés
(Instantaneous Field Of View, campo de vista instantáneo). En una pantalla de
computadora o en un dispositivo de entrada, como un escáner o una cámara digital, un pixel
es la mínima e individualizada información visual que puede capturar o mostrar un
elemento
que en mismo libere electrones, los cuales generan una corriente eléctrica en forma
directamente proporcional a la energía recibida de los electrones liberados. Existen
actualmente dos tipos de dispositivos optoelectrónicos muy utilizados para captar la luz,
que son el CCD (Charge Coupled Devise) y el CMOS (Complementary Metal Oxide
Semiconductor). Estos sensores de imagen, convierten la luz en voltaje, pero difieren en la
forma de leer ese voltaje, lo cual se traduce en diferencias de precio y calidad.
En el caso del CCD, la carga es transportada a lo largo del chip y leída al final del mismo.
Para lograr esto, se usan procesos especiales de fabricación para darle al chip la habilidad
de transportar la carga a través del chip sin que ocurra distorsión. Estos procesos tienen
como consecuencia la creación de sensores de alta calidad en términos de fidelidad y
sensibilidad.
En el caso del CMOS, cada píxel es leído en forma instantánea e individual. Sin embargo,
debido a que cada fotodiodo posee transistores en su alrededor, algunos de los fotones
pueden alcanzar los transistores, dando como resultado una pérdida de sensibilidad a la luz.
Las principales diferencias entre ambos sistemas se describen en la tabla siguiente:
Debido a sus propias características, el sensor CMOS es usado en cámaras digitales donde
el costo prive sobre la calidad, mientras que los sensores CCD se utilizan en cámaras de
alta gama.
Fuente de iluminación
OBJETO
N
m al CAMARA
Nor
Irradiancia
Z
Eje óptico
Radiancia
Puesto que la intensidad lumínica que incide sobre los elementos sensibles del CCD es de
tipo análoga, así mismo es la señal que emana de estos fotoelementos, por lo cual se hace
necesaria su conversión a digital mediante el uso de un convertidor de análogo a digital,
A/D. La imagen digitalizada es ahora enviada a un DSP (digital signal processor o
procesador digital de señal), programado para llevar a cabo la tarea de procesar la imagen
obtenida a partir de la digitalización del patrón de intensidades proveniente del CCD.
Las tareas llevadas a cabo por el DSP incluyen, entre otras, ajustar el contraste y el detalle
de la imagen, comprimir los datos que la conforman para que ocupen menos espacio y
posteriormente enviar los datos al dispositivo de almacenamiento. Se puede afirmar que el
DSP es el cerebro del sistema fotográfico digital.
10
CCD
de barrido Convertidor Salida
DSP A/D Digital
progresivo
Generador
de tiempo Controlador
del sistema
Reset
φ1 • • • • •
φ2 • • • • •
φ3 • • • • • •
t1 φ3 < φ1, φ2
t2 φ1 < φ2, φ3
t3 φ2 < φ3, φ1
El tercer paso es el desplazamiento vertical, donde se aplica una serie de pulsos a las
columnas, con lo que van vaciando su información
1.8 El escaneado.
Una forma de adquirir la imagen digital de un área determinada es la del escaneado, método
que es el más utilizado actualmente en la fotogrametría, debido a que ofrece una mayor
accesibilidad para obtener una imagen numérica que la de la toma directa por cámara
digital. Dado que con los modelos estereoscópicos obtenidos con fotografías aéreas se
obtienen precisiones del orden de 15 µm, la resolución óptica del escáner debe poseer
valores similares para que la imagen digital sea competitiva con la fotografía. Existen
varios tipos de escáneres según usen fotomultiplicador o CCD, y según sean de tambor o
planos. En la tabla 10.2, (ASPRS, Digital Photogrammetry, 1996), se comparan los
principales escáneres disponibles para uso fotogramétrico.
Resolución óptica.
Es la máxima cantidad de información que un escaner o cámara digital puede muestrear.
Esta información se expresa como puntos por pulgada (dpi o ppp) en el caso de los
escáneres, y como una cantidad fija en el caso de las cámaras digitales.
Resolución interpolada.
Es la máxima resolución obtenida a partir de software, el cual mediante métodos de
interpolación entre los pixeles originales de la imagen crea nuevos pixeles. Esta resolución
se utiliza principalmente para el proceso de impresión, cuando se considera necesaria para
aumentar la calidad visual del producto. Sin embargo, este método no se usa en
fotogrametría por alterar la integridad de la información geométrica (y radiométrica) de la
imagen.
Resolución de salida.
Se refiere al numero de puntos por pulgada que debe contener el archivo final a ser
impreso. El método de reproducción de la impresión y la resolución del dispositivo de
salida usado determinan la correcta resolución de salida para la imagen.
Resolución de impresora.
Se refiere al número de puntos por pulgada, horizontales y verticales, que un dispositivo de
salida puede generar.
1.10 Digitalización
Es un proceso mediante el cual se transforma una señal analógica (variable continua), en
señal digital (variable discreta). Debido a que la señal es digitalizada para ser usada en
computadores, los cuales usan el código binario, con n números de bits por byte, la
digitalización se hace en potencias de 2. A grandes rasgos, para llevar a cabo la
14
digitalización, el rango de voltaje de entrada de la señal análoga se divide por el valor 2n,
donde n es el número de bits que posee el conversor. El resultado de esta división es el
intervalo dentro del cual la señal analógica tendrá el mismo valor para el digitalizador. De
esta manera los valores digitales se irán registrando según el valor de la señal analógica en
dichos intervalos. Por ejemplo, si la señal va a ser digitalizada por un conversor 23, la señal
analógica será dividida en 2×2× 2 = 8 intervalos. Todo voltaje que esté comprendido dentro
de un determinado intervalo será digitalizado entonces según su correspondiente valor
digital.
111 {
110 {
Valor digital de salida
101 {
100 {
011 {
010 {
001 {
000 { Voltaje de
0,625 1,375 3,125 4,375 entrada
0 1,25 2,50 3,75 5
.
Figura 1.9. Digitalización de 3 bits de un voltaje de 0 a 5 V.
Frecuencia
0 255 0 255
Valor radiométrico Valor radiométrico
ND o i, j − ND min
ND f i, j = × (∆ B)
Dmax − Dmin
Donde:
NDf i,j es el valor del pixel obtenido de la fórmula.
ND o i,j es el valor original del pixel.
ND min es el menor valor.
ND max es el mayor valor.
∆B es el rango de brillantez del monitor.
1 L C
1 L C
M= ∑
n i =1
∑
j =1
R(i, j) m= ∑
n i =1
∑
j =1
P(i, j)
Donde n = L × C
. M
Tendremos entonces: Norm.(P(i,j) = —— × P(i,j)
m
1.11.3 Filtros.
Una característica de la imagen digital es el parámetro denominado frecuencia espacial, el
cual se define como el número de cambios en valores de brillantez por unidad de distancia
para cualquier zona de la imagen. Si los valores de brillantez varían mucho en un área
determinada de la imagen, se dice que es un área de alta frecuencia espacial; en caso
contrario, se trata de un área de baja frecuencia espacial.
Un filtro lineal espacial es aquel que modifica valores de brillantez de la imagen original,
en función de un peso promedio creado mediante una combinación lineal.
multiplicada por cada píxel y sus vecinos en una pequeña región, se suman los valores y
este resultado se asigna al píxel de la imagen que coincide con el centro del kernel.
Existen diferentes tipos de filtros según la función que realicen, bien sea para destacar
algún rasgo o característica de la imagen o para corregir algún defecto. Así pues, tenemos
filtros paso bajo, para disminuir contraste, paso alto para aumentarlo, Laplacianos para
destacar límites entre distintos valores numéricos de la imagen y Sobel para determinar la
orientación en estructuras de la imagen.
Columnas
I I I I I I C C C C C C C C C C
I I I I
Filas
I I I I C C C C C C C C C C
I I I I I I
I I I I I I I I I I C C C C C C C C C C
I I I I I C C C C C C C C C C
I I I I I
I I I I I I I I I C C C C C C C C C C
I
I I I I I I I I I I C C C C C C C C C C
I I I C C C C C C C C C C
I I I I I I I
I I I I I I I I C C C C C C C C C C
I I
I I I I I I I I I C C C C C C C C C C
I
I I I I I I I I I C C C C C C C C C C
I
K1 K2 K3
K4 K5 K6
K7 K8 K9
Filtro kernel
Para la posición que ocupa el filtro el la figura 1.11, el cálculo del pixel correspondiente a
la imagen resultante sería de la forma:
1 1 1
1 2 1
1 1 1
-1 -1 -1
-1 9 -1
-1 -1 -1
1 1 1 -1 -1 -1
1 -8 1 1 -8 1
-1 -1 -1 1 1 1
Norte Sur
-1 1 1 1 1 -1
-1 -8 1 1 -8 -1
-1 1 1 1 1 -1
Este Oeste
1 1 1 1 -1 -1
-1 -8 1 1 -8 -1
-1 -1 1 1 1 1
Noreste Sureste
19
Filtro de Laplace.
El filtro de Laplace (1) es un filtro kernel que se aproxima a la segunda derivada, siendo
insensible a la rotación, por lo que no es capaz de definir ejes, ya que no detecta la
dirección donde estas discontinuidades ocurren (puntos, líneas y ejes).
Este filtro (2) resta los valores de brillantez de los píxeles vecinos al píxel central. Como
consecuencia de esto, al aplicar este filtro en una región de la imagen que posea brillo o
gradiente de brillo uniforme, se obtendrá una imagen con valores de brillantez de cero,
salvo cuando exista una discontinuidad en forma de punto, línea o eje, en cuyo caso el valor
es diferente de cero, pudiendo ser negativo o positivo. Para que los valores puedan ser
desplegados, se les agrega el valor de 128.
-1 -1 -1 -1 -2 -3 -2 -1
-1 8 -1 -2 2 4 2 -2
-1 -1 -1 -3 4 8 4 -3
-2 2 4 2 -2
-1 -2 -3 -2 -1
Filtro de Sobel.
Es un filtro kernel que detecta ejes y su orientación.
-1 0 +1
-2 0 +2
-1 0 +1
20
Existen otros tipos de filtros que eliminan o minimizan el ruido de una imagen, como:
1 1 1 1 2 1
1/9 1 1 1 1/16 2 4 2
1 1 1 1 2 1
Ejercicios
Imagen original
70 82 83 47 71 70 82
76 84 79 43 74 76 84
78 81 77 45 75 78 81
44 50 48 39 42 44 50
72 80 77 46 73 72 80
70 82 83 47 71 70 82
76 84 79 43 74 76 84
21
70 82 83 47 71 70 82
76 46 90 0 87 0 84
78 112 147 0 159 98 81
44 0 0 0 0 0 50
72 114 141 0 153 64 80
70 35 126 0 67 0 82
76 84 79 43 74 76 84
70 82 83 47 71 70 82
76 18 0 0 122 37 84
78 5 0 0 104 30 81
44 12 0 0 69 29 50
72 27 0 0 80 33 80
70 34 0 0 105 39 82
76 84 79 43 74 76 84
La transformación de Fourier
Las imágenes digitales existen en la forma del dominio espacial, el cual se refiere al
concepto de que las posiciones de los píxeles en la imagen están referidas directamente al
espacio bidimensional de la imagen. Mediante el uso de ciertas operaciones matemáticas,
las imágenes pueden convertirse de la frecuencia espacial a la frecuencia espectral y
viceversa. En una imagen convertida a la frecuencia espectral, la posición de sus píxeles
describe la frecuencia, en lugar de la localización espacial. Las imágenes en la frecuencia
espectral no poseen ningun carácter reconocible, a diferencia de las imágenes en el dominio
espacial, aunque contienen toda la información de la imagen original.
La forma más usada para convertir la imagen digital original en su dominio de frecuencia
es la transformación discreta de Fourier, la cual transforma los valores de brillantez en una
serie de coeficientes para funciones de seno y de coseno, que varían desde cero hasta hasta
la frecuencia de Nyquist.
Suponiendo que se discretiza una función f(x) en una secuencia de N unidades ∆x,
obteniendo la forma: {f(x0), f(x0 + ∆x), f(x0 + 2∆x )…… f(x0 + [N – 1]∆x) }, podemos
generalizar usando x como una variable discreta: f(x) = f(x0 + x∆x).
La transformación discreta de Fourier será entonces:
1 N −1
F(u) = ∑ f(x)exp[− 2ππux/ ] para u = 0,1,2,...N − 1
N x =0
1 N −1
f(x) = ∑ F(u)exp[− 2ππux/ ] para x = 0,1,2,...N − 1
N u =0
22