Componentes de los sistemas de Visión
________________________________________________________________________
Componentes de los sistemas de Visión
A continuación se muestra un esquema típico de un sistema de visión por computador.
Algunos elementos no siempre están presentes o están presentes en un formato distinto al que
aparece en el esquema. Por ejemplo, en un sistema que incorpore cámaras Firewire o Gigabit
Ethernet, el frame grabber como tal no existe, en su lugar se utiliza un puerto Firewire o
Gigabit Ethernet.
También existe la posibilidad de prescindir del computador externo en los casos en que se
trabaje con cámaras inteligentes. En estos casos, el preprocesado y procesado de las imágenes
se hace en el interior de la cámara, desde donde, mediante entradas y salidas que puede
incorporar la cámara, se puede interactuar con el resto del sistema.
Prácticas de aula de visión artificial 1
Componentes de los sistemas de Visión
________________________________________________________________________
Cámaras
Las cámaras permiten convertir energía lumínica en eléctrica y transferir el resultado de dicha
conversión.
Las cámaras se pueden clasificar según distintos criterios. Algunos son:
- Resolución
- Tamaño del sensor
- Por la sensibilidad del sensor a diferentes longitudes de onda
- Por interfaz de salida
Algunos ejemplos de interfaz de salida son:
- Salida de video analógica
- Camera Link
- IEEE 1394 a/b
- USB 2
- Gigabit Ethernet
Funcionamiento de un sensor
Los sensores de imagen emulan electrónicamente el comportamiento de las tradicionales
películas fotográficas. En este caso, los sensores, formados por una matriz bidimensional de
píxels, están constantemente expuestos a la luz, ya que no disponen de un diafragma que se
abra y cierre a cada imagen que se quiera capturar. Mediante circuitos de control se gobierna
el tiempo de exposición durante el cual se convierten los fotones incidentes en los píxels en
cargas eléctricas.
En la visión por computador predominan dos tipos de sensores: el CCD (charge couple device)
y el CMOS (complementary metal oxide semiconductor).
Prácticas de aula de visión artificial 2
Componentes de los sistemas de Visión
________________________________________________________________________
Como se puede ver en la figura, en el caso de los sensores CCD, las cargas se desplazan hasta
un punto común donde son convertidas a tensión y ésta se amplifica. Esto hace que el
resultado final sea homogéneo, ya que el amplificador es común a todas las cargas y ruido que
introduzca será parecido en todas las amplificaciones próximas en el tiempo.
En el caso de los sensores CMOS, cada píxel contiene los circuitos necesarios para realizar la
conversión y amplificación, con lo que el resultado es menos homogéneo que en el caso de los
CCD.
Por otra parte, la superficie útil para la captación de fotones es menor, ya que cada píxel debe
reservar espacio para la circuitería. La relación entre la superficie de captación de fotones y la
superficie total del píxel se denomina fill factor y es menor en los sensores CMOS. En ambos
tipos de sensores se utilizan microlentes situadas sobre cada píxel que hacen que los fotones
se dirijan a la zona sensible del píxel, mejorando su absorción.
A grandes rasgos, los sensores CMOS son más ruidosos, pero permiten alcanzar velocidades
de captura mayores que en el caso de los sensores CCD.
El tiempo durante el cual se convierten fotones en cargas, que luego se transferirán fuera del
sensor, se conoce como tiempo de exposición o shutter. El inicio y duración de este periodo de
tiempo puede fijarse mediante la propia cámara o mediante señales externas (trigger), por
ejemplo, mediante pulsos TTL. Durante el tiempo de readout, se transfiere la información
eléctrica fuera del sensor.
Ópticas
A continuación se muestra un esquema correspondiente al funcionamiento de una óptica.
La distancia focal corresponde a la distancia entre el plano de referencia y el plano de imagen,
que corresponde al sensor.
Prácticas de aula de visión artificial 3
Componentes de los sistemas de Visión
________________________________________________________________________
La distancia focal de un objetivo adecuada para una aplicación se calcula en función de ciertas
variables según la expresión siguiente:
Tamañodel sensor x Distancia de trabajo
Distancia focal=
Campo de visión [mm]
donde “tamaño de sensor” y “campo de visión” se refieren al eje horizontal.
Los tamaños de los sensores suelen ser estándar:
En la figura anterior se pueden ver los tamaños estándar.
Algunos parámetros de los objetivos son su apertura, la distancia mínima de enfoque (MOD),
el tamaño del sensor para el que ha sido diseñado y su distancia focal. La apertura indica
cuánto se puede abrir el iris del objetivo. Normalmente se da en números f: f1, f1.4, f2, etc.
Este número es la relación entre la distancia focal del objetivo y el diámetro de la apertura
máxima. Para una distancias focal dada, cuanto mayor es el número f del objetivo, menor es el
diámetro y, por tanto, deja pasar menos luz.
Dentro del rango de apertura de un objetivo, cuanto más cerrado esté éste, mayor
profundidad campo se tendrá. La profundidad de campo es el rango de distancias, relativas al
objetivo, dentro del cual un objeto estará enfocado sin necesidad de ajustar el enfoque.
La distancia mínima de enfoque, como su nombre indica, es la distancia por debajo de la cual
un objetivo no podrá enfocar un objeto. Si, dado un objetivo, es necesario enfocar por debajo
de su distancia mínima de enfoque, se pueden utilizar anillos extensores. Los anillos
extensores son anillos que se sitúan entre la cámara y el objetivo para modificar las
propiedades ópticas del sistema. Al utilizar anillos extensores se pierde profundidad de campo
proporcionalmente al grueso de los anillos, de forma que con un anillo muy grueso se puede
enfocar muy por debajo de la distancia mínima de enfoque, pero la profundidad de campo se
reduce mucho.
Los objetivos de alta resolución, además de ofrecer una mejor resolución, suelen tener
distancias mínimas de enfoque inferiores a las de los objetivos estándar.
Prácticas de aula de visión artificial 4
Componentes de los sistemas de Visión
________________________________________________________________________
Iluminación
La iluminación es un factor clave en un sistema de visión por computador. Encontrar la
iluminación adecuada puede simplificar mucho el procesado y análisis de las imágenes,
mientras que una iluminación inadecuada puede hacerlo inviable.
Los sistemas de iluminación se pueden clasificar tanto por el tipo de fuente de luz como por la
técnica de iluminación, así como por su rango espectral, entre otras clasificaciones. De esta
manera, según la primera clasificación, se pueden encontrar sistemas basados en:
- Fluorescentes, mayoritariamente de alta frecuencia.
- LED
- Fuentes halógenas
- Láser
Una posible clasificación por técnica de iluminación podría ser:
- frontal
- lateral
- darkfield
- contraste o backlight
- coaxial
- difusa
A continuación se muestran algunos ejemplos de cada técnica de iluminación:
Frontal
Se utiliza en aplicaciones generales donde no hay condiciones que requieran otro tipo
específico de iluminación.
Prácticas de aula de visión artificial 5
Componentes de los sistemas de Visión
________________________________________________________________________
Lateral
Se utiliza en casos en que se quieren resaltar detalles que requieren que la fuente de luz esté
orientada en posición no cenital respecto a la cámara.
Prácticas de aula de visión artificial 6
Componentes de los sistemas de Visión
________________________________________________________________________
Darkfield
Se utiliza para resaltar detalles en relieve.
luz frontal Darkfield
Prácticas de aula de visión artificial 7
Componentes de los sistemas de Visión
________________________________________________________________________
Backlight
Se utiliza para resaltar perfiles o para que la luz atraviese el objeto a inspeccionar.
luz frontal Backlight
Prácticas de aula de visión artificial 8
Componentes de los sistemas de Visión
________________________________________________________________________
Coaxial
Se utiliza para atenuar los reflejos de superficies reflectantes, iluminando de forma homogénea
la superficie.
luz frontal luz coaxial
luz frontal luz coaxial
Prácticas de aula de visión artificial 9
Componentes de los sistemas de Visión
________________________________________________________________________
Difusa
También se utiliza para atenuar reflejos, así como para eliminar sombras.
luz frontal luz difusa
Prácticas de aula de visión artificial 10
Componentes de los sistemas de Visión
________________________________________________________________________
Frame grabbers
Los frame grabbers son tarjetas de adquisición de video. Podemos distinguir entre frame
grabbers analógicos y digitales. Los primeros pueden capturar video analógico estándar o no
estándar, mientras que los segundos pueden capturar video de cámaras con interfaz,
básicamente, CameraLink, dado que otros formatos digitales que requieren frame grabbers
han quedado obsoletos.
Suelen incorporar cierta cantidad de memoria que se utiliza a modo de buffer en la transmisión
entre la cámara y la memoria del sistema, ya que, de no ser así, diferencias en la velocidad de
transmisión entre la cámara y el sistema computador podrían ocasionar pérdida de datos
(imágenes).
Existen frame grabbers para distintos tipos de bus (PCI, PCI Express, etc). Algunos pueden
realizar algunas operaciones de preprocesado, como por ejemplo decodificación Bayer o
binarizado. Suelen incluir SDK para operaciones básicas: captura de imagen, gestión del
buffer, modificación de la configuración, operaciones de preprocesado (si está disponible en el
frame grabber). También suelen incorporar entradas y salidas digitales que pueden incluir una
entrada de trigger y una salida de strobe.
Computador + software
Existen varias alternativas en el campo de la visión por computador a la hora de escoger un
sistema de computación para el análisis y/o procesado de imágenes. Una opción es trabajar
sobre una plataforma basada en PC a base de añadir frame grabbers (en el caso de trabajar
con cámaras que lo requieran) e instalar el software necesario. Otra opción consiste en el uso
de sistemas dedicados que suelen ser computadores que contienen todos los componentes
necesarios para el trabajo con visión por computador, por ejemplo un frame grabber, conector
para IEEE1394 y para Gigabit Ethernet.
También existen, como se ha comentado anteriormente, los llamados sistemas inteligentes,
que incorporan en un mismo dispositivo la cámara, la óptica, la iluminación y el software para
procesar y/o analizar imágenes, de forma que, a través de sus salidas, pueden informar al
exterior del resultado de una inspección.
A nivel de software, se suelen encontrar dos opciones. La primera opción es el uso de
aplicaciones diseñadas para la visión por computador. Mediante el uso de las herramientas
genéricas programadas por el fabricante del software, se crean aplicaciones específicas para
resolver un problema concreto. La principal desventaja de esta opción es que las aplicaciones
disponen de un número limitado de operaciones (preprocesado y procesado) que pueden
realizar, pero como ventaja está el hecho de que la creación de aplicaciones específicas se
puede llevar a cabo en un tiempo relativamente corto.
La alternativa es el uso de librerías de programación. Éstas suelen ofrecer un mayor número
de posibilidades, ya que el programador construye su aplicación totalmente a medida, aunque
el tiempo necesario para ello suele ser mucho mayor que en el caso de la primera opción
comentada.
Prácticas de aula de visión artificial 11
Componentes de los sistemas de Visión
________________________________________________________________________
Cuestiones
Analiza los catálogos de las cámaras JAI CV-A11, JAI CV-A1 y el catálogo de ópticas MidOpt y
conteste a las siguientes cuestiones.
a) Calcula la distancia de trabajo dado un objetivo de 35 mm, una cámara JAI CV-A11 y un
campo de visión de 100 mm en la dirección horizontal (X) y 75 mm en la dirección vertical (Y).
b) Recalcúlalo para un objetivo de 12 mm y uno de 100 mm.
c) ¿Cómo has obtenido el tamaño del sensor?
d) Dadas las hojas de especificaciones de la cámara JAI CV-A11 y los objetivos, una distancia
de trabajo de 25 cm y un campo de visión de 10 cm, ¿qué objetivo escogerías?. Justifica tu
respuesta.
e) ¿Hay algún otro objetivo que se pudiera utilizar para obtener condiciones similares (ignorad
el ángulo de visión) a las del apartado anterior?. En caso afirmativo, si fuera necesario, indica
que elemento habría que añadir para poder cumplir las condiciones.
f) Recalcula ( a y b ) para la JAI CV-A1 en las mismas condiciones y comenta las conclusiones.
g) Supongamos una cámara JAI CV-A1 con una óptica GMN31214MCN. ¿Qué limitación podría
tener esta configuración? ¿Cómo se podría solucionar?
h) Comenta las dos diferencias que creas más importantes entre los objetivos GM32514MCN y
GMN32516MCN
i) ¿En qué consiste el partial scan?. ¿Para qué crees que puede ser útil/qué ventajas crees que
puede tener?
j) ¿En qué consiste el binning?. ¿Para qué crees que puede ser útil/qué ventajas crees que
puede tener?
k) ¿Qué diferencia básica crees que hay entre los modos de trigger “Edge Pre-Select” y “Pulse
Width Control”?
l) ¿Cuáles son los tiempos de integración mínimos y máximos en la A-11 y la A-1 a 28,64 Mhz?
m) Suponiendo que debes hacer la lectura de un código de barras. El campo de visión es de
200 mm y el grueso de la línea más fina del código de barras es de 0.5 mm. Considerando la
restricción de que la línea más fina debe tener un grueso mínimo de 4 píxels, qué resolución
debe tener la cámara para esta aplicación?
n) ¿Por qué crees que los fluorescentes utilizados en visión por computador suelen ser de alta
frecuencia?
o) ¿Cómo iluminarías el blister de algún medicamento para poder hacer un OCR de su nombre?
Prácticas de aula de visión artificial 12