Informe de Aplicación de Aprendizaje
Profundo para la Evaluación de la
calidad del Vino.
Introducción al aprendizaje profundo.
Autores:
José Antonio Pérez Contrera
José Antonio García Cevila
Título del Documento
Informe: Aplicación del Aprendizaje Profundo para la Evaluación de la
Calidad del Vino.
1. Situación Problémica.
La industria vinícola enfrenta un desafío significativo en la evaluación objetiva
y consistente de la calidad del vino. Tradicionalmente, esta tarea ha
dependido de catadores expertos que evalúan el vino en función de
características sensoriales como aroma, sabor, acidez y textura. Sin
embargo, este enfoque tiene varias limitaciones:
- Subjetividad: Las opiniones de los catadores pueden variar debido a
factores personales, culturales o emocionales.
- Costo y Tiempo: La contratación de expertos es costosa y requiere tiempo
para realizar las evaluaciones.
- Escalabilidad: No es práctico escalar este proceso para grandes volúmenes
de producción.
Para abordar estos problemas, se propone el uso del aprendizaje profundo
como una solución automatizada y objetiva para predecir la calidad del vino
basándose en características químicas medibles. Este enfoque permitirá
evaluar la calidad del vino de manera rápida, precisa y escalable, lo que
beneficiará tanto a pequeños productores como a grandes empresas.
2. Descripción del Dataset.
El dataset utilizado es winequality, disponible en repositorios de UCI
Machine Learning Repository. Este conjunto de datos contiene información
sobre la calidad del vino blanco y tinto, evaluada por expertos en una escala
de 0 a 10. Cada entrada incluye 11 características físicas y químicas del vino,
junto con una calificación de calidad asignada por los catadores.
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Características del Dataset:
- Número de muestras: 4898 (vino blanco) o 1599 (vino tinto), dependiendo
de la versión utilizada.
- Características de entrada (variables independientes):
- Acidez fija
- Acidez volátil
- Ácido cítrico
- Azúcar residual
- Cloruros
- Dióxido de azufre libre
- Dióxido de azufre total
- Densidad
- pH
- Sulfatos
- Alcohol
-Variable objetivo (dependiente):
- Calidad (escala de 0 a 10, siendo 10 la mejor calidad).
Este dataset es ideal para aplicar técnicas de aprendizaje supervisado, ya
que las características de entrada son numéricas y la variable objetivo es una
clasificación ordinal.
3. Modelo de Aprendizaje Profundo Propuesto.
Para resolver el problema de evaluación de la calidad del vino, se propone
construir un modelo de red neuronal artificial (RNA) utilizando aprendizaje
profundo. A continuación, se describe el diseño teórico del modelo:
3.1 Arquitectura del Modelo.
El modelo será una red neuronal multicapa (MLP, por sus siglas en inglés)
diseñada para aprender patrones complejos en los datos y predecir la calidad
del vino. La arquitectura incluye las siguientes capas:
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
1. Capa de Entrada:
- Contiene 11 neuronas, una por cada característica química del vino.
- Estas neuronas reciben los valores normalizados de las características.
2. Capas Ocultas:
- Primera Capa Oculta: 64 neuronas con función de activación ReLU
(Rectified Linear Unit). Esta capa extrae características básicas de los datos.
- Segunda Capa Oculta: 32 neuronas con función de activación ReLU. Esta
capa refina las características extraídas.
- Tercera Capa Oculta: 16 neuronas con función de activación ReLU. Esta
capa captura relaciones no lineales más complejas.
3. Capa de Salida:
- Contiene 1 neurona con función de activación lineal (para regresión) o
softmax (para clasificación).
- Si se utiliza regresión, la salida será un valor continuo que representa la
calidad del vino.
- Si se utiliza clasificación, la salida será una probabilidad asociada a cada
categoría de calidad (0 a 10).
3.2 Función de Pérdida y Optimización.
- Función de Pérdida:
- Para regresión: Error cuadrático medio (MSE).
- Para clasificación: Entropía cruzada categórica.
- Optimizador:
- Se utilizará Adam (Adaptive Moment Estimation), un optimizador
eficiente que ajusta automáticamente la tasa de aprendizaje durante el
entrenamiento.
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
3.3 Preprocesamiento de Datos.
Antes de entrenar el modelo, los datos deben ser preprocesados para
mejorar su calidad y facilitar el aprendizaje:
1. Normalización:
- Se escalarán todas las características de entrada al rango [0, 1]
utilizando la técnica de normalización Min-Max.
2. División de Datos:
- El dataset se dividirá en tres conjuntos:
-Entrenamiento (70%): Para entrenar el modelo.
- Validación (15%): Para ajustar hiperparámetros y evitar sobreajuste.
- Prueba (15%): Para evaluar el rendimiento final del modelo.
3. Codificación de la Variable Objetivo:
- Si se utiliza clasificación, la variable objetivo (calidad) se codificará en
formato one-hot encoding.
3.4 Entrenamiento y Evaluación.
1. Entrenamiento:
- El modelo se entrenará durante 100 épocas con un tamaño de lote
(batch size) de 32.
- Se implementará early stopping para detener el entrenamiento si no hay
mejora en la pérdida de validación durante 10 épocas consecutivas.
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
2. Evaluación:
- Para regresión, se utilizarán métricas como el error absoluto medio (MAE)
y el coeficiente de determinación (R²).
- Para clasificación, se utilizarán métricas como precisión, recall, F1-score
y matriz de confusión.
4. Beneficios Esperados.
La implementación de este modelo de aprendizaje profundo ofrece varios
beneficios:
1. Automatización: Reduce la dependencia de catadores humanos, lo que
disminuye costos y aumenta la eficiencia.
2. Consistencia: Proporciona evaluaciones consistentes y libres de sesgos
humanos.
3. Escalabilidad: Puede procesar grandes volúmenes de datos en poco
tiempo, lo que es ideal para la industria moderna.
4. Innovación: Abre nuevas oportunidades para la investigación y el
desarrollo de productos en la industria vinícola.
5. Conclusión.
El uso del aprendizaje profundo en la evaluación de la calidad del vino
representa una solución innovadora y práctica para superar las limitaciones
de los métodos tradicionales. Al aprovechar el dataset winequality y aplicar
una red neuronal multicapa, es posible desarrollar un modelo preciso y
escalable que transforme la forma en que se evalúa la calidad del vino. Este
enfoque no solo beneficia a la industria vinícola, sino que también demuestra
el potencial del aprendizaje profundo en aplicaciones industriales y
comerciales.
Este informe puede ser complementado con la implementación práctica del
modelo utilizando herramientas como TensorFlow o PyTorch.
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.
Título del Documento
Información de autoría
Obra bajo licencia Creative Commons 4.0 “Reconocimiento – NoComercial-Compartir Igual”:
[Link]
Se puede copiar, distribuir y comunicar públicamente la obra y hacer obras derivadas bajo las
siguientes condiciones:
• Reconocimiento a los autores.
• No se permite el uso comercial.
• Se permiten obras derivadas siempre que mantengan la misma licencia que el original.
Sobre los autores:
Foto Nombre y apellidos Breve descripción
Categoría docente
Correo electrónico
Foto Nombre y apellidos Breve descripción
Categoría docente
Correo electrónico
Universidad de las Ciencias Informáticas (UCI),
Carretera a San Antonio de los Baños Km 2 ½,
Torrens, Boyeros, La Habana, Cuba.