“AÑO DE LA ESPERANZA Y EL FORTALECIMIENTO DE LA
DEMOCRACIA”
Base de datos "RBC”:“Sistema de clasificación de la calidad del vino"
Integrantes:
-Correa Gómez Xavier Antonio
-Flores Navarro Karol
-Córdova Córdova Luis Alexander
-Rivas Ruiz Jeriff Stive
-Chunga Chunga Maricielo
Docente:
Gutiérrez Segura Flabio
Curso:
Fundamentos matemáticos de la Inteligencia Artificial
Ciclo: V
PIURA – PERÚ
2026
Introducción
El razonamiento basado en casos (Case-Based Reasoning, CBR) es una técnica de inteligencia
artificial que resuelve nuevos problemas a partir de la recuperación y adaptación de experiencias
previas almacenadas en una base de conocimiento. Este enfoque se fundamenta en el principio
de que situaciones similares tienden a presentar soluciones semejantes, lo que permite generar
predicciones a partir de casos ya conocidos.
En el presente trabajo se empleó la base de datos “Sistema de clasificación de la calidad del
vino" la cual contiene información sobre las propiedades fisicoquímicas de diferentes muestras
de vino, tales como acidez, densidad, contenido de alcohol y concentración de sulfatos, entre
otras variables. Asimismo, la base de datos incluye una valoración de la calidad del vino,
utilizada como variable objetivo.
Para la implementación del sistema de razonamiento basado en casos se utilizó el software
FreeCBR, herramienta que permite almacenar, recuperar y comparar casos similares con el
propósito de realizar predicciones sobre nuevos registros. Previamente, fue necesario adecuar la
estructura de la base de datos al formato requerido por el software, definiendo correctamente los
atributos y sus respectivos tipos de datos.
El desarrollo de este trabajo permitió aplicar conceptos fundamentales de inteligencia artificial y
explorar el uso de sistemas basados en conocimiento para la resolución de problemas de
clasificación en un contexto real.
1. Elección de la base de datos
Para el desarrollo del presente trabajo se seleccionó la base de datos:
[Link]
Este conjunto de datos contiene información fisicoquímica de diferentes muestras de vino y su
correspondiente nivel de calidad. La base de datos es ampliamente utilizada en problemas de
aprendizaje automático y sistemas inteligentes debido a la variedad de atributos que presenta.
La base de datos elegida corresponde a un problema de clasificación, donde el objetivo es
predecir la variable calidad a partir de las características fisicoquímicas del vino.
2. Descripción de la base de datos
La base de datos está conformada por registros que describen las propiedades químicas y físicas
de diferentes tipos de vino.
Los atributos considerados son los siguientes:
Atributo Tipo de dato Descripción
acidez_fija Float Acidez fija del vino
acidez_volatil Float Acidez volátil del vino
Concentración de ácido
acido_citrico Float
cítrico
azucar_residual Float Cantidad de azúcar residual
cloruros Float Concentración de cloruros
Cantidad de dióxido de
dioxido_azufre_libre Int
azufre libre
Cantidad total de dióxido de
dioxido_azufre_total Int
azufre
densidad Float Densidad del vino
pH Float Nivel de pH
sulfatos Float Concentración de sulfatos
alcohol Float Porcentaje de alcohol
Calificación de la calidad
calidad Int
del vino
tipo_vino String Tipo de vino (red o white)
La variable de salida utilizada para la predicción es calidad.
3. Obtención de la base de datos
La base de datos fue obtenida del repositorio
• Kaggle datasets: [Link]
4. Conversión de la base de datos a formato TXT
Para su utilización en el software FreeCBR, la base de datos fue convertida al formato de texto
plano (.txt).
El archivo generado presenta las siguientes características:
Los datos se encuentran separados por tabulaciones.
La primera fila contiene los nombres de los atributos.
La segunda fila especifica el tipo de dato de cada atributo.
Los registros se encuentran organizados por columnas.
Los tipos de datos empleados son los aceptados por FreeCBR:
String
Float
Int
En formato txt:
5. Base de datos cargada en FreeCBR
Una vez preparado el archivo en formato .txt, se procedió a su carga en el software FreeCBR
siguiendo el procedimiento indicado por la [Link] la importación, FreeCBR
reconoció los nombres de los atributos y los tipos de datos definidos en la segunda fila del
archivo. Finalmente, se verificó que todos los registros fueran cargados correctamente para su
posterior utilización en el proceso de razonamiento basado en casos.
6. Predicción de nuevos casos
Caso 1.
Caso 2.
Caso 3.
Caso 4.
Caso 5.
Caso 6.
Caso 7.
Caso 8.
Caso 9.
Caso 10.
Conclusiones
-El razonamiento basado en casos constituye una técnica de inteligencia artificial que
permite resolver nuevos problemas mediante la recuperación de experiencias
previamente almacenadas, facilitando la obtención de predicciones a partir de la
similitud entre casos.
-La base de datos elegida resultó adecuada para la aplicación de esta metodología,
debido a que contiene atributos fisicoquímicos relevantes que permiten caracterizar las
muestras de vino y establecer relaciones con la variable de salida correspondiente a la
calidad.
-La preparación de la base de datos en formato .txt, así como la correcta definición de
los tipos de datos y la organización de los atributos, fueron aspectos fundamentales para
garantizar la importación exitosa de la información en el software FreeCBR.
-El uso de FreeCBR permitió realizar predicciones sobre nuevos casos a partir de la
comparación con registros previamente almacenados, evidenciando la utilidad de este
enfoque para problemas de clasificación.
-El desarrollo del presente trabajo permitió fortalecer los conocimientos relacionados
con los fundamentos matemáticos de la inteligencia artificial y comprender la
importancia de la calidad y estructura de los datos en el desempeño de los sistemas
inteligentes.