0% encontró este documento útil (0 votos)
10 vistas10 páginas

Métodos de Clasificación en Transporte Estudiantil

Este documento compara diferentes métodos de clasificación para determinar el modo de transporte de los estudiantes de la Universidad de Costa Rica. Analiza modelos como regresión logística binomial, análisis discriminante lineal, árboles de decisión, K-vecinos más cercanos, máquinas de soporte vectorial y redes neuronales. Estos modelos obtuvieron una precisión superior al 83% para predecir el modo de transporte. Adicionalmente, aplicó el modelo de ensamble apilamiento a varias técnicas, obteniendo una precisión superior al 86
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
10 vistas10 páginas

Métodos de Clasificación en Transporte Estudiantil

Este documento compara diferentes métodos de clasificación para determinar el modo de transporte de los estudiantes de la Universidad de Costa Rica. Analiza modelos como regresión logística binomial, análisis discriminante lineal, árboles de decisión, K-vecinos más cercanos, máquinas de soporte vectorial y redes neuronales. Estos modelos obtuvieron una precisión superior al 83% para predecir el modo de transporte. Adicionalmente, aplicó el modelo de ensamble apilamiento a varias técnicas, obteniendo una precisión superior al 86
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Revista Infraestructura Vial / LanammeUCR / ISSN electrónico: 2215-3705

Volumen 24 / Número 43 / Enero, 2022


DOI: 10.15517/iv.v24i43.48240
Artículo Científico

Comparación en la aplicación de métodos de clasificación para


determinar el modo de transporte de los estudiantes para acceder
a la sede Rodrigo Facio de la Universidad de Costa Rica en Montes
de Oca, San José, Costa Rica
Comparison in the application of classification methods to determine
the mode of transportation of students to access the Rodrigo Facio
campus of the Universidad Costa Rica in Montes de Oca, San Jose,
Costa Rica
Diana Sanabria Barboza Henry Hernández
Escuela de Ingeniería Civil Escuela de Ingeniería Civil
Universidad de Costa Rica Universidad de Costa Rica
San José, Costa Rica San José, Costa Rica
[Link]@[Link] [Link]@[Link]

Fecha de recepción: 31/08/2021 - Fecha de aprobación: 03/01/2022

RESUMEN ABSTRACT
Este trabajo presenta los resultados de un proceso This work presents the results of an exploratory process
exploratorio donde se aplicaron diferentes métodos de where different classification methods were applied to
clasificación para determinar el modo de transporte determine the mode of transportation for students
de los estudiantes para acceder a la sede Rodrigo Facio de to access the Rodrigo Facio campus of the University
la Universidad de Costa Rica. Dentro de los modelos of Costa Rica. Among the analyzed models are binomial
analizados se encuentran la regresión logística binomial, logistic regression, linear discriminant analysis, decision
análisis discriminante lineal, árboles de decisión, K-vecinos trees, K-closest neighbors, vector support machines
más cercanos, máquinas de soporte vectorial y redes and neural networks. A validation was carried out with
neuronales. Se realizó una validación con el método de the K-folds method and a precision higher than 83%
K-pliegues y se obtuvo una precisión superior al 83% para was obtained for all the models analyzed. Similarly, the
todos los modelos analizados. De manera similar, se aplicó stacking assembly model was applied for the decision tree
el modelo de ensamble apilamiento para las técnicas de techniques, K-nearest neighbors, vector support machines,
árboles de decisión, K-vecinos más cercanos, máquinas random forests, Bootstrap aggregation, binomial logistic
de soporte vectorial, bosques aleatorios, agregación de regression, and the potentiation method, obtaining
Bootstrap, regresión logística binomial y método precision values higher than 86% in all cases. The random
de potenciación obteniendo valores de precisión forest method gives the highest precision.
superiores al 86% en todos los casos, siendo el modelo de
bosques aleatorios el que presentó una mayor precisión. Keywords: mode of transport, multivariate analysis,
ensemble methods, classification methods.
Palabras clave: modo de transporte, análisis multivariado,
métodos de ensamble, métodos de clasificación.

1 La revista Infraestructura Vial del LanammeUCR se distribuye bajo la licencia de


Creative Commons. Reconocimiento-NoComercial-SinObraDerivada 4.0 Internacional
Introducción Conceptualización
El proceso de gestión de la infraestructura de Las modelos de elección de modo de transporte
transporte pasa por una etapa de planificación, en más comúnmente utilizados son los modelos
donde es necesario evaluar diferentes escenarios Logit multinomial (creado en 1970) y Logit
futuros. Las etapas de planificación también incluyen anidado. El primero asume que las alternativas
la evaluación de proyectos y políticas públicas con son independientes entre sí y el segundo se utiliza
el fin de alcanzar metas y objetivos. Por ejemplo, la generalmente en casos que involucran modos
priorización del transporte público tiene un efecto combinados, en los que las alternativas se agrupan en
significativo en la reducción de la congestión. En nido, según Bekhor y Shiftan (2009). Por ejemplo,
Costa Rica, de acuerdo con el Programa Estado de en Costa Rica, se utilizó en los años noventa el
la Nación (2019), para el año 2018 la congestión, modelo Logit para estimar la distribución modal
como una externalidad del transporte, significó en entre el transporte público y el vehículo privado
promedio una pérdida de 2869 dólares anuales por para el Estudio del Transporte Urbano del Gran Área
persona (p.161). Adicionalmente, el fomentar el Metropolitana de 1991. Similarmente, se aplicaron
transporte público puede mejorar la calidad del aire y, modelos Logit para el proyecto de Planificación
por ende, el bienestar social (Alpízar, Piaggio y Pacay, Regional y Urbana de la GAM (PRUGAM) en el año
2017) o contribuir a las metas país en temas del uso 2007 y para el Modelo de Demanda de Transporte
de energía para el transporte (Ministerio de Ambiente Urbano en la GAM del 2016 para estimar la
y Energía, 2015). Adicionalmente, Sagaris, et al. (2021) distribución modal entre el transporte público y el
mencionan los beneficios a la población relacionados vehículo privado (Castro-Rodríguez, Picado-Aguilar
con la reducción del uso del vehículo privado. De y Rodríguez-Shum, 2018). Otro ejemplo a nivel
acuerdo con Jiménez-Serpa, Rojas-Sánchez, y Salas- latinoamericano es el de París-Bravo (2019), quien
Rondón (2015) la implementación de medidas como aplicó modelos Logit multinomiales para determinar
la integración tarifaria son fundamentales para los factores que intervienen en la selección de modo
proveer un transporte público eficiente. acceder al Transmilenio en Bogotá, Colombia o los
aplicados por Jiménez-Serpa y Salas-Rondón (2016)
Para evaluar el impacto de los diferentes proyectos para estudiar los factores que influyen en la selección
y políticas públicas en la selección de modo de de taxi compartido como opción para viajes
transportes, es necesaria su modelación. De acuerdo relacionados con el aeropuerto en el departamento
con Garber y Hoel (2005) una de las etapas del análisis Santander en Colombia. Similarmente, Jiménez-
de demanda corresponde a la selección de modo, el Serpa y Salas-Rondón (2017) aplicaron modelos logit
cual permite determinar el porcentaje de viajes que para estudiar la probabilidad de uso del vehículo
se realizan en vehículo particular y en transporte particular en caso de implementarse un sistema
público. La elección del modo es una de las etapas de tarificación por congestión y Salas-Rondón,
más importantes en el proceso de planificación Jiménez-Serpa, y Martínez-Estupiñán (2021), quienes
del transporte y tiene un impacto directo en las aplicaron este tipo de modelos para evaluar las
decisiones de formulación de políticas de transporte acciones para mejorar la futura operación de los
(Sekhar, 2014). sistemas estratégicos de transporte público.
Por otro lado, el identificar el modo de transporte Para estimar la utilidad de un modo de transporte,
puede ofrecer varias ventajas en diferentes campos de lo usual es usar una combinación lineal de atributos
la ingeniería del transporte como la planificación del para evaluar el costo que representa para el usuario
transporte y los sistemas de transporte inteligentes el utilizar cierto modo de transporte. En el campo de
que conducen a una amplia gama de aplicaciones la ingeniería del transporte, el modelo más popular
con impactos medioambientales y de seguridad vial es el Logit múltiple (multinomial) (Ortúzar, 2012).
(Jahangiri y Rakha, 2014).

2
Sin embargo, después del año 2007 se ha visto
un incremento significativo en las publicaciones Metodología
científicas relacionadas con la aplicación de técnicas El objetivo general de esta investigación es comparar
de clasificación de aprendizaje de máquinas (Hillel, la precisión de técnicas de clasificación para la
Bierlaire, Elshafie y Jin, 2020). Por ejemplo, Zenina determinación del modo de transporte que utilizan
y Borisov (2011) utilizaron análisis discriminantes los estudiantes activos de la Universidad de Costa
escalonados y progresivos para la elección del Rica en el 2018 con base en su frecuencia de visita, las
modo del modelo y compararon los resultados con características del hogar y la ubicación de su residencia.
el modelo Multinomial Logit (MNL, por sus siglas en
inglés) y los modelos de árbol de decisión (DT, por sus Interesa explorar el rendimiento de modelos
siglas en inglés). paramétricos de clasificación posteriores al modelo
Logit multinomial, basadas en la conformación de
Adicionalmente, Sekhar (2014) indica que modelos grupos de personas de un entorno común con base
como el logit, redes neuronales artificiales, sets de en coincidencia de características y relaciones de
teoría difusa y neuro-difusos tienen alta precisión. independencia entre sí: tanto técnicas basadas en
Por otro lado, Souza Pitombo, Schindler Gomes Da cálculos estadísticos, como los modelos previamente
Costa y Salgueiro (2015) aplicaron la metodología mencionados y el análisis de discriminante lineal,
de árboles de decisión donde la mayoría de los así como otras basadas en inteligencia artificial
encuestados usaban el modo motorizado privado como árboles de decisión y clasificación, K-vecinos
(60,6%), seguido del modo no motorizado (21,2%) más cercanos, máquinas de soporte vectorial y
y el transporte público (18,2%). La variable más redes neuronales.
importante (que explica mejor la variabilidad de los
datos teniendo en cuenta la elección del modo) fue El registro utilizado para esta investigación es la
“Licencia de conducir”, que divide los datos en dos Encuesta de Transporte UCR llevada a cabo por el
ramas principales. LanammeUCR (Hernández-Vega y Umaña-Marín,
2018), la cual tuvo el objetivo de caracterizar a los
Vassilev (2018) combinó tres herramientas de minería viajes de las personas usuarias de las instalaciones
de datos: análisis de componentes principales, de la Universidad de Costa Rica (UCR), identificando
distancia de Mahalanobis y análisis discriminante zonas de generación de viajes, perfil personal y
lineal para explorar el modo de transporte utilizado, a de viajes, medios de transporte utilizados, rutas
partir de datos recolectados con teléfonos celulares. empleadas, entre otros. El cuestionario se aplicó
Similarmente, Hillel, Elshafie y Jin (2018) aplicaron la en formato electrónico mediante la plataforma
metodología de árboles de decisión con aumento de LimeSurvey, tomando en cuenta aspectos prácticos,
gradiente estocástico y realizaron una validación especialmente considerando su bajo costo. Se
de K-pliegues. Adicionalmente, Sekhar y Madhu enviaron correos electrónicos al estudiantado y al
(2016) aplicaron el modelo de bosque aleatorio para personal docente y administrativo de la universidad.
modelar la selección de modo en Delhi, India. Las respuestas recibidas al cuestionario fueron
Existen estudios donde se determina el modo de totalmente voluntarias, por lo que es de esperar de
transporte a partir de datos recolectados de manera que exista un sesgo de participación.
automática. Por ejemplo, Dabiri y Heaslip (2018) El estudiantado y el personal docente y
aplicaron redes neuronales convolucionales para administrativo tuvieron acceso a la encuesta durante
predecir el modo de transporte a partir de datos el mes de junio del 2018, a través del enlace http://
obtenidos de Sistemas de Posicionamiento Global. [Link]. La duración promedio del
Similarmente, Jahangiri y Rakha (2014) aplicaron llenado de las preguntas fue de 13 minutos para
máquinas de soporte vectorial utilizando datos el caso de los estudiantes y de 12 minutos para el
de diferentes sensores para predecir el modo de caso de las personas funcionarias de la universidad
transporte utilizados por los diferentes usuarios. (Hernández-Vega y Umaña-Marín, 2018).

3
La base de datos disponible cuenta con 1733 registros. • Cantidad de automóviles en el hogar. Variable
En cuanto a tipo de usuario cabía la posibilidad de categórica que ofrece tres opciones: 0, 1 o más
seleccionar múltiples roles por respuesta, se resalta de 2.
que el 82,23% declaró ser estudiante regular de la
Universidad (diplomado, bachillerato o licenciatura), Las siguientes variables que se refieren a la
paralelamente 7,16% se identificó como estudiante provincia, consideran la dinámica de movilidad
de posgrado, 6,41% como docente y 6,06% como de los estudiantes que viven fuera de la Gran Área
funcionario administrativo, las personas que también Metropolitana, principalmente, y su movilización a
se denominaron deportistas, visitantes, estudiantes residencias alquiladas o temporales en el campus
de curso libre, egresados, proveedores no alcanzan el durante el periodo lectivo, y su retorno a su lugar de
1% en cada categoría. origen en los periodos de receso de lecciones: fines
de semana y meses de vacaciones.
Así, el presente trabajo buscó enfocarse en personas
usuarias que son estudiantes regulares, cuyo nivel • Provincia de residencia (entre semana, de
más alto de educación declarado es universitaria marzo a junio y de julio a diciembre).
incompleta y son estudiantes activos. Además, el
análisis se limitó a estudiantes que visitan el campus • Provincia de residencia durante los fines
universitario Rodrigo Facio, en San Pedro Montes de de semana.
Oca, y excluyendo a quienes visitan exclusivamente • Provincia de residencia durante los meses de
alguna otra sede. Finalmente, interesó considerar enero y febrero.
datos de ingreso monetario, por lo cual se excluyeron
los registros que no contaban con respuestas • Fincas de la sede Rodrigo Facio que visita.
asociadas. La selección final se compone de 626 Cantidad de fincas del campus que suelen visitar:
registros válidos. campus central, Ciudad de la Investigación
e Instalaciones Deportivas, por lo cual las
Seguidamente, se detalla la totalidad variables de respuestas se categorizaron, respectivamente,
la encuesta consideradas para el presente trabajo, en 1, 2 o 3.
además de su descripción y tratamiento preliminar.
En la mayoría se agruparon ciertas categorías • Días de la semana que visita la Universidad.
originales para generar rangos representativos y Cantidad de días que visita la Universidad en
evitar rangos con poca representación de respuestas: una semana, los valores parten desde 1 días
hasta la categoría 5 o más.
• Edad. Variable discreta, edad de los estudiantes,
cuyo rango va desde los 17 a los 47 años, con • Tiempo promedio de llegada a la Universidad.
una media de 21,8 años. El 75% de las personas Tiempo en rangos que parten desde los 15
tenía 23 años o menos. minutos hasta más de 1 hora.
• Sexo. La muestra está compuesta exactamente • Tiempo promedio de retorno de la
por 50% estudiantes mujeres y 50% hombres. Universidad. Tiempo en rangos que parten
desde los 15 minutos hasta más de 1 hora.
• Ingreso bruto mensual del hogar. Esta variable
es categórica, tiene rangos que van desde menos Entre todas las posibilidades que ofrece la información
de 250 mil colones (443 dólares de los Estados de la encuesta, la variable categórica que se planteó
Unidos de América) mensuales hasta 1 millón de como respuesta de los modelos por construir es
colones (1773 dólares de los Estados Unidos el modo de transporte que cada persona utiliza
de América), los rangos superiores a este valor más frecuentemente (es decir, que se está ante una
se agruparon en la categoría “Más de 1 millón”. encuesta de preferencias reveladas). Considerando
• Cantidad de personas en el hogar. Variable el objetivo de la investigación y la versatilidad que
categórica, número de personas que una variable dependiente dicotómica ofrece para la
conforman el hogar de la persona encuestada simplificación y aplicación de diversos métodos, los
en rangos: uno o dos miembros, tres, cuatro, modos de transporte encuestados se categorizaron
más de cinco miembros. previamente en dos grupos:

4
• Movilidad activa - Servicio público colectivo calculando los indicadores de precisión y, finalmente,
(MASP): camina, bicicleta, servicio de autobús promediando los resultados de todas las iteraciones.
externo de la universidad (conocido como ruta
bus UCR) para el transporte de estudiantes, bus En una segunda etapa, se exploraron los resultados de
regular, tren, otro (87,06% de la selección final). la combinación de modelos predictivos, a través de los
modelos de ensambles que incluyen la generación de
• Vehículo particular o servicio público pliegues de construcción e iteraciones: Agregación
individual (motorizado) (VP): Carro (conductor de Bootstrap, Bosques Aleatorios, Método de
o pasajero), Moto (conductor o pasajero), Uber, potenciación y Apilamiento.
Taxi (12,94%).

Para alcanzar el objetivo planteado primeramente se


aplicaron seis técnicas diferentes al 80% del conjunto Resultados y discusión
de datos partiendo de la regresión logística binomial, Para la evaluación de los modelos se aplicó un método
en combinación con métodos de validación para de validación cruzada de K-pliegues 10 pliegues y 5
evitar el sesgo de estimación de la precisión en las repeticiones, y se obtuvo una precisión superior al 87%
predicciones al emplear el conjunto total de registros para todos los modelos analizados, con excepción de
para su construcción. El 20% restante se reservó para la aplicación de redes neuronales (83%). La técnica de
corroboraciones finales de validación de los resultados. K-vecinos más cercanos presentó la precisión más alta,
La validación empleada parte del principio de tal como se aprecia en el Cuadro 1.
retención, utilizando una parte de los datos para Respecto a la regresión logística binomial aplicada,
construir el modelo y otra parte para ensayarlo, solamente las variables, ningún vehículo en el hogar,
proceso que se optimiza al aprovechar la técnica de un vehículo en el hogar, si el estudiante reside fuera
validación cruzada K-pliegues que genera grupos de la Gran Área Metropolitana (GAM) los fines de
aleatorios del total de datos. De esta manera, es semana, o si el tiempo de llegada es entre 45 y 60
posible iterar la construcción de cada modelo minutos, resultaron ser significativos en el modelo,
excluyendo determinado “K-pliegue” a la vez, como se evidencia en el Cuadro 2.

Cuadro 1. Medidas promedio de evaluación de predicciones de modo de transporte estudiantil,


según modelos de clasificación base construidos y aplicación de validación cruzada K-pliegues

Técnica Error Precisión Sensibilidad Especificidad


Regresión Logística Binomial 0,10609 0,89391 0,96798 0,38500
Análisis Discriminante Lineal 0,12202 0,87798 0,95173 0,38905
Árboles de decisión 0,12386 0,87614 0,96353 0,27881
K-vecinos más cercanos 0,08000 0,92000 0,97268 0,33405
Máquinas de soporte vectorial 0,11798 0,88202 0,97475 0,24048
Redes neuronales 0,16115 0,83885 0,90981 0,33833

5
Cuadro 2. Coeficientes significativos del modelo de Regresión Logística Binomial
de predicciones de modo de transporte estudiantil

Variable Coeficiente Estadístico z Probabilidad (>|z|) Significancia

Ningún vehículo en el hogar 0,057 -3,0217 0,0025 **


Un vehículo en el hogar 0,121 -3,4757 0,0005 ***
Fuera de la GAM los fines
0,16 -1,9213 0,0547 .
de semana
Tiempo de llegada
0,081 -2,1636 0,0305 *
entre 45-60 min.

Similarmente, el método de árbol de decisión (ver vive fuera de la Gran Área Metropolitana (GAM)
Figura 1) utiliza la tenencia de vehículo en el hogar durante los fines de semana, seguido del tiempo de
como primer criterio de selección, seguido del tiempo retorno (en este caso entre 45 y 60 minutos).
de retorno, del ingreso en el hogar, si el estudiante

Figura 1. Árbol de decisión y clasificación del modo de transporte de estudiantes de la Universidad de Costa Rica

6
Específicamente, para el modelo de K-vecinos, y con Respecto a la precisión de predicciones de modo
base en un 20% de los datos originales reservados de transporte, se aplicó el modelo de ensamble de
para validación, se obtuvo una precisión superior al apilamiento y para las diferentes técnicas analizadas
85%, una sensibilidad del 98% y una especificidad del se obtuvieron precisiones con medias superiores
11%, como se detalla en el Cuadro 3. al 86% (ver Cuadro 4), resultados muy similares se
obtuvieron con los modelos individuales.

Cuadro 3. Medidas promedio de evaluación de predicciones de modo de transporte


estudiantil, según el modelo K-vecinos más cercanos y con base en 20% de los
datos originales reservados para validación

Técnica Error Precisión Sensibilidad Especificidad

K-vecinos más cercanos 0,14286 0,85714 0,98148 0,11111

Cuadro 4. Distribución estadística de la precisión de predicciones de modo de transporte


estudiantil según el modelo de ensamble Apilamiento, para diferentes técnicas

Técnica Mínimo Primer cuartil Mediana Media Tercer cuartil Máximo

Árboles de decisión 0,8000 0,8600 0,8776 0,8676 0,8800 0,9000


K-vecinos más cercanos 0,8235 0,8627 0,8800 0,8749 0,8800 0,9184
Máquinas de
0,8235 0,8782 0,8824 0,8885 0,9015 0,9388
soporte vectorial
Bosques aleatorios 0,8400 0,8800 0,8980 0,8937 0,9184 0,9600
Agregación de Bootstrap 0,8000 0,8600 0,8788 0,8789 0,9000 0,9600
Regresión Logística Binomial 0,8235 0,8600 0,8800 0,8765 0,9000 0,9600
Método de potenciación 0,8235 0,8782 0,8824 0,8901 0,9000 0,9600

Cuadro 5. Medidas promedio de evaluación de predicciones de modo de


transporte estudiantil, según modelos de clasificación de ensamble

Modelo Error Precisión

Agregación de Bootstrap 0,12090 0,87910


Bosques Aleatorios 0,14180 0,85820
Método de potenciación 0,11800 0,88200
Apilamiento 0,10700 0,89300

7
Las medidas promedio de evaluación de predicciones Se recomienda explorar, en estudios posteriores, otros
para el modelo de ensamble Apilamiento con base métodos de clasificación de aprendizaje bayesiano
en 20% de los datos originales reservados para como el explorador bayesiano ingenuo aplicado por
validación tienen una precisión del 89% siendo este Hagenauer y Helbich (2017), o realizar pruebas de
modelo el que presenta mejores resultados, según lo hipótesis, como la Kruskal-Wallis sobre las diferencias
observado en el Cuadro 5. de rendimiento entre los clasificadores que también
fue aplicada por Hagenauer y Helbich (2017).
Los resultados obtenidos se encuentran dentro
de los rangos obtenidos por Hagenauer y Helbich Sería interesante utilizar en futuros proyectos similares
(2017) y superiores a los reportados por Omrani otros modelos para la clasificación, como el enfoque
(2015). Al comparar los resultados obtenidos en el de aprendizaje automático supervisado utilizado
presente análisis con otros estudios de tenencia de por Bjerre-Nielsen, Minor, Sapieżyński, Lehmann y
vehículo, por ejemplo, se puede decir presentan Lassen (2020) para determinar el modo de transporte
valores de precisión ligeramente inferiores y utilizado a partir de datos de Wi-fi y Bluetooth.
similares a los encontrados por Muhsin Zambang,
Jiang, y Wahab (2021) en un estudio realizado en Finalmente, sería recomendable aplicar estos
Ghana, pero superiores a los determinados por métodos con datos más recientes con el fin de
Kaewwichian, Tanwanichkul y Pitaksringkarn (2019) valorar posibles variaciones recientes en los patrones
en otro estudio similar en Tailandia. En estos estudios de movilidad.
se aplicaron algunas de las técnicas incluidas en el
presente análisis.
Agradecimientos
Conclusiones y Se agradece a Deiby Solano, profesor del posgrado
en Estadística en la Universidad de Costa Rica, los
recomendaciones comentarios y sugerencias para mejorar el presente
estudio. Además, se agradece al Laboratorio
En el presente estudio se logró comparar la precisión Nacional de Materiales y Modelos Estructurales de la
de técnicas de clasificación para la determinación Universidad de Costa Rica por proveer la información
del modo de transporte que utilizan los estudiantes requerida para el presente estudio.
activos de la Universidad de Costa Rica en el 2018 con
base en su frecuencia de visita, las características del
hogar y la ubicación de su residencia. Los métodos Referencias
estudiados brindan en términos generales buenos
resultados, por lo que su aplicación podría tener un Alpízar, F., Piaggio, M., y Pacay, E. (2017). Valoración
potencial similar a los métodos logit tradicionales. económica de los beneficios en la salud
asociados a la reducción de la contaminación
Respecto a los modelos de clasificación base del aire. Santiago, Chile: CEPAL.
construidos y aplicación de validación cruzada
K-pliegues, la técnica de K-vecinos más cercanos Bekhor, S., y Shiftan, Y. (2009). Specification and
presentó la precisión más alta. Cuando se aplicó Estimation of Mode Choice Model Capturing
el modelo de ensamble de apilamiento y para Similarity between Mixed Auto and Transit
las diferentes técnicas analizadas se obtuvieron Alternatives. Journal of Choice Modelling, 3(2),
precisiones con medias superiores al 86%, siendo 29-49. DOI: 10.1016/S1755-5345(13)70034-4
la técnica de bosques aleatorios la que presentó Bjerre-Nielsen, A., Minor, K., Sapieżyński, P.,
resultados ligeramente superiores a las otras técnicas. Lehmann, S., y Lassen, D. D. (2020). Inferring
Los resultados fueron muy similares a los que se transportation mode from smartphone
obtuvieron con los modelos individuales. sensors: Evaluating the potential of Wi-Fi and
Bluetooth. PLOS ONE, 15(7), e0234003. DOI:
10.1371/[Link].0234003

8
Castro-Rodríguez, L, Picado-Aguilar, G., y Rodríguez- Jiménez-Serpa, J. C., Rojas-Sánchez, A. E., y Salas-
Shum, S. (2018). Evolución histórica de la Rondón, M. H. (2015). Tariff integration for
modelación de demanda de transporte public transportation in the metropolitan area
urbano en Costa Rica. Infraestructura Vial, 20, of Bucaramanga. INGE CUC, 11(1), 25-33. DOI:
4-47. DOI: 10.15517/iv.v20i1.33541 10.17981/ingecuc.11.1.2015.02

Dabiri, S., y Heaslip, K. (2018). Inferring transportation Jiménez-Serpa, J. C., y Salas-Rondón, M. H. (2016).
modes from GPS trajectories using a Un caso de estudio sobre los factores que
convolutional neural network. Transportation influyen para viajar en taxi compartido desde
Research Part C: Emerging Technologies, 86, y hacia el aeropuerto. Ingeniería de Transporte,
360-371. DOI: 10.1016/[Link].2017.11.021 20(01), 33-46.

Garber, N. y Hoel, L. (2005). Ingeniería de tránsito y Jiménez-Serpa, J. C., y Salas-Rondón, M. H. (2017).


carreteras. México, México D. F.: Thomson. Aplicación de modelos econométricos para
estimar la aceptabilidad de una tasa por
Hagenauer, J., y Helbich, M. (2017). A comparative congestión vehicular. INGE CUC, 13(2), 60-78.
study of machine learning classifiers for DOI: 10.17981/ingecuc.13.2.2017.08
modeling travel mode choice. Expert Systems
with Applications, 78, 273-282. DOI: 10.1016/j. Kaewwichian, P., Tanwanichkul, L., y Pitaksringkarn, J.
eswa.2017.01.057 (2019). Car ownership demand modeling using
machine learning: Decision trees and neural
Hernández-Vega, H. y Umaña-Marín, G. (2018). networks. International Journal of GEOMATE,
Encuesta de Transporte 2018. Sede Rodrigo 17(62), 219-230. DOI: 10.21660/2019.62.94618
Facio Universidad de Costa Rica. Recuperado
de: [Link] Ministerio de Ambiente y Energía (2015). VII Plan
repositorio/handle/50625112500/1582 Nacional de Energía 2015-2030. Programa
de las Naciones Unidas para el Desarrollo
Hillel, T., Bierlaire, M., Elshafie, M., y Jin, Y. (2020). PNUD. Recuperado de: [Link]
A systematic review of machine learning recursos/2015/pdf/[Link]
classification methodologies for modelling
passenger mode choice. Journal of Choice Muhsin Zambang, M. A., Jiang, H., y Wahab, L. (2021).
Modelling, 38, 100221. DOI: 10.1016/j. Modeling vehicle ownership with machine
jocm.2020.100221 learning techniques in the Greater Tamale
Area, Ghana. PLOS ONE, 16(2), e0246044. DOI:
Hillel, T., Elshafie, M. Z., y Jin, Y. (2018). Recreating 10.1371/[Link].0246044
passenger mode choice-sets for transport
simulation: A case study of London, UK. Omrani, H. (2015). Predicting travel mode
Proceedings of the Institution of Civil Engineers- of individuals by machine learning.
Smart Infrastructure and Construction, 171(1), Transportation Research Procedia, 10, 840-849.
29-42. DOI: 10.1680/jsmic.17.00018 DOI: 10.1016/[Link].2015.09.037

Jahangiri, A., y Rakha, H. (2014). Developing a Ortúzar, J.D. (2012). Modelos de demanda de
support vector machine (SVM) classifier for transporte. Santiago, Chile: Ediciones UC.
transportation mode identification by using
mobile phone sensor data. En Transportation París-Bravo, D. (2019). Factores determinantes para
Research Board 93rd Annual Meeting. la selección de modo auxiliar para acceder a
Conferencia de Transportation Research Transmilenio (Tesis de grado). Universidad de
Board, Washington D.C., Estados Unidos. los Andes, Colombia.

9
Programa Estado de la Nación (2019). Informe Estado
de la Nación 2019. Recuperado de: [Link]
[Link]/wpcontent/uploads/2019/11/
informe_estado_nacion_2019.pdf

Sagaris, L., Mindell, J., Rojas-Rueda, D., Cortínez-


O´Ryan, A., Sadrangani, K., Casanave-Macías,
J., González-Sánchez, Y., y Hernández-
Vega, H. (2021). Transporte, Salud, Equidad
Acercamientos urgentes en un mundo con y
post-Covid 19. Recuperado de: [Link]
[Link]/transporte-salud-y-equidad/

Salas-Rondón, M. H., Jiménez-Serpa, J. C., y Martínez-


Estupiñán, Y. F. (2021). Subsidio a la tarifa
para fortalecer la operación de los sistemas
estratégicos de transporte público en
Colombia. Revista UIS Ingenierías, 20(3), 77-90.
DOI: 10.18273/revuin.v20n3-2021005

Sekhar, C. (2014). Mode Choice Analysis: The Data,


the Models and Future Ahead. International
Journal for Traffic & Transport Engineering, 4(3),
269 - 285. DOI: 10.7708/ijtte.2014.4(3).03

Sekhar, C. R., y Madhu, E. (2016). Mode choice


analysis using random forrest decision trees.
Transportation Research Procedia, 17, 644-652.
DOI: 10.1016/[Link].2016.11.119

Souza Pitombo, C., Schindler Gomes Da Costa,


A., y Salgueiro, A. R. (2015). Proposal of a
sequential method for spatial interpolation of
mode choice. Boletim de Ciências Geodésicas,
21(2), 274-289. DOI: 10.1590/S1982-
21702015000200016

Vassilev, A. (2018). Data Mining Applied to


Transportation Mode Classification Problem.
Proceedings of the 4th International Conference
on Vehicle Technology and Intelligent
Transport Systems (VEHITS), 36-46. DOI:
10.5220/0006633300360046

Zenina, N., y Borisov, A. (2011). Transportation Mode


Choice Analysis Based on Classification
Methods. Scientific Journal of Riga Technical
University Computer Sciences, 45(1), 49-53. DOI:
10.2478/v10143-011-0041-2

10

También podría gustarte