Big data
Big data, macrodatos, datos masivos, inteligencia de datos o datos a gran
escala es un concepto que hace referencia a un conjuntos de datos tan grandes
que aplicaciones informáticas tradicionales de procesamiento de datos no son
suficientes para tratar con ellos y los procedimientos usados para encontrar
patrones repetitivos dentro de esos datos. En los textos científicos en español
con frecuencia se usa directamente el término en inglés big data, tal como
aparece en el ensayo de Viktor Schönberger: La revolución de los datos
masivos.2
La disciplina dedicada a los datos masivos se enmarca en el sector de
las tecnologías de la información y la comunicación. Esta disciplina se ocupa
de todas las actividades relacionadas con los sistemas que manipulan
grandes conjuntos de datos. Las dificultades más habituales vinculadas a la
gestión de estas cantidades de datos se centran en la recolección y el
almacenamiento,3 búsqueda, compartición, análisis,4 y visualización. La
tendencia a manipular enormes cantidades de datos se debe a la necesidad en
muchos casos de incluir dicha información para la creación de informes
estadísticos y modelos predictivos utilizados en diversas materias, como los
análisis de negocio, publicitarios, los datos de enfermedades infecciosas, el
espionaje y seguimiento a la población o la lucha contra el crimen
organizado.5
Definición[editar]
Big data o macrodatos es un término que hace referencia a una cantidad de
datos tal que supera la capacidad del software convencional para ser
capturados, administrados y procesados en un tiempo razonable. El volumen
de los datos masivos crece constantemente. En 2012 se estimaba su tamaño de
entre una docena de terabytes hasta varios petabytes de datos en un único
conjunto de datos. En la metodología MIKE2.0 dedicada a investigar temas
relacionados con la gestión de información, definen big data14 en términos de
permutaciones útiles, complejidad y dificultad para borrar registros
individuales.
Captura[editar]
¿De dónde provienen todos estos datos? Los fabricamos directa e
indirectamente segundo tras segundo. Un iPhone hoy en día tiene más
capacidad de cómputo que la NASAcuando el hombre llegó a la luna 20 por lo
que la cantidad de datos generados por persona y en unidad de tiempo es muy
grande. Catalogamos la procedencia de los datos según las siguientes
categorías:21
Generados por las personas: el hecho de enviar correos electrónicos o
mensajes por WhatsApp, publicar un estado
en Facebook, tuitear contenidos o responder a una encuesta por la calle son
cosas que hacemos a diario y que crean nuevos datos y metadatos que
pueden ser analizados. Se estima que cada minuto al día se envían más de
200 millones de correos electrónicos, se comparten más de 700.000 piezas
de contenido en Facebook, se realizan dos millones de búsquedas en
Google o se editan 48 horas de vídeo en YouTube.22 Por otro lado, las
trazas de utilización en un sistema ERP, incluir registros en una base de
datos o introducir información en una hoja de cálculo son otras formas de
generar estos datos.
Transacciones de datos: la facturación, las llamadas o
las transacciones entre cuentas generan información que tratada puede ser
datos relevantes. Un ejemplo más claro lo encontraremos en las
transacciones bancarias: lo que el usuario conoce como un ingreso de X
euros, la computación lo interpretará como una acción llevada a cabo en
una fecha y momento determinado, en un lugar concreto, entre unos
usuarios registrados, y más metadatos.
Marketing electrónico y web: se generan una gran cantidad de datos
cuando se navega por internet. Con la web 2.0 se ha roto
el paradigma webmaster-contenido-lector y los mismos usuarios se
convierten en creadores de contenido gracias a su interacción con el sitio.
Existen muchas herramientas de seguimiento utilizadas en su mayoría con
fines de marketing y análisis de negocio. Los movimientos de ratón quedan
grabados en mapas de calor y queda registro de cuánto pasamos en cada
página y cuándo las visitamos.
Máquina a máquina (machine to machine, M2M): son las tecnologías
que comparten datos con dispositivos: medidores, sensores de temperatura,
de luz, de altura, de presión, de sonido… que transforman las magnitudes
físicas o químicas y las convierten en datos. Existen desde hace décadas,
pero la llegada de las comunicaciones inalámbricas (Wi-
Fi, Bluetooth, RFID…) ha revolucionado el mundo de los sensores.
Algunos ejemplos son los GPS en la automoción o los sensores de signos
vitales en la medicina.
Biométrica: son el conjunto de datos que provienen de la seguridad,
defensa y servicios de inteligencia.23 Son cantidades de datos generados
por lectores biométricos como escáneres de retina, escáneres de huellas
digitales, o lectores de cadenas de ADN. El propósito de estos datos es
proporcionar mecanismos de seguridad y suelen estar custodiados por los
ministerios de defensa y departamentos de inteligencia. Un ejemplo de
aplicación es el cruce de ADN entre una muestra de un crimen y una
muestra en nuestra base de datos.
Transformación[editar]
Una vez encontradas las fuentes de los datos necesarios, muy posiblemente
dispongamos de un sinfín de tablas de origen que no estarán relacionadas. El
siguiente objetivo es hacer que los datos se recojan en un mismo lugar y darles
un formato.
Aquí entran en juego las plataformas extraer, transformar y cargar (ETL). Su
propósito es extraer los datos de las diferentes fuentes y sistemas, para
después hacer transformaciones (conversiones de datos, limpieza de datos
sucios, cambios de formato…) y finalmente cargar los datos en la base de
datos o almacén de datos especificada.24 Un ejemplo de plataforma ETL es
el Pentaho Data Integration, más concretamente su aplicación Spoon.
Almacenamiento NoSQL[editar]
El término NoSQL se refiere a Not Only SQL y son sistemas de
almacenamiento que no cumplen con el esquema entidad-relación. 25 Proveen
un sistema de almacenamiento mucho más flexible y concurrente y permiten
manipular grandes cantidades de información de manera mucho más rápida
que las bases de datos relacionales.
Distinguimos cuatro grandes grupos de bases de datos NoSQL:
Almacenamiento clave-valor (key-value): los datos se almacenan de
forma similar a los mapas o diccionarios de datos, donde se accede al dato
a partir de una clave única. 26 Los valores (datos) son aislados e
independientes entre ellos, y no son interpretados por el sistema. Pueden
ser variables simples como enteros o caracteres, u objetos. Por otro lado,
este sistema de almacenamiento carece de una estructura de datos clara y
establecida, por lo que no requiere un formateo de los datos muy estricto.27
Son útiles para operaciones simples basadas en las claves. Un ejemplo es el
aumento de velocidad de carga de un sitio web que puede utilizar diferentes
perfiles de usuario, teniendo mapeados los archivos que hay que incluir según
el id de usuario y que han sido calculados con anterioridad. Apache
Cassandra es la tecnología de almacenamiento clave-valor más reconocida por
los usuarios.28
Almacenamiento documental: las bases de datos documentales guardan
un gran parecido con las bases de datos Clave-Valor, diferenciándose en el
dato que guardan. Si en el anterior no se requería una estructura de
datos concreta, en este caso guardamos datos semiestructurados. 28 Estos
datos pasan a llamarse documentos, y pueden estar formateados
en XML, JSON, Binary JSON o el que acepte la misma base de datos.
Todos los documentos tienen una clave única con la que pueden ser
accedidos e identificados explícitamente. Estos documentos no son
opacos al sistema, por lo que pueden ser interpretados y lanzar queries
sobre ellos.26 Un ejemplo que aclare cómo se usa lo encontramos en
un blog: se almacena el autor, la fecha, el título, el resumen y el
contenido del post.
CouchDB o MongoDB28 son quizá las más conocidas. Hay que hacer
mención especial a MapReduce, una tecnología de Google inicialmente
diseñada para su algoritmo PageRank, que permite seleccionar un
subconjunto de datos, agruparlos o reducirlos y cargarlos en otra colección,
y a Hadoop que es una tecnología de Apache diseñada para almacenar y
procesar grandes cantidades de datos.
Almacenamiento en grafo: las bases de datos en grafo rompen con la
idea de tablas y se basan en la teoría de grafos, donde se establece que
la información son los nodos y las relaciones entre la información son
las aristas,28 algo similar al modelo relacional. Su mayor uso se
contempla en casos de relacionar grandes cantidades de datos que
pueden ser muy variables. Por ejemplo, los nodos pueden
contener objetos, variables y atributos diferentes en unos y otros. Las
operaciones de join se sustituyen por recorridos a través del grafo, y se
guarda una lista de adyacencias entre los nodos.26 Encontramos un
ejemplo en las redes sociales: en Facebook cada nodo se considera
un usuario, que puede tener aristas de amistad con otros usuarios,
o aristas de publicación con nodos de contenidos. Soluciones
como Neo4J y GraphDB28 son las más conocidas dentro de las bases de
datos en grafo.
Almacenamiento orientado a columnas: por último, el
almacenamiento Column-Oriented es parecido al Documental. Su
modelo de datos es definido como “un mapa de
datos multidimensional poco denso, distribuido y persistente”. 26 Se
orienta a almacenar datos con tendencia a escalar horizontalmente, por
lo que permite guardar diferentes atributosy objetos bajo una misma
clave. A diferencia del documental y el clave-valor, en este caso se
pueden almacenar varios atributos y objetos, pero no serán
interpretables directamente por el sistema. Permite agrupar columnas
en familias y guardar la información cronológicamente, mejorando el
rendimiento. Esta tecnología se acostumbra a usar en casos con 100 o
más atributos por clave.28 Su precursor es BigTable de Google, pero
han aparecido nuevas soluciones como HBase o HyperTable.
Análisis de datos[editar]
Teniendo los datos necesarios almacenados según diferentes tecnologías
de almacenamiento, nos daremos cuenta que necesitaremos diferentes
técnicas de análisis de datoscomo las siguientes:
Asociación: permite encontrar relaciones entre diferentes variables. 29
Bajo la premisa de causalidad, se pretende encontrar una predicción en
el comportamiento de otras variables. Estas relaciones pueden ser los
sistemas de ventas cruzadas en los comercios electrónicos.
Minería de datos (data mining): tiene como objetivo encontrar
comportamientos predictivos. Engloba el conjunto de técnicas que
combina métodos estadísticos y de aprendizaje automático con
almacenamiento en bases de datos. 30 Está estrechamente relacionada
con los modelos utilizados para descubrir patrones en grandes
cantidades de datos.
Agrupación (clustering): el análisis de clústeres es un tipo de minería
de datos que divide grandes grupos de individuos en grupos más
pequeños de los cuales no conocíamos su parecido antes del análisis. 30
El propósito es encontrar similitudes entre estos grupos, y el
descubrimiento de nuevos, conociendo cuáles son las cualidades que lo
definen. Es una metodología apropiada para encontrar relaciones entre
resultados y hacer una evaluación preliminar de la estructura de los
datos analizados. Existen diferentes técnicas y algoritmos de
clusterización.31
Análisis de texto (text analytics): gran parte de los datos generados por
las personas son textos, como e-mails, búsquedas web o contenidos.
Esta metodología permite extraer información de estos datos y así
modelar temas y asuntos o predecir palabras.32
Visualización de datos[editar]
Tal y como el Instituto Nacional de Estadística dice en sus tutoriales, “una
imagen vale más que mil palabras, o que mil datos”. Nuestra mente
agradecerá mucho más la visualización amigable de unos resultados
estadísticos en gráficos o mapas que no en tablas con números y
conclusiones. En los macrodatos se llega un paso más allá: parafraseando
a Edward Tufte, uno de los expertos en visualización de datos más
reconocidos a nivel mundial "El mundo es complejo, dinámico,
multidimensional, el papel es estático y plano. ¿Cómo vamos a representar
la rica experiencia visual del mundo en la mera planicie?”. Mondrian33 es
una plataforma que permite visualizar la información a través de los
análisis llevados a cabo sobre los datos que disponemos. Con esta
plataforma se intenta llegar a un público más concreto, y una utilidad más
acotada como un Cuadro de Mando Integral de una organización. Por otro
lado, las infografías se han vuelto un fenómeno viral, donde se recogen los
resultados de los diferentes análisis sobre nuestros datos, y son un material
atractivo, entretenido y simplificado para audiencias masivas. 34
Utilidad[editar]
Este conjunto de tecnologías se puede usar en una gran variedad de
ámbitos, como los siguientes.
Democracia[editar]
Los datos masivos se usan habitualmente para influenciar el proceso
democrático. Los representantes del pueblo pueden ver todo lo que hacen
los ciudadanos, y los ciudadanos pueden dictar la vida pública de los
representantes mediante tuits y otros métodos de extender ideas en la
sociedad. Las campañas presidenciales de Obama y Trump los usaron de
manera generalizada6 y hay expertos que advierten que hay que "reinventar
la democracia representativa. Si no, es posible que se convierta en una
dictadura de la información".35
Empresas[editar]
Redes sociales
Cada vez más los internautas tienden a subir a las redes sociales toda su
actividad y la de sus conocidos. Las empresas utilizan esta información
para cruzar los datos de los candidatos a un trabajo. Oracle ha desarrollado
una herramienta llamada Taleo Social Sourcing,36 la cual está integrada
con las API de Facebook, Twitter y LinkedIn. Gracias a su uso, los
departamentos de recursos humanos pueden ver, entrando la identidad del
candidato, su perfil social y profesional en cuestión de segundos. Por otro
lado, les permite crear una lista de posibles candidatos según el perfil
profesional necesario, y así pasar a ofrecer el puesto de trabajo a un
público mucho más objetivo.
Por otro lado, Gate Gourmet —una compañía de cáterin para aerolíneas—
experimentaba una tasa de abandono del 50 % de sus trabajadores
asignados al aeropuerto de Chicago, y sospecharon que el problema existía
en el tiempo dedicado al viaje. Para demostrarlo, hicieron análisis juntando
varios data sets de sus sistemas internos y de otros externos como datos
demográficos, datos de tráfico y datos de uso de redes sociales. Los
resultados que obtuvieron fueron patrones que relacionaban muy
consistentemente la alta tasa de abandono con la distancia del lugar de
trabajo a casa y la accesibilidad al transporte público. 37
Consumo
Amazon es líder en ventas cruzadas. El éxito se basa en la minería de
datos masiva basando los patrones de compra de un usuario cruzados con
los datos de compra de otro, creando así anuncios personalizados
y boletines electrónicos que incluyen justo aquello que el usuario quiere en
ese instante.38 También hay casos sin conexión de aplicaciones de
macrodatos. Los teléfonos móviles envían peticiones de escucha WiFi a
todos los puntos de acceso que se cruzan. Algunas compañías han decidido
hacer un trazo de estas peticiones con su localización y dirección
MAC para saber qué dispositivo hace cuál ruta dentro de un recinto. No
hay que asustarse ya que con la dirección MAC no pueden invadir la
intimidad.39 Las grandes superficies aprovechan estos datos para sacar
información como contabilizar cuánto tiempo pasan los clientes en su
interior, qué rutas siguen, dónde permanecen más tiempo (ya sea
escogiendo un producto o el tiempo de espera en caja) o cuál es la
frecuencia de visita.
Macrodatos e intimidad
La cantidad de datos creados anualmente es de 2.8 zettabytes en 2012, de
los cuales el 75 % son generados por los individuos según su uso de la red
ya sea bajarse un archivo, conectar el GPS o enviar un correo electrónico.
Se calcula que un oficinista medio genera 1.8 terabytes al año por lo que
son unos 5 GB al día de información.40
Aquí entran en juego las empresas llamadas corredores de datos. Acxiom
es una de ellas, y posee unas 1.500 trazas de datos de más de 500 millones
de usuarios de internet. Todos estos datos son transformados y cruzados
para incluir al usuario analizado en uno de los 70 segmentos de usuarios,
llamado PersonicX.41 Descrito como un “resumen de indicadores de estilo
de vida, intereses y actividades”, esta correduría de datos basa
su clusterización en los acontecimientos vitales y es capaz de predecir más
de 3 000 reacciones ante estímulos de estos clientes. En un primer
momento captaba la información de los hechos reales y no virtuales de los
usuarios.42 En febrero de 2013, Facebookacordó la cesión de la
información personal de sus usuarios con Acxiom y otros corredores de
datos haciendo cruzar las actividades de la vida off-line con las actividades
en línea [30].
A nivel usuario, nos encontramos con Google Location History: un
servicio de Google que registra las ubicaciones en las cuales ha estado un
usuario que lleva el móvil encima, y con el servicio de
localización activado (que por defecto lo está en los terminales
con Android). Al acceder a él muestra un mapa con las rutas que ha
seguido el usuario, con la hora de llegada y salida de cada ubicación. 43
Gracias a esta utilidad se crean algoritmos de recomendaciones de amigos
en redes sociales y ubicaciones a visitar basados en el historial de
ubicaciones del usuario.44
Por último, Google pagó 3.200 millones de dólares por Nest, una empresa
de detectores de humo.45 Ahora Google ha abierto Nest Labs, donde se
pretende desarrollar sensorespara convertir la casa en una Smart home.
Incluir estos sensores permitirá saber por ejemplo cuándo hay alguien o no
en casa gracias a su interacción con los wearables, a qué temperatura está
el ambiente o detectar si hay algún peligro dentro como fuego.46
Deportes[editar]
Profesional
En un ámbito donde se mueve tanto dinero, suelen utilizar las nuevas
tecnologías antes que los usuarios de base. Nos encontramos por ejemplo
que el análisis de los partidos constituye una parte fundamental en el
entrenamiento de los profesionales, y la toma de decisiones de los
entrenadores.
Amisco47 es un sistema aplicado por los más importantes equipos de las
ligas Española, Francesa, Alemana e Inglesa desde el 2001. Consta de 8
cámaras y diversos ordenadores instalados en los estadios, que registran los
movimientos de los jugadores a razón de 25 registros por segundo, y luego
envían los datos a una central donde hacen un análisis masivo de los datos.
La información que se devuelve como resultado incluye una reproducción
del partido en dos dimensiones, los datos técnicos y estadísticas, y un
resumen de los datos físicos de cada jugador, permitiendo seleccionar
varias dimensiones y visualizaciones diferentes de datos. 47
Aficionado
Aplicaciones como Runtastic, Garmin o Nike+ proveen de resultados big
data al usuario. Este último —Nike+— va un paso más allá a nivel de
organización, ya que fabrican un producto básico para sus usuarios: las
zapatillas. Los 7 millones de usuarios generan una gran cantidad de datos
para medir el rendimiento y su mejora, por lo que la empresa genera
unos clústeres con los patrones de comportamiento de sus usuarios. Uno de
sus objetivos pues, es controlar el tiempo de vida de sus zapatillas
encontrando fórmulas para mejorar la calidad. Por último, aumenta la
competitividad entre sus usuarios con el uso de la gamificación: establece
que comunidades de usuarios lleguen a metas y consigan objetivos
conjuntamente con el uso de la aplicación, motivando e inspirando a los
corredores para usar su aplicación y a más largo plazo, sus productos
deportivos.
Investigación[editar]
Salud y medicina
Hacia mediados 2009, el mundo experimentó una pandemia de gripe A,
llamada gripe porcina o H1N1. El website Google Flu Trends fue capaz de
predecirla gracias a los resultados de las búsquedas. Flu Trends usa los
datos de las búsquedas de los usuarios que contienen "síntomas parecidos a
la enfermedad de la gripe" (Influenza-Like Illness Symptoms) y los agrupa
según ubicación y fecha, y es capaz de predecir la actividad de la gripe
hasta con dos semanas de antelación más que los sistemas tradicionales.
Más concretamente en Nueva Zelanda48 cruzaron los datos de las
tendencias de gripe de Google con datos existentes de los sistemas de salud
nacionales, y comprobaron que estaban alineados. Los gráficos mostraron
una correlación con las búsquedas de síntomas relacionados con la gripe y
la extensión de la pandemia en el país. Los países con sistemas de
predicción poco desarrollados pueden beneficiarse de una predicción fiable
y pública para abastecer a su población de las medidas de seguridad
oportunas.
Defensa y seguridad
Para incrementar la seguridad frente a los ataques de las propias
organizaciones, ya sean empresas en el entorno económico o los propios
ministerios de defensa en el entorno de ciberataques, se contempla la
utilidad de las tecnologías de big data en escenarios como la vigilancia y
seguridad de fronteras, lucha contra el terrorismo y crimen organizado,
contra el fraude, planes de seguridad ciudadana o planeamiento táctico de
misiones e inteligencia militar.49
Caso específico del proyecto Aloja
Una de las máquinas del Marenostrum, Supercomputador del BSC
El proyecto Aloja50 ha sido iniciado por una apuesta en común
del Barcelona Supercomputing Center (BSC) y Microsoft Research. El
objetivo de este proyecto de big data quiere "conseguir una optimización
automática en despliegues de Hadoop en diferentes infraestructuras". [40]
Caso específico de sostenibilidad
Conservation International es una organización con el propósito de
concienciar a la sociedad de cuidar el entorno de una manera responsable y
sostenible. Con la ayuda de la plataforma Vertica Analytics de HP, han
situado 1.000 cámaras a lo largo de 16 bosques en 4 continentes. Estas
cámaras incorporan unos sensores, y a modo de cámara oculta graban el
comportamiento de la fauna. Con estas imágenes y los datos de
los sensores (precipitaciones, temperatura, humedad, solar…) consiguen
información sobre cómo el cambio climático o el desgaste de la tierra
afecta en su comportamiento y desarrollo.51
El Big Data revoluciona los Recursos Humanos
La gestión de los Recursos Humanos ya no se circunscribe únicamente a la
elaboración de nóminas, comprobación de horarios, selección de candidatos
a través de currículo académico y entrevista, o conocer datos tan básicos
como la edad, dónde viven los empleados, si tienen o no hijos, o cuántas
horas de formación se dieron al personal o días que se ausentaron de su
puesto de trabajo. El análisis de todos esos datos, más los que los
empleados generan en el uso de redes sociales e internet, y la incorporación
de nuevas herramientas de Big Data en la gestión de las personas están
abriendo un nuevo campo de posibilidades a la hora de tomar decisiones en
los departamentos de Recursos Humanos, sobre todo de las grandes
empresas.
Tradicionalmente se viene aplicando estos sistemas de Big Data y Data
Analitic en el diseño de estrategias comerciales, de marketing y ventas, o en
sectores como la banca. Sin embargo, serán también herramientas muy
importantes a la hora de contratar y gestionar personas en un futuro muy
cercano, como concluye un estudio realizado por Workday: un 96% de los
directores de [Link]. considera que el Big Data permitirá avanzar para
«predecir tendencias y lo que pasará en el futuro. De manera que los
[Link]. podrán anticiparse a las necesidades de la empresa, en
cuestiones de formación, recursos, promoción... Por ejemplo, un buen
análisis de Big Data puede ayudar a detectar quiénes tienen intención de
marcharse de la empresa. Con esos datos el manager puede anticipar
acciones para retener a esos profesionales», explica Cristina
Hebrero,responsable del Estudio Workday («HR Digital Disruption, sobre
el valor de la tecnología en la gestión de personas»).
Mute
Ad
00:00:12
El 93% de los jefes de personal cree que los datos se utilizarán de forma habitual en
[Link].
El 93% de los jefes de personal cree que en cinco años los datos con fines
predictivos se utilizarán de manera habitual en los Recursos Humanos, y el
mismo porcentaje considera que disponer de datos fiables y actualizados
sobre los empleados tendrá un retorno de la inversión a medio y largo
plazo.
Por tanto, analizar los grandes volúmenes de datos de que dispone o puede
disponer una empresa para tomar decisiones sobre empleados conllevará
una verdadera revolución en las estrategias de los departamentos [Link].
Incluso para los propios equipos de personal, que deberán interpretar y
poseer mayor capacidad analítica y estadística. «El Big Data pone a
disposición de las áreas de [Link]. muchos datos que hasta ahora no
existían ni se tenía acceso a ellos. Es un momento incipiente porque las
compañías están invirtiendo e implantando ahora soluciones tecnológicas
para capturar esos datos y poder empezar a medir y analizar indicadores
predictivos que pueden anticipar cosas que pueden pasar en el futuro»,
explica Hebrero.
Internet y las redes sociales abren la puerta a un mundo desconocido en
[Link]. El análisis de esos datos externos permite conocer las opiniones de
un empleado o de un candidato, sus aficiones, deportes, con quién se
relaciona, lo que le gusta, su conducta y valores, fotos que cuelga en las
redes... «La huella digital que dejamos es cada vez mayor en todos los
aspectos de la vida», dice Hebrero. Datos que, además, se generan a
velocidad de vértigo, a través de una gran variedad de fuentes y en tiempo
real.
El 48% de las empresas usan las redes sociales para interactuar con sus empleados
Si además se analizan datos internos (por ejemplo, las relaciones entre
empleados) se puede detectar a los que son más innovadores, líderes, los
empleados que están con riesgo de marcharse de la compañía porque están
descontentos... El Big Data y la analítica de datos se puede aplicar «a todo
el ciclo de vida de un empleado: desde al reclutamiento, a la formación y
desarrollo hasta a su salida de la compañía. Los datos internos son más
relativos a experiencias, conocimientos y capacidades que la compañía
puede tener dentro de su modelo de desarrollo. Los externos tiene que ver
más con el Big Data en las redes sociales y el concepto de reclutamiento
social: cada vez se reclutan más candidatos a través de las redes y sobre
perfiles de LinkedIn y otras plataformas», añade Ignacio Crespo, senior
manging consultant business Analytics&Strategy de IBM.
Búsqueda de candidatos
Según datos de esta compañía, el número de directores de [Link]. que
utilizó la analítica predictiva para tomar mejores decisiones en cuestiones
de empleados aumentó del 16% (en 2013) a 19% (en 2015). Y el 48% de
las empresas están usando las redes sociales para interactuar con sus
empleados y averiguar aspectos clave. «La computación cognitiva va a
suponer un profundo impacto en [Link]. Ayudará a los trabajadores a
detectar oportunidades de crecimiento e identificar nuevos retos. Además,
los directores de [Link]. detectarán más fácilmente patrones, tendencias y
conocimientos para retener talento», añade Crespo.
Hay que tener en cuenta que a estas alturas «el empleado de éxito presenta
características que no están en los criterios de selección actuales», dice
Hebrero. Es decir, ya no es el que posea mejor currículo ni mejores notas,
ni el que ha causado la mejor impresión en la entrevista personal. Por
eso, las empresas necesitan nuevas herramientas tecnológicas que
«permitan buscar nuevas fuentes de reclutamiento para traer a candidados
de más éxito, cruzar datos, analizar impactos...», concluye Hebrero.