Clasificación según IBM
Importancia Big Transaction Data
Registros de facturación y telecomunicaciones.
Datos de CRM, ERP, e inventarios de ventas
Es importante porque permite transformar grandes Formatos semiestructurados o no estructurados
volúmenes de información en decisiones estratégica,
identificando problemas, reduciendo costos y
mejorando la eficiencia. A demás facilita de nuevos
productos y servicios.
BIG DATA Datos generados por los Seres Humanos
Datos creados por la interacción humana a través de diferentes
medios de comunicación y transacciones. ( Llamadas a call
centers, nota de voz, uso de tarjetas de crédito/débito…)
Datos Biométricos Redes sociales y Páginas web
¿Dónde se utiliza? Son datos utilizados para intensificar a personas
•Hace referencia a toda aquella información que se obtiene
mediante características físicas únicas. a traves de transacciones web y contenidos de redes
Escaneo de retina. sociales( Facebook, Twitter, Instangram…)
Marketing y ventas; estas son áreas donde se Huellas Digitales
utiliza con mayor frecuencia el Big Data. Reconocimiento fácil y genético.
Datos de Máquinas ( M2M)
–Marketing social. Datos generados por dispositivos conectados entre
–Deportes Es la gestión y análisis de enormes sí que recogen información para monitorear y
analizar proceso.
– Políticas y salud volúmenes de datos que no pueden Monitoreo de consumo de agua, gas y
Clasificación ser tratados de manera electricidad
según su estructura convencional.
Sensores y medidores inteligentes
Herramientas para trabajar con BiG
Datos estructurados Data
Ordenados y bien definidos en cuanto a formato, tamaño y
longitud. Caso de éxito
Datos no estructurados Hadoop: Almacenamiento y procesamiento distribuido.
No tiene estructura interna identificable. Netflix, que utiliza el análisis de grandes volúmenes de Spark: Procesamiento rápido y en tiempo real.
Están desorganizados y no tienen valor hasta ser ordenados y datos sobre las preferencias y comportamientos de sus
BBDD NoSQL: Almacenamiento de datos no estructurados (MongoDB,
almacenado. usuarios para personalizar recomendaciones de Cassandra).
Ej; videos, audios, imágenes… contenido. Gracias a esto, ha logrado mejorar la
Apache Flink: Procesamiento de datos en tiempo real y por lotes.
experiencia del usuario, aumentar la retención de
Datos semiestructurados
clientes y optimizar la producción de contenido original, Apache Kafka: Manejo de flujos de datos en tiempo real.
Informaficion no regular que no se gestiona de manera estándar.
basándose en las tendencias y gustos identificados a
Mezcla datos estructurados y no estructurado.
partir de los datos.
Tiene organización definida pero no perfecta ( HTML, XML..)