0% encontró este documento útil (0 votos)
4 vistas1 página

Importancia y Clasificación del Big Data

El documento describe la importancia del Big Data en la transformación de grandes volúmenes de información en decisiones estratégicas, destacando su uso en áreas como marketing, ventas, y salud. Se clasifica el Big Data en datos estructurados, no estructurados y semiestructurados, y se mencionan herramientas como Hadoop y Spark para su procesamiento. Además, se presenta un caso de éxito de Netflix, que utiliza análisis de datos para personalizar recomendaciones y mejorar la experiencia del usuario.

Cargado por

zrosa7323
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
4 vistas1 página

Importancia y Clasificación del Big Data

El documento describe la importancia del Big Data en la transformación de grandes volúmenes de información en decisiones estratégicas, destacando su uso en áreas como marketing, ventas, y salud. Se clasifica el Big Data en datos estructurados, no estructurados y semiestructurados, y se mencionan herramientas como Hadoop y Spark para su procesamiento. Además, se presenta un caso de éxito de Netflix, que utiliza análisis de datos para personalizar recomendaciones y mejorar la experiencia del usuario.

Cargado por

zrosa7323
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Clasificación según IBM

Importancia Big Transaction Data


Registros de facturación y telecomunicaciones.
Datos de CRM, ERP, e inventarios de ventas
Es importante porque permite transformar grandes Formatos semiestructurados o no estructurados
volúmenes de información en decisiones estratégica,
identificando problemas, reduciendo costos y
mejorando la eficiencia. A demás facilita de nuevos
productos y servicios.
BIG DATA Datos generados por los Seres Humanos
Datos creados por la interacción humana a través de diferentes
medios de comunicación y transacciones. ( Llamadas a call
centers, nota de voz, uso de tarjetas de crédito/débito…)
Datos Biométricos Redes sociales y Páginas web
¿Dónde se utiliza? Son datos utilizados para intensificar a personas
•Hace referencia a toda aquella información que se obtiene
mediante características físicas únicas. a traves de transacciones web y contenidos de redes
Escaneo de retina. sociales( Facebook, Twitter, Instangram…)
Marketing y ventas; estas son áreas donde se Huellas Digitales
utiliza con mayor frecuencia el Big Data. Reconocimiento fácil y genético.
Datos de Máquinas ( M2M)
–Marketing social. Datos generados por dispositivos conectados entre
–Deportes Es la gestión y análisis de enormes sí que recogen información para monitorear y
analizar proceso.
– Políticas y salud volúmenes de datos que no pueden Monitoreo de consumo de agua, gas y
Clasificación ser tratados de manera electricidad

según su estructura convencional.


Sensores y medidores inteligentes

Herramientas para trabajar con BiG


Datos estructurados Data
Ordenados y bien definidos en cuanto a formato, tamaño y
longitud. Caso de éxito
Datos no estructurados Hadoop: Almacenamiento y procesamiento distribuido.
No tiene estructura interna identificable. Netflix, que utiliza el análisis de grandes volúmenes de Spark: Procesamiento rápido y en tiempo real.
Están desorganizados y no tienen valor hasta ser ordenados y datos sobre las preferencias y comportamientos de sus
BBDD NoSQL: Almacenamiento de datos no estructurados (MongoDB,
almacenado. usuarios para personalizar recomendaciones de Cassandra).
Ej; videos, audios, imágenes… contenido. Gracias a esto, ha logrado mejorar la
Apache Flink: Procesamiento de datos en tiempo real y por lotes.
experiencia del usuario, aumentar la retención de
Datos semiestructurados
clientes y optimizar la producción de contenido original, Apache Kafka: Manejo de flujos de datos en tiempo real.
Informaficion no regular que no se gestiona de manera estándar.
basándose en las tendencias y gustos identificados a
Mezcla datos estructurados y no estructurado.
partir de los datos.
Tiene organización definida pero no perfecta ( HTML, XML..)

También podría gustarte