El seminario Big Data proporciona al estudiante las arquitecturas y herramientas para almacenar y procesar grandes volúmenes de datos, desde Hadoop y los data lakes hasta Apache Spark, Delta Lake, Kafka y bases NoSQL en la nube. Le permite procesar conjuntos masivos con PySpark, participar en proyectos de datos a gran escala y dialogar con equipos de ingeniería de datos con criterio técnico.
Profesionales de tecnología y analistas con SQL básico y nociones de Python.
Procesamiento con PySpark de un conjunto de datos masivo abierto y propuesta de arquitectura de datos para una organización.