Temario del curso
Introducción
Descripción general de las características y arquitectura de "Open Studio for Big Data"
Configuración de Open Studio para Big Data
Navegación por la interfaz de usuario
Comprensión de los componentes y conectores de Big Data
Conexión a un clúster de Hadoop
Lectura y escritura de datos
Procesamiento de datos con Hive y MapReduce
Análisis de los resultados
Mejora de la calidad de los datos masivos (big data)
Construcción de una tubería de big data
Gestión de usuarios, grupos, roles y proyectos
Despliegue de Open Studio en producción
Monitoreo de Open Studio
Resolución de problemas (troubleshooting)
Resumen y conclusión
Requerimientos
- Conocimiento sobre bases de datos relacionales
- Conocimiento sobre almacenes de datos (data warehousing)
- Comprensión de los conceptos de ETL (Extracción, Transformación y Carga)
Público objetivo
- Profesionales de inteligencia empresarial
- Profesionales de bases de datos
- Desarrolladores de SQL
- Desarrolladores ETL
- Arquitectos de soluciones
- Arquitectos de datos
- Profesionales de almacenes de datos (data warehousing)
- Administradores e integradores de sistemas
Reseñas (2)
Un viaje por el mundo de Spark: un curso muy intenso. DSL, Spark SQL, particionamiento versus agrupación para mí.
Georgiana Elisabeta
Curso - Apache Spark Fundamentals
Traducción Automática
Ejercicios prácticos. La clase debería haber durado 5 días, pero los 3 días fueron útiles para aclarar muchas de las preguntas que tenía al trabajar con NiFi.
James - BHG Financial
Curso - Apache NiFi for Administrators
Traducción Automática