Contacta con nosotros

Temario del curso

Introducción a Apache Spark

  • El papel de Spark en el procesamiento de grandes datos.
  • Arquitectura de Spark y sus componentes.

Configuración de Apache Spark

  • Requisitos de hardware y software.
  • Procedimientos de instalación para los modos independiente (standalone) y de clúster.
  • Mejores prácticas de configuración para administradores de sistemas.

Administración de clústeres de Spark

  • Herramientas y técnicas de gestión de clústeres.
  • Monitorización de aplicaciones de Spark y recursos del clúster.
  • Configuraciones de seguridad y gestión de usuarios.

Ajuste y optimización del rendimiento

  • Distribución de recursos y programación (scheduling).
  • Ajuste de Spark para lograr el óptimo rendimiento.
  • Identificación y resolución de cuellos de botella comunes.

Solución de problemas y resolución de incidencias

  • Desafíos comunes en la administración de Spark.
  • Herramientas y técnicas diagnósticas para la resolución de incidencias.
  • Enfoque paso a paso para resolver problemas habituales.
  • Mejores prácticas para mantener un entorno Spark saludable.

Temas avanzados de administración

  • Integración con otras herramientas de grandes datos (big data).
  • Garantía de alta disponibilidad y recuperación ante desastres.
  • Actualización y escalado de clústeres de Spark.

Resumen y próximos pasos

Requerimientos

  • Conocimientos básicos de configuración y gestión de redes.
  • Habilidad con el sistema operativo Linux y la interfaz de línea de comandos.
  • Interés por aprender sobre sistemas de computación distribuida y gestión de grandes datos (big data).

Público objetivo

  • Administradores de sistemas.
 35 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas