Contacta con nosotros

Temario del curso

Esenciales de la Administración de Kafka

  • Dónde encaja Kafka en una plataforma de datos moderna y las responsabilidades típicas en producción.
  • Conceptos clave para operadores: brokers, temas (topics), particiones, offsets y grupos de consumidores.
  • Fundamentos de la replicación: líderes y seguidores, réplicas sincronizadas y compromisos en la disponibilidad.
  • Aspectos destacados operativos de Kafka y terminología común utilizada en los procedimientos de ejecución (runbooks).

Modo KRaft y Diseño del Clúster

  • Conceptos básicos de KRaft: controladores, quórum de metadatos, elecciones y por qué es relevante operativamente.
  • Planificación del despliegue: dimensionamiento para el rendimiento (throughput), particiones, retención y crecimiento.
  • Roles de los nodos y distribuciones: controladores combinados frente a dedicados, consideraciones sobre dominios de fallo.
  • Laboratorio: inspeccionar metadatos de KRaft, validar la salud del quórum e interpretar los registros del controlador.

Instalación, Configuración y Operaciones Diarias

  • Enfoques de instalación (paquetes, tarball, contenedores) y qué estandarizar en entornos empresariales.
  • Configuración esencial del broker que impacta la fiabilidad: listeners, replicación, directorios de registros y retención.
  • Operaciones seguras del servicio: orden de inicio, apagado graceful (ordenado) y comprobaciones de validación.
  • Laboratorio: desplegar un clúster multi-nodo, verificar el registro del broker y confirmar la producción y consumo base.

Gestión de Temas, Particiones y Ubicación de Datos

  • Ciclo de vida de los temas usando la CLI de Kafka: crear, describir, actualizar configuraciones, eliminar.
  • Elegir particiones y factores de replicación para cargas de trabajo reales, incluyendo anti-patrones comunes.
  • Reasignaciones y equilibrado: cuándo mover particiones y cómo verificar el progreso de forma segura.
  • Laboratorio: crear temas, desencadenar una reasignación de particiones, simular un fallo de broker y confirmar la recuperación.

Seguridad de Kafka para Producción

  • TLS para tráfico de cliente e inter-broker: certificados, cadenas de confianza y pasos de validación.
  • Autenticación con SASL: selección de mecanismos comunes y evitar configuraciones erróneas.
  • Autorización con ACLs: patrones de privilegio mínimo para administradores, productores y consumidores.
  • Laboratorio: habilitar TLS y SASL, validar la conectividad del cliente y aplicar ACLs para roles de aplicación.

Observabilidad, Fiabilidad y Solución de Problemas

  • Aspectos esenciales de la monitorización: salud del controlador, particiones sub-replicadas, latencia de solicitudes y saturación de disco y red.
  • Registros y métricas: lectura de registros del broker y exposición de métricas mediante JMX exporter a pilas de observabilidad comunes.
  • Procedimientos operativos (playbooks): reinicios en cascada, cambios seguros de configuración, manejo de discos llenos e issues de ISR.
  • Laboratorio: construir un conjunto mínimo de alertas, diagnosticar un clúster degradado y restaurar una replicación saludable.

Actualizaciones y Preparación para la Recuperación ante Desastres

  • Planificación de actualizaciones de Kafka: comprobaciones de compatibilidad, etapas previas (staging) y enfoque de rollback.
  • Expectativas de copias de seguridad y recuperación: qué se puede respaldar, qué no, y conceptos básicos de recuperación de configuración.
  • Visión general de la replicación cross-cluster y cuándo usar MirrorMaker 2 para DR (Desastres) y migraciones.
  • Cierre: lista de verificación operativa, artefactos de transferencia y próximos pasos para el despliegue en producción.

Requerimientos

  • Comprensión de la administración básica de Linux (usuarios, servicios, archivos, permisos).
  • Experiencia con conceptos de redes TCP/IP (DNS, puertos, firewalls, balanceadores de carga).
  • Experiencia básica en scripting (Bash, PowerShell o similar) para tareas operativas rutinarias.

Público Objetivo

  • Administradores de Kafka e ingenieros de plataforma responsables de operar clústeres de Kafka.
  • Ingenieros de fiabilidad del sitio (SRE) e ingenieros DevOps que apoyan plataformas de transmisión de datos.
  • Equipos de infraestructura y operaciones que despliegan nuevos clústeres de Kafka basados en KRaft o migran desde ZooKeeper.
 21 Horas

Número de participantes


Precio por participante

Reseñas (5)

Próximos cursos

Categorías Relacionadas