Visão Geral
Este curso aborda o planejamento, implementação e administração de ambientes Apache Kafka altamente disponíveis e resilientes, com foco em continuidade de negócios e recuperação de desastres. O participante aprenderá a projetar arquiteturas tolerantes a falhas, configurar replicação, implementar estratégias de failover, recuperação de clusters, replicação entre datacenters e aplicar boas práticas para garantir disponibilidade, integridade e continuidade dos serviços de Event Streaming em ambientes corporativos.
Objetivo
Após realizar este curso, você será capaz de:
- Projetar arquiteturas Kafka altamente disponíveis
- Implementar estratégias de replicação e tolerância a falhas
- Planejar e executar processos de recuperação de desastres
- Configurar replicação entre clusters e datacenters
- Monitorar a disponibilidade dos ambientes Kafka
- Aplicar boas práticas para continuidade de negócios em plataformas de Event Streaming
Publico Alvo
- Administradores de Middleware
- Administradores de Sistemas
- Engenheiros DevOps
- Profissionais Platform Engineering
- Arquitetos de Infraestrutura
- Engenheiros de Dados
Pre-Requisitos
- Conhecimentos equivalentes ao curso Apache Kafka Administration
- Familiaridade com Apache Kafka
- Conhecimentos sobre sistemas distribuídos
- Noções de redes TCP/IP
Conteúdo Programatico
Module 1: High Availability Fundamentals
- High availability concepts
- Kafka distributed architecture review
- Fault tolerance mechanisms
- Replication fundamentals
- Service continuity principles
- Enterprise availability requirements
Module 2: Cluster Resilience and Replication
- Broker replication
- Partition replication
- Leader election
- In-Sync Replicas (ISR)
- Replication factor strategies
- Cluster resilience planning
Module 3: Disaster Recovery Strategies
- Disaster recovery concepts
- Backup strategies
- Cluster recovery procedures
- Cross-cluster replication
- MirrorMaker overview
- Multi-datacenter architectures
Module 4: Monitoring and Availability Management
- Availability monitoring
- Health checks
- Failure detection
- Capacity planning
- Operational dashboards
- SLA monitoring
Module 5: Business Continuity Best Practices
- Business continuity planning
- Failover strategies
- Recovery testing
- Incident response
- Operational governance
- Production best practices
Module 6: High Availability and Disaster Recovery Workshop
- Replication configuration laboratory
- Failover simulation
- Disaster recovery exercises
- Cross-cluster replication laboratory
- Availability validation
- Final high availability project
TENHO INTERESSE