Engenharia de Alta Disponibilidade e Segurança de Dados

Este curso forma o profissional capaz de manter sistemas de dados críticos disponíveis, resilientes e protegidos contra falhas e vazamentos. Ao longo de 7 atividades práticas, você domina RPO e RTO, elimina pontos únicos de falha, constrói um Data Lakehouse resiliente com Arquitetura Medalhão, Apache Spark e MinIO e implementa controles como RBAC, mascaramento de dados e criptografia na AWS. A jornada inclui o Cão de Guarda Digital, com regras de DLP para prevenir vazamentos, o Plano Fênix, voltado à recuperação de desastres, e uma arquitetura de IA Generativa de missão crítica com alta disponibilidade para bancos vetoriais e pipelines RAG, guardrails e observabilidade. Você une resiliência, segurança e IA em um perfil cada vez mais valorizado pelo mercado.

Formato

Online

Data de Início

Imediato

Carga Horária

72 h/a

Prazo de Acesso

24 meses

Parcelado

12x no cartão

Pré-Requisito (Opcional):
Recomendamos ter concluído o curso gratuito de Fundamentos de Engenharia de Dados aqui na DSA.

Descrição do Curso

Ao longo do curso, você aprenderá a construir a base da alta disponibilidade, compreendendo o que realmente significa resiliência de dados, como medir objetivos de recuperação (RPO e RTO) e eliminar pontos únicos de falha em sistemas críticos. Essa fundamentação é essencial para qualquer Arquiteto ou Engenheiro de Dados que queira garantir que aplicações corporativas permaneçam acessíveis, seguras e consistentes, mesmo em cenários de incidentes ou sobrecarga.

Em seguida, o curso mergulha na construção prática de um Data Lakehouse resiliente, explorando conceitos da Arquitetura Medalhão e aplicando ferramentas como Apache Spark e MinIO para criar ambientes replicados, escaláveis e distribuídos. Você implementará estratégias de replicação, experimentará simulações de falha e aprenderá a manter integridade e performance mesmo em ambientes híbridos e complexos.

Mas resiliência não é nada sem segurança e governança, por isso, uma parte central do curso aborda o controle de acesso, anonimização de dados e políticas de auditoria com foco em conformidade e proteção de informações sensíveis. O aluno domina práticas de RBAC (Role-Based Access Control), criptografia de dados e gestão de identidades na nuvem usando AWS, Lake Formation e IAM. Com isso, entende na prática como proteger dados críticos e evitar vazamentos ou acessos indevidos.

O grande diferencial do curso está na sua relação com o mundo da IA e dos LLMs. O módulo final mostra como arquitetar sistemas de IA Generativa com alta disponibilidade, explorando a segurança e resiliência de bancos vetoriais e estratégias para manter embeddings e modelos LLM operando 24/7 em ambientes de missão crítica. O aluno aprende a configurar clusters distribuídos, aplicar políticas de segurança e monitorar o desempenho de pipelines RAG e LLMOps.

Logbook das Principais Atividades Práticas


  • Estudo de Caso - Análise de RPO/RTO Para Um Sistema de Missão Crítica
  • Projeto 1 - Implementando Cluster Para Alta Disponibilidade do Lakehouse com Spark e MinIO
  • Projeto 2 - Implementando RBAC e Mascaramento de Dados em Ambiente de Alta Disponibilidade
  • Projeto 3 - Implementando Data Lake Seguro, de Alta Disponibilidade e com Criptografia de Dados em Repouso e em Trânsito na AWS
  • Projeto 4 - O Cão de Guarda Digital: Configurando Regras de DLP Para Bloquear Vazamentos
  • Projeto 5 - Plano Fênix: Desenvolvendo e Implantando Um Plano de Recuperação de Desastres
  • Projeto 6 – Arquitetura RAG em Produção: Alta Disponibilidade, Segurança, Guardrails e Observabilidade


Este curso é mais do que uma formação técnica, é um guia prático para quem deseja se tornar referência em confiabilidade, segurança e IA aplicada à engenharia de dados.

Os projetos desafiam o aluno a pensar como um verdadeiro engenheiro de disponibilidade: prevenindo falhas, protegendo ativos e garantindo que a informação esteja sempre segura, acessível e sob controle.

Ementa do Curso

Pronto(a) para começar sua jornada de aprendizagem profissional?