Laboratórios
37 laboratórios com validação
Cada lab tem contexto profissional, passos, comandos, checagens de validação e os erros que mais aparecem no dia a dia.
Bancada pronta: validar as 8 ferramentas
Iniciante45 minM0Instalar e provar, por comando, que todo o arsenal do curso funciona na sua máquina.
Onboarding em empresa começa exatamente assim: montar ambiente e provar que consegue rodar o projeto localmente no primeiro dia.
Conta de nuvem blindada com orçamento
Iniciante30 minM0Proteger a conta AWS e garantir alerta de custo antes de criar qualquer recurso.
Primeira tarefa de qualquer engenheiro que recebe acesso a uma conta nova de nuvem.
Runbook de 30 comandos Linux
Iniciante60 minM1Construir um documento operacional com os 30 comandos que você usará em investigação real.
Runbook é o que permite a qualquer pessoa do plantão diagnosticar sem depender de quem escreveu o sistema.
Serviço systemd resiliente a reboot e falha
Intermediário50 minM1Colocar a API do CloudShop sob systemd com usuário dedicado, restart automático e logs no journal.
Todo serviço em VM precisa subir no boot e voltar após falha, sem intervenção humana.
Caça ao disco cheio
Intermediário40 minM1Diagnosticar e resolver um /var em 100% sem apagar dado necessário.
Disco cheio é um dos incidentes mais frequentes e um dos que mais assustam iniciantes.
Nginx reverse proxy com TLS para a API
Intermediário60 minM2Publicar a API atrás de Nginx com HTTPS, cabeçalhos corretos e timeouts definidos.
Configuração padrão de qualquer serviço exposto na internet.
Investigação de DNS e TTL
Intermediário35 minM2Diagnosticar por que uma mudança de DNS 'não propagou' e planejar a migração corretamente.
Toda migração de infraestrutura passa por DNS; erro aqui derruba o serviço para parte dos usuários.
Medir latência por fase com curl
Iniciante30 minM2Separar DNS, conexão, TLS e processamento para dizer exatamente onde está a lentidão.
Transformar 'está lento' em número por fase é o que permite corrigir o gargalo certo.
Conflito de merge resolvido com segurança
Intermediário40 minM3Criar, diagnosticar e resolver um conflito real, validando o resultado.
Conflito acontece toda semana em time; resolver mal introduz bug silencioso.
Health-check em Bash com retry e exit codes
Intermediário45 minM3Escrever um script robusto que outros processos possam usar para decidir.
Scripts de verificação alimentam cron, systemd, pipelines e alertas.
Backup de logs com retenção e restauração testada
Intermediário45 minM3Automatizar backup diário e provar que a restauração funciona.
Backup não testado não é backup — é esperança.
Stack CloudShop completo com Docker Compose
Intermediário75 minM4Subir Vue + API Node + PostgreSQL com healthchecks e persistência em um comando.
Ambiente de desenvolvimento reproduzível é entrega padrão de quem cuida de plataforma.
Reduzir a imagem de 1,2 GB para menos de 200 MB
Avançado50 minM4Aplicar multi-stage, base enxuta e .dockerignore medindo o resultado.
Imagem menor reduz tempo de pipeline, custo de registry e superfície de ataque.
Endurecer o container: não-root, read-only e limites
Avançado40 minM4Rodar a aplicação sem privilégios, com filesystem somente leitura e recursos limitados.
Exigência de qualquer checklist de segurança em ambiente corporativo.
CI completo em PR: lint, testes e build
Intermediário60 minM5Impedir merge de código que não passa em qualidade, em menos de cinco minutos.
Padrão mínimo de qualquer time que entrega várias vezes por semana.
Publicar imagem no GHCR com tag imutável
Avançado50 minM5Gerar imagem versionada com metadados e registrar o digest.
Rastreabilidade entre commit, imagem e o que roda em produção.
Rollback automático em falha de saúde
Avançado55 minM5Fazer o pipeline reverter sozinho quando o deploy não fica saudável.
Reduz o tempo de restauração de dezenas de minutos para poucos.
VPC do CloudShop com subnets pública e privada
Avançado70 minM6Construir a rede completa e provar que a subnet privada não é alcançável de fora.
Base de qualquer ambiente de nuvem auditável.
Frontend no S3 com CloudFront e bucket privado
Intermediário60 minM6Publicar o site com HTTPS e CDN sem tornar o bucket público.
Arquitetura padrão e mais econômica para SPA em produção.
RDS privado com segredo gerenciado e backup testado
Avançado65 minM6Subir PostgreSQL gerenciado sem acesso público e restaurar um backup.
Banco é o recurso mais crítico; backup não testado é o erro mais caro.
Terraform com state remoto e dois ambientes
Avançado80 minM7Provisionar dev e staging com o mesmo módulo e state em S3 com lock.
Como times reais gerenciam múltiplos ambientes sem duplicar código.
Provocar e resolver drift de Terraform
Avançado50 minM7Alterar um recurso pelo console, detectar a divergência e reconciliar.
Drift acontece em toda empresa após correção emergencial no console.
Playbook Ansible idempotente para o host da API
Intermediário60 minM7Configurar o host inteiro por playbook, provando idempotência.
Configuração reproduzível de frota de VMs, sem passos manuais.
CloudShop no Kubernetes (Kind) de ponta a ponta
Avançado90 minM8Rodar web, API e banco no cluster com Service, Ingress e Secret.
Migração de Compose para Kubernetes é tarefa recorrente em empresas em transição.
Probes e limites contra falso incidente
Avançado60 minM8Configurar probes corretas e observar OOMKilled na prática.
Probes e limites malfeitos causam instabilidade recorrente em clusters reais.
Chart Helm com rollback comprovado
Avançado70 minM8Empacotar o CloudShop, implantar duas versões e reverter.
Rollback treinado é o que dá coragem para implantar com frequência.
ArgoCD sincronizando o CloudShop
Avançado75 minM9Colocar o cluster sob GitOps e provar o self-heal.
Modelo de entrega padrão em plataformas Kubernetes modernas.
Rollback de produção por git revert
Avançado45 minM9Reverter uma versão ruim em minutos usando apenas Git.
É assim que se restaura serviço em plataformas GitOps.
Segredos fora do Git com External Secrets
Avançado55 minM9Fazer o cluster buscar a senha do banco no cofre, sem nada sensível no repositório.
Requisito obrigatório para GitOps em ambiente corporativo.
Stack de observabilidade e dashboard do CloudShop
Avançado90 minM10Subir Prometheus, Grafana e Loki e construir o dashboard que responde 'está tudo bem?'.
Sem observabilidade, você descobre incidente pelo cliente.
Alertas acionáveis com runbook vinculado
Avançado60 minM10Criar alertas por sintoma do usuário e testar o disparo de verdade.
Alerta ruim gera fadiga; alerta bom evita indisponibilidade prolongada.
Traces distribuídos com OpenTelemetry
Avançado65 minM10Rastrear uma requisição do frontend até o banco e achar o gargalo.
É o sinal que responde 'onde o tempo foi gasto' em arquitetura distribuída.
SLO, error budget e postmortem
Avançado70 minM10Definir o SLO do CloudShop, medir o budget e escrever um postmortem real.
É o vocabulário que define maturidade de SRE em qualquer entrevista.
Varredura de segredos no histórico do Git
Intermediário40 minM11Provar que nenhum segredo existe no histórico e criar barreira preventiva.
Auditoria de segurança começa exatamente por aqui.
Pipeline de segurança com política de bloqueio
Avançado60 minM11Bloquear o build em vulnerabilidade crítica corrigível e registrar exceções com prazo.
Como DevSecOps funciona sem parar a entrega do time.
Otimização de custo com meta e sem violar o SLO
Intermediário55 minM11Reduzir o custo do ambiente e provar que o SLO permaneceu intacto.
FinOps na prática: economia justificada por dados, não por corte cego.
Portfólio final: README, ADRs e diagrama
Intermediário75 minM11Deixar o CloudShop pronto para ser avaliado por um recrutador técnico.
É o artefato que converte estudo em entrevista.