Sou engenheiro de Confiabilidade de Site/DevOps com mais de 4 anos de experiência prática em produção, construindo infraestrutura que escala sem quebrar às 3 da manhã.
O que realmente construí em produção:
- Migrações AWS sem tempo de inatividade (troca de Elastic IP entre contas, delegação DNS no Route53, reconfiguração do NLB) com automação de rollback
- Pipeline CI/CD usando CDK/CodePipeline e GitHub Actions com varredura de segurança automatizada
- Clusters EKS com armazenamento suportado por FSx e recuperação de desastres, reduzindo o tempo de inatividade em 90%
- Monitoramento CloudWatch/Prometheus cobrindo mais de 15 modos de falha com logs estruturados e alertas em múltiplos períodos
- Infraestrutura provisionada com Terraform para onboarding de ambientes seguros e repetíveis
- Automação personalizada em Go e Python para orquestração de infra (por exemplo, uma camada proxy SFTP personalizada)
O que trago dos meus próprios sistemas (construídos e operados de forma independente):
- Plataformas Kubernetes auto-recuperáveis com GitOps (ArgoCD), política como código (Kyverno) e chaos engineering (AWS FIS) testadas contra SLA de recuperação de 10 minutos
- Detecção de segurança em tempo de execução usando Falco com resposta automatizada e classificada por severidade
- Operador Kubernetes do zero (Go, CRDs personalizados, controller-runtime) para gerenciamento de frota
- Multi-cl