Homelab: infraestrutura self-hosted como código
75 serviços em produção, HA de DNS, observabilidade completa e automação de negócio real, tudo declarado como código.
75 serviços · DNS em HA · backup GFS
- Docker Compose
- Traefik
- Prometheus
- Grafana
~ $ whoami
Site Reliability Engineer (SRE) · PagBank
disponívelSustento produção crítica no mercado financeiro: resposta a incidentes, observabilidade e automação.
Em casa, a mesma engenharia continua: homelab self-hosted 100% como código, com alta disponibilidade e observabilidade completa.
SRE no PagBank, atuo na sustentação de produção crítica do mercado financeiro: escala de plantões, resposta a incidentes e a automação que evita que o mesmo problema aconteça duas vezes.
Opero infraestrutura de ponta a ponta (rede, alta disponibilidade, observabilidade, segurança), tudo declarado como código, do design à análise de causa raiz.
Fora do banco, o laboratório é real: um homelab com 75 serviços em produção e o wa-courier, gateway WhatsApp open source que criei e mantenho. Em paralelo, desenvolvo um SaaS multi-tenant pro mercado imobiliário, em fase de MVP.
Nada configurado manualmente que não possa ser reconstruído do zero a partir do repositório.
Métricas, logs e alertas fazem parte do design do serviço, não são um extra adicionado depois.
Múltiplas camadas de defesa (rede, autenticação, análise de log) em vez de depender de um único controle.
+ o lado self-hosted inteiro: os serviços do homelab, ao vivo →
75 serviços em produção, HA de DNS, observabilidade completa e automação de negócio real, tudo declarado como código.
75 serviços · DNS em HA · backup GFS
Gateway HTTP open source pra WhatsApp: um número, um container Docker, zero serviço externo. Em produção, MIT license.
MIT · multi-arch · Prometheus
Produto multi-tenant em desenvolvimento, do banco à operação. Detalhes quando o MVP amadurecer.
MVP em construção
Site Reliability Engineer · Sênior
Canary deploy + ASG afinado pra tráfego crítico. O crivo técnico antes da produção.
Site Reliability Engineer · Pleno
Self-service de SFTP multi-tenant (Jenkins + Terraform). Zero fila de infra.
Site Reliability Engineer
Primeiro cargo formal de SRE. Troubleshooting em sistemas de pagamento.
Administrador de Sistemas · TEF
Sitef, AGK e Intellinac. Automação com Salt/Ansible, IaC com Terraform.
Administrador de Sistemas
Puppet, Docker e microsserviços (Mesos/Marathon) em meio de pagamento.
Analista de Suporte
Seis anos de backup, Nagios e Shell Script. A base da disciplina de SRE.
E-mail é o canal com melhor SLA de resposta. Os outros ficam de backup.
disponívelemail[email protected]
githubgithub.com/thales-machado
linkedinin/thales-machado
localPassos, MG · GMT-3