Site Reliability Engineer · Observabilidade · AI for Ops
Seba Pinery
Construo sistemas confiáveis onde a observabilidade é o coração da operação, para que o produto cresça enquanto a infraestrutura se mantém estável.
Impacto
Resultados mensuráveis
Resultados em plataformas de produção sob minha responsabilidade.
−60%
menos alertas falso-positivos
alerts.false_positive.rate
+6.000
monitores de produção governados
monitors.production.count
+50
times com Alerting-as-Code
terraform.teams.managed
−75%
custo de infraestrutura cloud
gcp.cost.monthly
−75% / −50%
MTTA / MTTR
incident.mtta · incident.mttr
2×
deploys diários
deploy.frequency.daily
Especialidade
O que eu faço
Construo e opero sistemas críticos em produção com foco em confiabilidade e desempenho.
Infraestrutura Cloud
Design e provisionamento de infraestruturas resilientes na AWS e no GCP. Gestão avançada de Kubernetes e Infraestrutura como Código com Terraform para ambientes escaláveis, seguros e reproduzíveis.
- AWS
- GCP
- Kubernetes
- Terraform
- Helm
Observabilidade
Instrumentação de serviços com OpenTelemetry e ecossistemas de alta ingestão, open source (Prometheus) e enterprise (Datadog). Estratégias de custom attributes nos spans e métricas de negócio customizadas para monitorar a operação em tempo real, com controle do custo da observabilidade.
- Datadog
- OpenTelemetry
- Prometheus
- Grafana
- Loki
IA para Operações
Agentes de IA na AWS Bedrock que atendem alertas e fazem a triagem no Datadog para detectar cedo o impacto na operação. Orquestração de agentes nos repositórios da empresa com um harness de agentes e Spec Driven Development (SDD): regras e especificações versionadas que todos que usam o Claude no repositório seguem da mesma forma.
- AWS Bedrock
- Claude
- Agent Harness
- SDD
- Datadog
CI/CD e Automação
Integração e entrega contínuas baseadas em GitOps com ArgoCD e Argo Rollouts. Eficiência operacional por meio da automação de infraestrutura e de processos rotineiros.
- ArgoCD
- Argo Rollouts
- GitLab CI
- GitOps
Stack
Ferramentas que uso no dia a dia
Cloud e Plataforma
- AWS
- Google Cloud
- Kubernetes
- Terraform
- Helm
- Linkerd
- Traefik
- Cloudflare
Observabilidade
- Datadog
- OpenTelemetry
- OTel Collector
- Prometheus
- Grafana
- Loki
- CloudWatch
IA e Agentes
- AWS Bedrock
- Claude
- Agent Orchestration
- Agent Harness
- Spec Driven Development
Entrega e Incidentes
- ArgoCD
- Argo Rollouts
- GitLab CI
- Jira Service Management
Linguagens
- Go
- Python
- TypeScript
- Node.js
Experiência
Onde trabalhei
- set. de 2025 — AtualSr Observability Infrastructure Engineer · Spin−60% de alertas falso-positivos em mais de 6.000 monitores
- jan. de 2024 — set. de 2025Site Reliability Engineer · SpinResposta a incidentes on-call, RCAs e práticas de SRE para times de produto
- jun. de 2022 — jan. de 2024Infrastructure Engineer · Ventura Travel−75% de custos no GCP · MTTA −75% · MTTR −50%
Vamos trabalhar juntos?
Estou disponível para projetos de consultoria e colaborações. Vamos conversar sobre como posso ajudar com a sua infraestrutura.
Iniciar conversa