Site Reliability Engineer · Observabilidad · AI for Ops
Seba Pinery
Construyo sistemas confiables donde la observabilidad es el corazón de la operación, para que el producto crezca mientras la infraestructura se mantiene estable.
Impacto
Resultados medibles
Resultados en plataformas productivas bajo mi responsabilidad.
−60 %
menos alertas falsas positivas
alerts.false_positive.rate
+6.000
monitores productivos gobernados
monitors.production.count
+50
equipos con Alerting-as-Code
terraform.teams.managed
−75 %
costo de infraestructura cloud
gcp.cost.monthly
−75 % / −50 %
MTTA / MTTR
incident.mtta · incident.mttr
2×
despliegues diarios
deploy.frequency.daily
Especialidad
Qué hago
Construyo y opero sistemas productivos críticos con foco en confiabilidad y rendimiento.
Infraestructura Cloud
Diseño y aprovisionamiento de infraestructuras resilientes en AWS y GCP. Gestión avanzada de Kubernetes e Infraestructura como Código con Terraform para entornos escalables, seguros y reproducibles.
- AWS
- GCP
- Kubernetes
- Terraform
- Helm
Observabilidad
Instrumentación de servicios con OpenTelemetry y ecosistemas de alta ingestión, open source (Prometheus) y enterprise (Datadog). Estrategias de custom attributes en los spans y métricas de negocio custom para monitorear la operación en tiempo real, con control del costo de la observabilidad.
- Datadog
- OpenTelemetry
- Prometheus
- Grafana
- Loki
IA para Operaciones
Agentes de IA sobre AWS Bedrock que atienden alertas y hacen triage en Datadog para detectar a tiempo la afectación a la operación. Orquestación de agentes en los repositorios de la compañía con un harness de agentes y Spec Driven Development (SDD): reglas y especificaciones versionadas que cualquier persona que use Claude en el repositorio sigue por igual.
- AWS Bedrock
- Claude
- Agent Harness
- SDD
- Datadog
CI/CD y Automatización
Integración y entrega continua basadas en GitOps con ArgoCD y Argo Rollouts. Eficiencia operativa mediante la automatización de infraestructura y procesos rutinarios.
- ArgoCD
- Argo Rollouts
- GitLab CI
- GitOps
Stack
Herramientas que uso a diario
Cloud y Plataforma
- AWS
- Google Cloud
- Kubernetes
- Terraform
- Helm
- Linkerd
- Traefik
- Cloudflare
Observabilidad
- Datadog
- OpenTelemetry
- OTel Collector
- Prometheus
- Grafana
- Loki
- CloudWatch
IA y Agentes
- AWS Bedrock
- Claude
- Agent Orchestration
- Agent Harness
- Spec Driven Development
Entrega e Incidentes
- ArgoCD
- Argo Rollouts
- GitLab CI
- Jira Service Management
Lenguajes
- Go
- Python
- TypeScript
- Node.js
Experiencia
Dónde trabajé
- sept 2025 — ActualidadSr Observability Infrastructure Engineer · Spin−60 % de alertas falsas positivas sobre +6.000 monitores
- ene 2024 — sept 2025Site Reliability Engineer · SpinRespuesta a incidentes on-call, RCAs y prácticas SRE para equipos de producto
- jun 2022 — ene 2024Infrastructure Engineer · Ventura Travel−75 % de costos en GCP · MTTA −75 % · MTTR −50 %
¿Trabajamos juntos?
Estoy disponible para proyectos de consultoría y colaboraciones. Hablemos sobre cómo puedo ayudar con tu infraestructura.
Iniciar conversación