Saltar al contenido
Seba Pinery

Trayectoria

Experiencia

Una trayectoria enfocada en SRE, observabilidad e infraestructura: del desarrollo backend a la ingeniería cloud a escala.

Trabajo remoto desde 2021

  1. sept 2025 — Actualidad

    Spin

    México · Remoto

    Sr Observability Infrastructure EngineerIC4Actualidad

    Escalo la visibilidad de los sistemas para toda la compañía. Co-administro múltiples tenants de Datadog —plataforma crítica utilizada por más de 1.200 personas para logs, métricas, trazas y eventos— y la estrategia de más de 6.000 monitores productivos en las unidades de negocio, asegurando que las alertas críticas sean prioritarias. Mi foco es traducir la observabilidad técnica en impacto de negocio: métricas custom centradas en la operación de cara al cliente final, dashboards operativos a nivel de infraestructura y de negocio, y políticas de escalación y enrutamiento integradas con Jira Service Management (ITSM).

    Logros principales

    • Gestión multi-tenant de alertas para más de 1.200 usuarios y 6.000 monitores.
    • Reducción del 60 % de alertas falsas positivas mediante la calibración sistemática de monitores.
    • Instrumentación de servicios con OpenTelemetry y estrategia de custom attributes en los spans, base de métricas de negocio custom monitoreadas en tiempo real y de dashboards operativos.
    • Gobierno de Alertas como Código con Terraform: centralicé routing rules, schedules y políticas de escalación para más de 50 equipos en 5 unidades de negocio, federando roles y eliminando la configuración manual de la plataforma.
    • Optimización de escalación y enrutamiento en Jira Service Management, categorizando alertas según Golden Signals (requests, errores, latencia) para alinear la respuesta con el impacto real en el usuario.
    • Desarrollé un agente de IA en AWS Bedrock, hoy en beta, que atiende las alertas de Datadog, realiza el triage y detecta afectación a la operación, priorizando lo que impacta al cliente final.
    • Harness de agentes y Spec Driven Development (SDD) en los repositorios de la compañía para la orquestación de agentes: reglas y especificaciones versionadas que cualquier persona que use Claude en el repositorio sigue por igual, mejorando la experiencia de desarrollo.

    Stack

    • Datadog
    • OpenTelemetry
    • AWS Bedrock
    • Claude
    • Terraform
    • Jira Service Management
    • CloudWatch
    • Prometheus
  2. ene 2024 — sept 2025

    Spin

    México · Remoto

    Site Reliability EngineerIC3

    Trabajé en la respuesta a incidentes críticos, coordinando equipos multidisciplinarios y aplicando marcos ITIL para optimizar el escalamiento, la documentación y la comunicación. Junto a los Incident Managers mejoré la priorización de alertas y el proceso de post-mortems, e integré el monitoreo en los flujos de incidentes. Realicé análisis de causa raíz de problemas recurrentes y propuse mejoras arquitectónicas —circuit breakers, rate limits, estrategias de caché— para aumentar la resiliencia, y ayudé a incorporar prácticas SRE (ownership de servicios, guardias rotativas, revisiones de confiabilidad) para que los equipos de producto se hicieran cargo de la salud, latencia y disponibilidad de sus servicios.

    Logros principales

    • Atención de incidentes críticos en esquema de guardias on-call.
    • Monitores de alertas para equipos de desarrollo y de operaciones.
    • Post-mortems y análisis de causa raíz.
    • Seguimiento de problemas recurrentes y propuestas de mejora arquitectónica.
    • Seguimiento de SLA con proveedores de servicios.

    Stack

    • AWS
    • Kubernetes
    • Terraform
    • ArgoCD
    • Argo Rollouts
    • Helm
    • Linkerd
    • Jira Service Management
    • Datadog
  3. jun 2022 — ene 2024

    Ventura Travel

    Alemania · Remoto

    Infrastructure Engineer

    Lideré la regeneración completa de la infraestructura en Google Cloud Platform, diseñándola desde cero y desplegándola con Terraform: clusters de Kubernetes, Cloud Storage y networking cloud (VPCs, subredes, firewall). El resultado fue una plataforma mucho más estable y confiable, y una base sólida y escalable para producción.

    Logros principales

    • Reducción del 75 % en los costos de infraestructura en GCP.
    • Pipelines de CI sobre instancias Spot en GKE: 50 % menos tiempo de ejecución y el doble de despliegues diarios.
    • MTTA −75 % y MTTR −50 % tras desplegar Prometheus, Loki y Grafana con cobertura de alertas en el 100 % de los microservicios.
    • Gobierno de infraestructura con Terraform y prácticas de FinOps para el control del presupuesto cloud.

    Stack

    • Google Cloud
    • Kubernetes
    • Terraform
    • Grafana
    • Prometheus
    • Loki
    • GitLab CI
    • ArgoCD
    • Traefik
    • Cloudflare
  4. ago 2021 — jun 2022

    Time Jobs

    Chile · Remoto

    DevOps Engineer

    Participé en la transformación estratégica de la plataforma cloud, ejecutando la migración completa de la operación de la empresa desde AWS a Google Cloud Platform. Esto garantizó la continuidad del negocio y sentó las bases de una arquitectura escalable y eficiente en costos mediante una estrategia GitOps de punta a punta: Terraform para el aprovisionamiento y ArgoCD para automatizar el despliegue de microservicios, estandarizando los flujos de trabajo en toda la organización.

    Logros principales

    • Migración completa de AWS a GCP sin interrupción operativa.
    • Librerías privadas para generar spans y atributos personalizados de OpenTelemetry, elevando la calidad de la observabilidad y acelerando el diagnóstico de problemas complejos.
    • Estrategia de despliegue declarativa con Terraform y ArgoCD, unificando y automatizando el ciclo de vida de la infraestructura y los microservicios en toda la organización.

    Stack

    • AWS
    • GCP
    • Terraform
    • ArgoCD
    • OpenTelemetry
    • Prometheus
    • Grafana
    • Loki
    • GitLab CI
    • Traefik
    • Cloudflare
  5. Hasta 2021

    Varias empresas

    Remoto

    Desarrollador Backend

    Desarrollo backend con Node.js y TypeScript antes de pasar a infraestructura y confiabilidad.

    Logros principales

    • Desarrollo de microservicios con Node.js, TypeScript y NestJS.

    Stack

    • Node.js
    • TypeScript
    • NestJS
    • MongoDB
    • PostgreSQL
    • Docker

¿Trabajamos juntos?

Estoy disponible para proyectos de consultoría y colaboraciones. Hablemos sobre cómo puedo ayudar con tu infraestructura.

Iniciar conversación