10 ago
|
STEFANINI LATAM
|
Lima
10 ago
STEFANINI LATAM
Lima
En Stefanini, somos más de 30,000 profesionales en 41 países, impulsando la innovación y co-creando un futuro mejor a través de la tecnología.
Actualmente buscamos un(a) Lead of Observability & SRE, un líder estratégico y técnico que será responsable de definir, gobernar y evolucionar las capacidades de observabilidad, confiabilidad y monitoreo de servicios críticos, asegurando altos niveles de disponibilidad, rendimiento y resiliencia en entornos de alta exigencia.
¿Cuál será tu misión?
Serás responsable de definir y liderar la estrategia corporativa de Observabilidad y SRE, estableciendo estándares, prácticas y modelos operativos que aseguren una visibilidad integral de los servicios digitales, promuevan la resiliencia tecnológica y fortalezcan una cultura de mejora continua, automatización y excelencia operativa.
Principales responsabilidades
- Definir la estrategia corporativa de Observabilidad y Site Reliability Engineering (SRE).
- Diseñar y gobernar estándares de métricas, logs, trazas, eventos y alertas.
- Establecer y gestionar SLI, SLO y Error Budgets para servicios críticos.
- Liderar la gestión de incidentes críticos, Problem Management, RCA y postmortems.
- Impulsar la automatización operativa y la adopción de prácticas Dev Ops y SRE.
- Garantizar la observabilidad integral de aplicaciones, APIs, infraestructura y plataformas Cloud.
- Diseñar dashboards ejecutivos y operativos,
optimizando la detección temprana de riesgos e incidentes.
- Liderar la evolución de herramientas como Dynatrace, Datadog, Grafana, Prometheus, Open Telemetry, ELK, Splunk, Azure Monitor y Azure Log Analytics.
- Desarrollar y liderar equipos multidisciplinarios, promoviendo una cultura de mejora continua, confiabilidad y excelencia operativa.
- Más de 7 años de experiencia en tecnología, infraestructura, operaciones, Cloud, Dev Ops, observabilidad o confiabilidad.
- Más de 3 años liderando equipos o iniciativas SRE.
- Experiencia comprobada en alta disponibilidad, observabilidad, gestión de incidentes y problemas, automatización operativa, monitoreo de plataformas y gestión del rendimiento.
- Conocimiento sólido en entornos Cloud, herramientas de monitoreo y ecosistemas Dev Ops.
- Experiencia trabajando con equipos de Desarrollo, Infraestructura, Operaciones, Seguridad, Cloud y proveedores.
- Deseable experiencia en sectores como Banca, Fintech, Telecomunicaciones o industrias con servicios digitales críticos.
Competencias clave
Buscamos un cualificado con fuerte liderazgo técnico, pensamiento analítico, capacidad para la toma de decisiones en escenarios críticos, orientación a resultados, influencia transversal y excelentes habilidades de comunicación con equipos técnicos y niveles ejecutivos.
#J-18808-Ljbffr
📌 Líder de Observabilidad y SRE (Lima)
🏢 STEFANINI LATAM
📍 Lima