Líder de Fiabilidad Tecnológica / Responsable de Operaciones
¿De qué se encarga la posición?
Garantizar la estabilidad, disponibilidad y escalabilidad de la plataforma tecnológica mediante la automatización. Contribuye a la construcción y mejora continua de la infraestructura, la observabilidad y la eficiencia operativa, asegurando que los squads de desarrollo cuenten con herramientas y procesos para operar y recuperar sus componentes de manera veloz, confiable y autónoma.
Requisitos:
Escolaridad: Cualificado en Ingeniería de Sistemas o carreras afines.
Experiencia: Mínimo 3 años de experiencia colaborando con equipos de desarrollo y operaciones en la mejora de sistemas, observabilidad de ecosistemas tecnológicos y automatización.
Idiomas: Inglés nivel medio / intermedio.
Disponibilidad: Requiere disponibilidad en horario extralaboral.
Conocimientos Requeridos:
Conceptos y herramientas de Observabilidad (Datadog, Dynatrace, etc.).
Automatización de procesos en operaciones de tecnología.
Marcos de trabajo como ITIL o COBIT.
Metodologías tradicionales de gestión de proyectos (PMI).
Responsabilidades principales:
Disponibilidad y Resiliencia: Garantizar la disponibilidad y confiabilidad de la plataforma, asegurando el cumplimiento de los SLIs/SLOs/SLAs definidos con el negocio.
Estrategia de Observabilidad: Definir, implementar y hacer evolucionar la estrategia de observabilidad (métricas, logs, trazabilidad y alertamiento inteligente).
Automatización Operativa: Desarrollar mecanismos de automatización para la gestión de incidentes, respuesta a fallos en producción, notificación de errores (vía MS Teams) y tareas repetitivas.
Modelo de Operación y Gestión de Incidentes: Definir junto al líder de Tecnología el modelo de operación tecnológica (incidentes, requerimientos), liderar postmortems y asegurar que las políticas y lineamientos se cumplan en las filiales.
Colaboración con Squads y Cultura SRE/DevOps: Acompañar a los equipos de