04 ago
|
Scotiabank
|
Xico
PropósitoEl Ingeniero de Soporte Aplicaciones tiene como propósito garantizar la disponibilidad, confiabilidad, escalabilidad y eficiencia operativa de los sistemas y servicios críticos de la organización, combinando prácticas de ingeniería de software con operaciones.El Ingeniero de Soporte Aplicaciones trabaja en estrecha colaboración con los equipos de desarrollo, operaciones y producto para implementar y fortalecer prácticas de observabilidad, gestión de incidentes, respuesta ante fallos, automatización y mejora continua, asegurando que los servicios cumplan con los acuerdos de nivel de servicio (SLA/SLO) establecidos y mantengan una experiencia de usuario óptima.Asimismo, se encarga de detectar fallas en tiempo real, liderar la respuesta técnica inicial, automatizar tareas repetitivas, reducir el MTTR y proporcionar análisis basados en datos para prevenir incidentes futuros y mejorar continuamente la confiabilidad del contexto productivo.
Responsabilidades
Diseñar, implementar y mantener sistemas resilientes que cumplan con SLO/SLA.
Asegurar la operación 7x24 y la continuidad del servicio respetando error budgets.
Observabilidad y análisis (end to end)
Implementar y mantener observabilidad (métricas, logs, trazas) y alertas accionables.
Administrar dashboards y reglas de alerta en la plataforma de monitoreo utilizada.
Definir, medir y monitorear SLI/SLO por servicio.
Analizar tendencias y degradaciones con datos (queries de métricas, logs y trazas).
Gestión de incidentes y postmortems
Actuar como primer nivel técnico especializado: detección y diagnóstico inicial.
Coordinar la escalación y apoyar la resolución durante incidentes P1/P2.
Documentar y dar seguimiento a postmortems/RCA y planes de acción.
Reducir MTTR y prevenir reincidentes.
Confiabilidad, automatización y mejora continua
Aplicar prácticas SRE (toil reduction, automatización, release readiness, error budgets).
Automatización y mejoras operativas
Automatizar tareas operativas (scripts, pipelines CI/CD,
remedios).
Identificar y ejecutar optimización de arquitectura, rendimiento y costos.
Gestión de capacidad y escalabilidad
Analizar tendencias de uso y crecimiento para anticipar necesidades de infraestructura.
Planificar y validar escalabilidad y performance de los servicios.
Colaboración transversal
Colaborar con Desarrollo, QA, Seguridad, Infraestructura y Producto desde el diseño.
Asegurar que los nuevos servicios cumplan estándares de observabilidad, mantenibilidad y confiabilidad antes del go live.
Seguridad y cumplimiento
Asegurar cumplimiento de políticas de seguridad, privacidad y normativas aplicables.
Colaborar en controles, evidencias y auditorías conforme a marcos internos.
Documentación técnica y cultura SRE
Mantener documentación clara y actualizada (arquitectura, procesos, runbooks, SLI/SLO, RCA).
Promover principios SRE y buenas prácticas dentro de los equipos relacionados.
Educación / Experiencia
Título universitario en Ingeniería en Sistemas, Computación, Telecomunicaciones o afín.
Nivel de inglés intermedio alto (oral y escrito).
2+ años de experiencia en entornos productivos de alta disponibilidad y alto volumen transaccional (operación 7x24).
2+ años en soporte a producción o roles relacionados con confiabilidad, operación o monitoreo.
1+ años de experiencia en ingeniería de nube (AWS, GCP, Azure) o funciones equivalentes.
Experiencia en diseño, implementación y mantenimiento de SLI/SLO y prácticas SRE.
Experiencia con microservicios, cargas de trabajo basadas en contenedores y funciones.
Experiencia en diseño de arquitecturas resilientes, escalables y seguras.
Participación en gestión de incidentes complejos, diagnósticos detallados y análisis de causa raíz.
Capacidad probada para identificar proactivamente problemas, cuellos de botella y oportunidades de mejora.
Si necesitas algún tipo de adaptación en temas de accesibilidad durante el proceso, indícalo a nuestro equipo de Atracción de Talento.
Ubicación: Ciudad de México, México
#J-*****-Ljbffr
📌 Ing Soporte Aplicaciones (Xico)
🏢 Scotiabank
📍 Xico