site reliability engineer (sre)
ubicación: santa fe, ciudad de méxico (cdmx) jornada laboral: tiempo completo (lunes a viernes, 10:00 a.m. a 7:00 p.m.) Modalidad: 100% presencial nivel de experiencia: mid / intermedio (3+ años)
¿quiénes somos?
en picaio estamos transformando la gestión fiscal y financiera de las grandes empresas a través de inteligencia artificial, procesamiento masivo de datos y automatización. Desarrollamos tecnología de alto impacto capaz de procesar millones de transacciones con trazabilidad total y alta disponibilidad.
buscamos a un/a site reliability engineer (sre) / dev sec ops mid con perfil hands-on: un/a profesional apasionado/a por la automatización, la infraestructura en la nube y la estabilidad de plataformas, capaz de aprender rápidamente, integrarse a la construcción de arquitecturas resilientes y resolver retos técnicos del día a día.
descripción del puesto
tu rol principal será garantizar la disponibilidad, estabilidad y rendimiento de nuestros servicios productivos. Como parte activa de nuestro equipo de ingeniería, trabajarás de la mano con desarrollo para automatizar procesos, mejorar la observabilidad y fortalecer la seguridad bajo una cultura de mejora continua y resiliencia.
si cuentas con experiencia en cloud, dev ops o ingeniería de plataformas y tu resistente es resolver problemas complejos mediante infraestructura como código y automatización, ¡esta vacante es para ti!
principales actividades
operar, automatizar y mantener la infraestructura productiva (80% operaciones/infraestructura/automatización, 20% desarrollo).
Implementar y mantener soluciones de monitoreo, observabilidad y alertamiento para dar seguimiento a slis, slos y slas. Gestionar incidentes productivos, ejecutar análisis de causa raíz (rca) y aplicar planes de remediación y troubleshooting. Mantener pipelines de ci/cd e implementar infraestructura como código (ia c). Colaborar de manera presencial con el equipo de desarrollo para incorporar prácticas de confiabilidad y seguridad (dev sec ops) desde el diseño.
requisitos
3 años o más en posiciones como sre, dev ops, platform engineer, cloud engineer o afines. Conocimiento sólido de plataformas cloud (aws, gcp o azure) y gestión de contenedores con docker y kubernetes. Experiencia con terraform, herramientas de ci/cd (git hub actions, git lab ci, jenkins) y administración de linux. Experiencia con contenedores y orquestación (docker y kubernetes). Conocimientos de monitoreo y observabilidad (datadog, grafana, prometheus, new relic o similares). Habilidad para crear scripts y automatizar procesos con bash, python o go.
deseable (puntos extra)
manejo de open telemetry para observabilidad avanzada. Conocimiento en cloud formation. Experiencia en estrategias de recuperación ante desastres (drp) y alta disponibilidad.
beneficios y prestaciones
contratación directa por tiempo indeterminado. Alimento personalizado y gratuito en la oficina. Acceso libre a gimnasio multidisciplinario sin costo. Prestaciones superiores a las de la ley.
¿te interesa el reto?
postúlate por este medio adjuntando tu cv actualizado y nos pondremos en contacto contigo a la brevedad para agendar una entrevista.
📌 Site reliability engineer (sre) (México)
🏢 PICAIO
📍 México