Observability Engineer (Ciudad de México)

Observability Engineer (Ciudad de México)

02 ago
|
Sequoia Connect
|
Ciudad de México

02 ago

Sequoia Connect

Ciudad de México

En Sequoia Connect, somos un Ecosistema Tecnológico Talent-First que redefine la interacción entre los profesionales de élite y el panorama corporativo global. Actuamos como un catalizador para el top 1% del talento, conectando el potencial humano con ejecuciones industriales y tecnológicas de alta complejidad. Al unirte a nuestra red de élite, no simplemente ocupas una posición; te alineas con un socio estratégico dedicado a actualizar tu "Human OS" y acelerar tu crecimiento profesional a través de proyectos de clase mundial y alto impacto.

Actualmente, colaboramos con la institución pilar del sistema financiero mexicano, líder absoluta en la gestión integral de riesgo, análisis de datos e historial crediticio. Con décadas de trayectoria, esta organización es el motor de confianza que habilita la inclusión financiera y el ecosistema de crédito a nivel nacional. Nuestro cliente administra una de las bases de datos transaccionales y de comportamiento más grandes, complejas y seguras del país, brindando servicios de inteligencia financiera a las instituciones bancarias y comerciales más importantes.

Esta es tu oportunidad de integrarte a un entorno tecnológico de misión crítica, donde la ciberseguridad, el procesamiento de Big Data y la analítica avanzada son el corazón de la operación diaria. Trabajarás en proyectos de alto rigor técnico que impactan directamente en la economía de millones de personas y en las decisiones estratégicas de miles de empresas. Si eres un cualificado que busca un reto de gran escala, estabilidad institucional incomparable y la oportunidad de garantizar la confiabilidad de la infraestructura financiera nacional, aquí es donde perteneces.

Actualmente nos encontramos buscando un Ingeniero Senior de Confiabilidad de Sitio (SRE) y Observabilidad:

El Reto (Responsabilidades)

- Definir,



instrumentar y operar SLOs/SLIs para los servicios críticos; administrar presupuestos de error (error budgets) y empujar mejoras basadas en datos.
- Construir, mantener y evolucionar la plataforma de observabilidad (métricas, logs, trazas), asegurando cobertura, calidad de datos y tiempos de detección (MTTD).
- Liderar la respuesta técnica a incidentes mayores (Sev1/Sev2), coordinar war rooms, comunicar el estado y conducir la estabilización del servicio para mejorar el MTTR.
- Conducir análisis post-mortem sin culpa (blameless), identificar causas raíz, definir y dar seguimiento a acciones correctivas y preventivas para evitar la recurrencia de incidentes.
- Diseñar e implementar automatizaciones para eliminar el trabajo manual repetitivo (toil), mejorar los tiempos de respuesta y automatizar runbooks.

Tu Perfil (Requisitos)

- Ingeniería en Sistemas, Computación, Telecomunicaciones o campo afín.
- Experiencia comprobable en ingeniería de confiabilidad de sitio (SRE), observabilidad, monitoreo de plataformas de misión crítica y troubleshooting de sistemas distribuidos.
- Dominio en plataformas de observabilidad como PRTG, Prometheus/Grafana, ELK/OpenSearch, Datadog, New Relic, AxonOps u OpenTelemetry.
- Experiencia operando sistemas distribuidos: Apache Cassandra, Kafka, contenedores (Kubernetes) y bases de datos relacionales y NoSQL.
- Administración avanzada de Linux y sólidas habilidades de scripting (Python, Bash, Go).
- Experiencia en automatización de infraestructura (Ansible, Terraform) y pipelines CI/CD.




- Conocimiento en la gestión de SLOs/SLIs, error budgets, y uso de herramientas de gestión de incidentes (PagerDuty/Opsgenie).
- Sólidos conocimientos en metodologías ITIL v4 e ISO 20000.
- Mindset de Alto Rendimiento: Resiliencia, inteligencia emocional y enfoque en entrega ágil.
- ADN Tecnológico: Entendimiento profundo de la diferencia entre programar e ingeniería.

Deseable

- Conocimientos en fundamentos de Cloud o experiencia con asistentes de código con IA.

Idiomas

- Inglés Técnico: Nivel intermedio-avanzado (Capacidad para la lectura y comprensión de documentación técnica y especificaciones, así como comunicación).
- Español Nativo.

Notas Especiales

- N/A

Esquema de Trabajo

Valoramos la flexibilidad para adaptarnos a tu estilo de vida. Esta posición está disponible como:

- Presencial (Sujeto a las necesidades del proyecto).

Si cumples con estos requisitos y estás buscando nuevos retos, inicia tu solicitud en nuestro sitio web para unirte a un empleador galardonado. Explora todas nuestras vacantes | Página de carreras de Sequoia: https://www.sequoia-connect.com/careers/

Keywords:
SRE, Observability, Site Reliability Engineering, Cloud, Monitoreo

- Ingeniería en Sistemas, Computación o afín.
- Experiencia en ingeniería de confiabilidad de sitio (SRE), observabilidad y monitoreo de plataformas críticas.
- Experiencia con PRTG, Prometheus/Grafana, ELK/OpenSearch, Datadog, New Relic, AxonOps u OpenTelemetry.
- Experiencia en sistemas distribuidos (Cassandra, Kafka, Kubernetes, BD relacionales y NoSQL).
- Administración avanzada de Linux y scripting en Python, Bash o Go.
- Experiencia en automatización con Ansible, Terraform y CI/CD.
- Experiencia en gestión de incidentes (PagerDuty/Opsgenie), SLOs/SLIs, error budgets y post-mortems sin culpa.
- Inglés intermedio-avanzado.

📌 Observability Engineer (Ciudad de México)
🏢 Sequoia Connect
📍 Ciudad de México

Postulate a este anuncio

Muestra tus habilidades a la empresa, rellenar el formulario y deja un toque personal en la carta, ayudará el reclutador en la elección del candidato.

Suscribete a esta alerta:

Recibe por email las nuevas ofertas de trabajo para: observability engineer (ciudad de méxico) / ciudad de méxico

Suscribete a esta alerta:

Recibe por email las nuevas ofertas de trabajo para: observability engineer (ciudad de méxico) / ciudad de méxico