31 jul
|
Brillio 2
|
Jalisco
Senior Observability / Monitoring EngineerRole OverviewWe are looking for a Senior Observability / Monitoring Engineer to design, implement, and optimize observability solutions for large-scale enterprise platforms. This role will play a critical part in enabling proactive monitoring, faster incident detection, and improved system reliability across Salesforce and Microsoft Azure environments. The ideal candidate will have strong expertise in metrics, logs, traces, alerting strategies, and observability tooling, along with hands‑on experience supporting production environments.Key Responsibilities - Observability EngineeringDesign and implement end-to-end observability frameworks across Salesforce and Azure platformsEstablish unified monitoring across logs, metrics, and distributed tracingDefine and standardize observability best practices, dashboards, and alerting strategiesEnable proactive detection of issues through intelligent alerting and anomaly detection Monitoring & ToolingImplement and manage tools such as Azure Monitor, Application Insights, Splunk, Datadog, Grafana, Prometheus, or similarBuild actionable dashboards for operations, SRE, and business stakeholdersOptimize alert noise reduction and improve signal-to-noise ratioContinuously enhance monitoring coverage across applications and infrastructure Incident Support & ReliabilitySupport incident management by providing deep insights using observability dataPerform root cause analysis (RCA) leveraging logs, traces,
and metricsCollaborate with SRE and engineering teams to improve system reliability and performanceContribute to post‑incident reviews and continuous improvement initiatives Automation & IntegrationAutomate monitoring setup and configuration using Infrastructure as Code (IaC)Integrate observability tools with CI/CD pipelines and DevOps workflowsDevelop scripts or tools to enhance monitoring capabilities and data collection Platform & Integration SupportMonitor and optimize Salesforce applications, including integrations and APIsSupport Azure‑based services, ensuring visibility across compute, storage, and networking layersEnsure end‑to‑end observability across integrated systems and middleware Governance & ComplianceEnsure observability practices align with security and compliance requirements (e.G., SOX)Maintain documentation, runbooks, and monitoring standardsSupport audits and governance reviews as requiredRequired Skills & Qualifications Technical SkillsStrong experience in observability, monitoring, or SRE rolesHands‑on experience with Azure (Azure Monitor, Application Insights)Experience with observability tools (Splunk, Datadog, Prometheus, Grafana, etc.)Strong understanding of logs, metrics, traces, and distributed systemsExperience with APM tools and performance tuningScripting skills (Python, PowerShell, Bash, or similar)Familiarity with CI/CD tools (Azure DevOps, Jenkins, GitHub Actions)Knowledge of Infrastructure as Code (Terraform, ARM, Bicep) Platform KnowledgeExperience supporting Salesforce environments (monitoring integrations, APIs, performance)Understanding of cloud‑native and microservices architectures Operational ExcellenceExperience in incident management and RCAAbility to analyze system performance and recommend improvementsStrong troubleshooting and analytical skills Soft SkillsStrong communication and collaboration skillsAbility to work with cross‑functional and general teamsProactive mindset with a focus on continuous improvement#J-18808-Ljbffr
📌 Senior Tech Specialist, Devops150 (Jalisco)
🏢 Brillio 2
📍 Jalisco