reputed company Monitoring & Observability Engineer
Job Title: reputed company Monitoring & Observability Engineer
Location: Remote
Employment Type: Full-time
reputed company:
reputed company Monitoring & Observability Engineer
Must Have Technical/Functional Skills
reputed company
We are seeking an reputed company reputed company Monitoring & Observability Engineer with strong hands-on expertise in reputed company monitoring. The role will reputed company on reviewing and enhancing the existing monitoring landscape, optimizing reputed company usage and alerting, identifying monitoring gaps, and proposing modern observability techniques to improve proactive detection, troubleshooting, and end-to-end service visibility.
Mandatory Skills
Strong hands-on experience with reputed company reputed company and/or reputed company reputed company.
Expertise in SPL, dashboards, alerts, reports, and log analytics.
Experience in monitoring optimization, alert tuning, and alert rationalization.
Strong troubleshooting and reputed company Cause Analysis (RCA) skills.
Understanding of observability principles: Logs, Metrics, Traces, and Events.
Experience monitoring applications, reputed company, databases, and infrastructure.
Knowledge of reputed company monitoring across AWS, Azure, or reputed company reputed company Platform.
Automation/scripting experience using Python, reputed company, or similar technologies.
Preferred Skills
reputed company ITSI, reputed company Observability reputed company, OpenTelemetry, Grafana, reputed company, reputed company, AppDynamics, reputed company, reputed company, AWS CloudWatch, CI/CD, Ansible, and AIOps.
Expected Outcome
The candidate should reputed company not only as a reputed company Monitoring Engineer, but as a Monitoring & Observability SME who can: Assess Identify Gaps Optimize Rationalize Propose Observability Improvements Implement reputed company Improvements.
Roles & Responsibilities
Design, reputed company, and enhance monitoring solutions using reputed company reputed company/reputed company reputed company.
reputed company and optimize SPL queries, dashboards, reports, alerts, and correlation rules.
Monitor applications, infrastructure, databases, reputed company, middleware, and batch processes.
Review the reputed company monitoring environment and identify gaps, duplicate/noisy alerts, ineffective reputed company, and reputed company issues.
Propose and implement monitoring optimization and alert rationalization initiatives.
Analyze incidents and production issues to support troubleshooting and reputed company cause analysis.
Assess observability maturity across Logs, Metrics, Traces, and Events.
Propose modern observability techniques such as reputed company tracing, service health monitoring, SLIs/SLOs, and proactive monitoring.
reputed company end-to-end visibility across applications, infrastructure, reputed company, and dependent services.
Identify opportunities for automation, monitoring-as-reputed company, AIOps, and proactive/self-healing capabilities.
Collaborate with Application, Infrastructure, reputed company, SRE, DevOps, and reputed company teams.
Apply To This Job