Senior Monitoring & Observability Engineer (all genders)
Core
Ensuring stability, high-performance, and scalability across the global application landscape through proactive monitoring, alerting, and incident management.
Role type
Senior Monitoring & Observability Engineer (L3 Support)
Builds
Monitoring dashboards, alerting frameworks, and automation for system health and business processes.
Domain
E-commerce, Cloud-native infrastructure, Observability
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Prometheus, Grafana, New Relic, AWS, Infrastructure as Code, CI/CD pipelines, Root Cause Analysis, Load testing, Security vulnerability scanning, Compliance auditing (ISO 27001, SOC2, GDPR)
Preferred skills
Business Continuity planning, Disaster Recovery, Stakeholder collaboration
Technologies
Prometheus, Grafana, New Relic, AWS
Responsibilities
Implementing monitoring tools and dashboards to track system health in real-time; Performing expert-level troubleshooting and root-cause analysis for complex technical issues; Optimizing system performance and scalability under load; Identifying and mitigating security vulnerabilities; Ensuring operations meet legal and industry compliance standards.
Seniority
Senior, hands-on IC