Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)
Core
Design and implement monitoring, alerting, dashboards, and APM instrumentation for applications and services in Azure to ensure reliability and production readiness.
Role type
Senior IC Site Reliability Engineer (Application Observability)
Builds
Production-ready applications with robust observability and monitoring capabilities
Domain
Cloud Operations / Application Performance Monitoring
Required skills
Azure IaaS, Application Performance Monitoring (APM), Log Analytics (KQL), Distributed Tracing, Structured Logging, Service Level Objectives (SLOs), Incident Analysis, CI/CD pipelines, Cloud-native architectures
Preferred skills
PowerShell, Bash, Scalability patterns, Resilience patterns, Production readiness initiatives
Technologies
Azure Monitor, Application Insights, New Relic, Databricks, DBT, SQL, Azure DevOps, GitHub Actions