Observability Engineer Expert
Core
Designing, implementing, and maintaining complex monitoring and observability platforms for infrastructure, applications, and services across hybrid environments.
Role type
Senior IC Observability Engineer
Builds
Monitoring solutions and alerting strategies for on-premise systems and public cloud platforms
Domain
IT Infrastructure & Cloud Operations
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Linux administration, networking fundamentals (TCP/IP, DNS, HTTP/S), incident investigation, root cause analysis, technical documentation, mentoring
Preferred skills
OpenTelemetry, Prometheus, Generative AI tools
Technologies
Nagios, Zabbix, Grafana, Nagios XI, AWS CloudWatch, Dynatrace, Azure Monitor
Responsibilities
Designing and maintaining monitoring platforms, integrating solutions with heterogeneous environments, defining alerting strategies and dashboards, collaborating with infrastructure and operations teams, contributing to incident investigation and hiring process
Seniority
Senior, hands-on IC