Infrastructure Engineer
Core
Ensure production system availability and operational performance per SLA, lead incident resolution, and manage disaster recovery and data retention practices.
Role type
Infrastructure Engineer (Cloud Monitoring & Observability)
Builds
Production systems, monitoring dashboards, alerting configurations, and disaster recovery procedures for cloud environments.
Domain
Cloud Infrastructure, Observability, IT Operations
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Dynatrace (dashboards, synthetic monitoring, alerts, integrations), Nagios (plugin development, host/service configuration), Grafana (datasources, dashboards, alerting), AWS CloudWatch, GCP Cloud Monitoring, Azure Monitor, OCI Monitoring
Preferred skills
AppManager, OpManager, Site24x7, Kubernetes, Docker, Dynatrace Associate/Professional certification, AWS CloudWatch certification
Technologies
Dynatrace, Nagios, Grafana, AWS, GCP, Azure, OCI, Kubernetes, Docker
Responsibilities
Monitor production systems and ensure SLA compliance, lead incident resolution and service restoration, establish and maintain disaster recovery procedures, manage data retention practices for regulatory compliance and operational continuity.
Seniority
Mid-level, hands-on IC