Middle Infrastructure Automation & Observability Engineer
Core
Design, build, and maintain Grafana dashboards and telemetry visualizations; develop Ansible playbooks for infrastructure automation; configure Prometheus monitoring and alerting.
Role type
Middle Infrastructure Automation & Observability Engineer
Builds
Grafana dashboards, Ansible playbooks, Prometheus alerting configurations
Domain
Enterprise IT infrastructure, DevOps, Site Reliability Engineering
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Ansible, Prometheus, Grafana, Git, CI/CD workflows, Linux administration, Python or Bash scripting
Preferred skills
Kubernetes, Mimir, Thanos, GitLab CI, ITIL processes, change management
Technologies
Ansible, Prometheus, Grafana, Git, AWX, Jira, Python, Bash, Linux (Ubuntu, RHEL)
Responsibilities
Design and maintain Grafana dashboards for system performance and platform health monitoring; Configure and maintain Prometheus monitoring and alerting solutions; Develop and maintain modular Ansible playbooks for infrastructure provisioning and operational workflows; Manage centralized execution and automation templates via AWX; Participate in Agile ceremonies including Sprint Planning, Daily Stand-ups, and Retrospectives; Collaborate with Product Owners and engineering teams to translate business requirements into actionable automation initiatives.
Seniority
Middle, hands-on IC