Site Reliability Engineer - Chicago
Core
Site Reliability Engineer responsible for maintaining cloud-based infrastructure, triaging incidents, and using enterprise-authorized AI to accelerate troubleshooting and reduce toil.
Role type
Mid-level Site Reliability Engineer
Builds
Cloud-based infrastructure and resilient services for Commercial and Investment Banking
Domain
Financial Services / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Cloud infrastructure maintenance, Incident triage and resolution, Observability (white-box/black-box monitoring, SLOs, telemetry), Linux/Windows administration, Containerization, Software engineering best practices, AI-assisted operational validation
Preferred skills
Continuous Integration/Continuous Delivery (CI/CD) practices
Technologies
AI, Cloud, Linux, Windows
Responsibilities
Triage, investigate, diagnose, and resolve incidents; Maintain cloud-based infrastructure; Implement observability patterns and alerting solutions; Use enterprise-authorized AI to accelerate incident triage and detect recurring toil; Write high-quality, maintainable code to reduce toil.
Seniority
Mid-level, hands-on IC