Site Reliability Engineer
Core
Ensure uptime and reliability for ExperianOne, a Cloud SaaS platform for Decision Analytics and Fraud.
Role type
Site Reliability Engineer
Builds
Cloud SaaS platforms for Decision Analytics and Fraud
Domain
Financial Services / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Kubernetes, Linux, Networking, Incident Management, Infrastructure as Code, Cloud Native design, Python, SQL, Troubleshooting
Preferred skills
Experience with EKS, Splunk, Dynatrace, Thousand Eyes, ServiceNow, Jira, Jenkins, Java, Cassandra, Redis, Apigee, Okta, Postgres, AWS/Azure/GCP, Git Ops
Technologies
Kubernetes, EKS, Splunk, Dynatrace, Thousand Eyes, ServiceNow, Jira, Jenkins, Python, Java, Cassandra, Redis, Apigee, Okta, Postgres, AWS, Azure, GCP, Git
Responsibilities
Monitor system health and availability, triage issues and identify root causes, lead incident response, write complex queries, partner with development teams on release procedures, maintain relationships with global SRE teams, collaborate on maintainable solutions with developers and architects.
Seniority
Mid-level, hands-on IC
