Site Reliability Engineer III (Multiple Openings)
Core
Migrate and maintain applications on Google Cloud, ensuring operational resiliency, fault tolerance, and capacity planning while monitoring system health and managing incidents.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Production applications and services on Google Cloud
Domain
Cloud Infrastructure / FinTech
Deliverable
production ML models | product features | infrastructure
Required skills
Google Cloud Platform, Observability, Incident Management, Capacity Planning, Automation, System Design, Non-functional Requirements Analysis
Preferred skills
None stated
Technologies
Google Cloud
Responsibilities
Migrate and maintain applications in Google Cloud, Apply Observability concepts to maintain services, Monitor metrics and system health, Provide on-call rotation support for production systems, Drive designs for application operational resiliency and fault tolerance, Continually improve processes and systems by promoting automation
Seniority
Senior, hands-on IC