SITE RELIABILITY ENGINEER II
Core
Maintain and document incident management across various portals and systems, serving as the first line of defense for 24x7 IT operations continuity.
Role type
Site Reliability Engineer (Operations)
Builds
Operational stability and incident response workflows for the Foundation Platform team
Domain
Financial Technology / Payments
Deliverable
production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work
Required skills
Windows and Linux server administration, networking, virtualization platforms, observability platforms, Infrastructure as Code (IaC), CI/CD, cloud environments
Responsibilities
Perform initial incident triage and determine business impact, register and document all incidents and interactions, keep users informed about incident status, maintain operational stability by resolving immediate problems and escalating to specialized teams
Seniority
Mid-level, hands-on IC
