Service Reliability Engineer
Core
Engineer and implement solutions to increase system integrity, scalability, security, and reliability for a cloud video platform.
Role type
Service Reliability Engineer (SRE)
Builds
Cloud video management systems for security, business intelligence, and loss prevention
Domain
Cloud infrastructure / Video security
Deliverable
production ML models | infrastructure
Required skills
Cloud environments (AWS), CI/CD technologies, infrastructure automation, monitoring tools, scripting languages, C#, Java, C++, TCP/IP network protocols, service monitoring tools, Agile methodologies
Preferred skills
None explicitly stated as preferred
Technologies
AWS, Coralogix, Typescript, MySQL, CrateDB, Git, Java, JavaScript, Coralogix, Datadog, Prometheus, Grafana, Jira
Responsibilities
Engineer and implement solutions that increase system integrity, scalability, security, and reliability; Monitor, analyze, and improve system metrics; Implement, operate, and continuously improve monitoring, alerting, and observability systems; Participate in incident response, postmortems, and release health processes; Partner with cross-functional teams to plan and deliver strategic reliability and quality initiatives; Define, measure, and improve service-level indicators (SLIs) and objectives (SLOs); Identify trends and risks in system performance; Collaborate with DevOps Engineers on CI/CD pipeline optimization; Participate in capacity planning and performance tuning
Seniority
Mid-level (1-5 years experience)