Senior Engineer - Site Reliability Engineering
Core
Senior SRE shaping reliability foundations, observability standards, and operational readiness for new and existing platforms in Markets and Risk Intelligence.
Role type
Senior hands-on IC Site Reliability Engineer
Builds
Production ML models | product features | infrastructure
Domain
Financial markets infrastructure / Cloud-native SRE
Deliverable
infrastructure
Required skills
SRE principles (SLOs, error budgets), Kubernetes, Azure (AKS, Container Apps, VNet, Entra ID), Datadog, observability (metrics, logs, traces), incident management, cloud cost optimization
Preferred skills
AWS, multi-cloud/hybrid environments, Infrastructure as Code (Terraform), vector databases, RAG architectures, Generative AI/LLM platforms, AI-integrated observability
Technologies
Azure, AKS, Azure Container Apps, VNet, Entra ID, Datadog, Kubernetes, Terraform, Prometheus, Grafana, ELK, OpenTelemetry
Responsibilities
Lead establishment of SRE foundations for new projects; Define and implement observability standards; Design monitoring and alerting solutions; Drive reliability improvements and incident reduction; Partner with Security teams; Lead handovers to BAU operations; Mentor engineers and shape standards
Seniority
Senior, hands-on IC with mentorship