Site Reliability Engineer - Senior
Core
Senior Site Reliability Engineer responsible for debugging, stabilizing, and improving the reliability of a high-load, production-critical sportsbook platform.
Role type
Senior hands-on IC Site Reliability Engineer
Builds
High-load production platform for online sports betting
Domain
Internet / Sports Betting / Distributed Systems
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Go, PostgreSQL, Kubernetes, Observability (Grafana, ELK), Redis, Kafka/RabbitMQ, Distributed Systems under load
Preferred skills
High-load systems, Real-time systems, Internal tooling/automation
Technologies
Go, PostgreSQL, Kubernetes, Grafana, ELK, Redis, Kafka, RabbitMQ
Responsibilities
Investigate and resolve production issues across services; Perform deep debugging using logs, traces, and metrics; Tune system performance (DB queries, caching, load); Manage Kubernetes environments (deployments, scaling, troubleshooting); Improve observability (metrics, logging, tracing); Support integrations between services and external platforms; Write internal tooling and automation in Go; Diagnose issues in messaging systems (Kafka, RabbitMQ)
Seniority
Senior, hands-on IC