Technology, DevOps/Site Reliability Engineer
Core
Improving developer velocity by handling production application support escalations, managing infrastructure stack, and ensuring operational continuity for trading operations.
Role type
DevOps/Site Reliability Engineer
Builds
Production application support, infrastructure stack evolution, and operational continuity for trading systems
Domain
Financial services / Trading operations
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Linux/Unix systems administration, containerization and orchestration, database administration (relational/document), reverse proxy and TLS management, monitoring and logging, scripting (Bash/Python/PowerShell), incident response, root-cause analysis
Preferred skills
Customer-facing support experience, observability stack ownership, automation proficiency, self-service tooling development
Technologies
Reverse proxy, Identity & Access Management, Secret/Configuration Management, Certificate management, SQL/NoSQL Databases, OTEL/Metrics/Traces/Logs, Container Orchestration, Event Streaming
Responsibilities
Triage and resolve production application escalations, monitor application and infrastructure health, develop and maintain runbooks and operational documentation, own incident response and post-incident reviews, manage infrastructure stack upgrades and security hardening, maintain observability stack for quick issue detection
Seniority
Mid-level, hands-on IC