Site Reliability Engineer - Collaboration & Communication
Core
Design, develop, and maintain secure, high-quality production code and enterprise-scale software solutions while championing site reliability culture and operational stability.
Role type
Senior IC Site Reliability Engineer (Software Engineering)
Builds
Secure, high-quality production code, synchronous integrations, and complex application architectures
Domain
Financial services / Enterprise software engineering
Deliverable
production ML models | product features | infrastructure
Required skills
Linux, Bash, Python, system design, application development, testing, production stability, database querying, SDLC, CI/CD, application resiliency, security practices, cloud, containers, orchestration, network troubleshooting, SRE best practices, enterprise-authorized AI validation
Preferred skills
SIP, VoIP, technical re-engineering, modernization, data center migrations, partner engagements, inclusive team culture building
Technologies
Bash, CI/CD, Cloud, Docker, GitLab, Jenkins, Kubernetes, Linux, Python, Terraform
Responsibilities
Build and maintain secure, high-quality production code including synchronous integrations and algorithm maintenance; Produce architecture and design artifacts for complex applications; Analyze large datasets to generate insights and reports; Proactively identify hidden issues and patterns to improve coding hygiene and system architecture; Champion site reliability culture by defining, educating on, and operationalizing SLOs, SLIs, and error budgets; Lead cross-team operational work including platform planning, data center migrations, and audits; Use enterprise-authorized AI capabilities to accelerate incident triage, troubleshooting, and post-incident analysis while validating outputs; Identify patterns in operational signals indicating reliability risk and prioritize reuse-first improvements tied to SLO outcomes.
Seniority
Senior, hands-on IC