Staff Site Reliability Engineer
Core
Managing, optimizing, and ensuring the reliability and scalability of SQL Server and PostgreSQL databases across cloud and on-premises environments.
Role type
Staff Site Reliability Engineer (Database)
Builds
High availability and disaster recovery architectures for mission-critical database systems.
Domain
Cloud infrastructure (Azure, AWS) and Database Administration
Deliverable
production ML models | product features | dashboards & analysis | research | client delivery | infrastructure | physical/clinical work
Required skills
SQL Server, PostgreSQL, Azure, AWS, Performance tuning, High availability, Disaster recovery, Backup/restore strategies, Database security, Scripting (PowerShell, Bash, Python), Infrastructure as Code, CI/CD pipelines, Observability tools (Datadog, Grafana, ELK, Prometheus), Kubernetes, Docker
Preferred skills
Containerized database environments, Cross-platform migrations
Technologies
Azure SQL, RDS, GitHub Actions, Azure DevOps, TeamCity, Datadog, Grafana, ELK, Prometheus, Kubernetes, Docker, PowerShell, Bash, Python
Responsibilities
Own architecture, design, deployment, and lifecycle management of databases; Lead database design reviews, schema governance, and query optimization; Manage database security, access controls, and compliance; Design and maintain HA/DR architectures; Implement backup strategies and recovery procedures; Perform proactive performance tuning and capacity planning; Develop automation for DBA operations; Collaborate on data model optimization and incident response; Establish monitoring standards and observability solutions; Contribute to CI/CD processes for database deployments.
Seniority
Staff, hands-on IC with strategic ownership