Site Reliability Engineer III (DBA)
Core
Ensure stability, scalability, and reliability of production database systems (Vitess/Cassandra) while establishing operational foundations for a new SRE Database Engineering function. (via careerplan.io/jobs/5435915008-site-reliability-engineer-iii-dba-at-backblaze)
Role type
Senior IC Site Reliability Engineer (Database focus)
Builds
Highly available distributed database systems (Vitess, Cassandra) and operational runbooks for the team
Domain
Cloud storage, distributed databases, SaaS
Required skills
MySQL, distributed/sharded databases, Vitess, Cassandra, Linux, Kubernetes, Terraform, Ansible, Python/Bash/Go, SQL query tuning, disaster recovery, incident response, automation scripting
Preferred skills
AWS/GCP/Azure, SaaS experience, ITIL/OSS practices, mentoring engineers
Technologies
Vitess, Cassandra, Kubernetes, Docker, Prometheus, Grafana, ELK, FireHydrant, Terraform, Ansible, Jenkins, Vault, Nomad, kubectl, mysqlsh
Responsibilities
Design and own high-availability database architecture; develop operational runbooks and training materials for junior engineers; optimize performance via query tuning and capacity planning; execute disaster recovery testing and procedures; respond to production incidents and lead root cause analysis; automate operational tasks and integrate monitoring frameworks; partner with teams on resharding and architecture decisions
Seniority
Senior, hands-on IC
