Lead Site Reliability Engineer
Core
Lead technical strategy, architecture, and operational maturity for mission-critical developer platforms (GitLab, CI/CD, Jira, Confluence, PostgreSQL) serving Air Dominance engineering teams.
Role type
Senior IC Lead Site Reliability Engineer (Technical Leadership)
Builds
Secure, reliable, and scalable developer tooling infrastructure, CI/CD pipelines, and database operations for classified engineering environments.
Domain
Defense/Aerospace, Cloud Infrastructure, DevOps, Database Operations
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Technical leadership, Site Reliability Engineering, DevOps, Cloud architecture (AWS/Azure/GCP), PostgreSQL administration, CI/CD platform architecture, Root cause analysis, Infrastructure as Code, Security hardening, Disaster recovery planning
Preferred skills
Enterprise GitLab/Jira/Confluence administration, Observability platform design, SLO framework development, Cybersecurity compliance, Technical strategy communication
Technologies
GitLab, Azure DevOps, Jira, Confluence, PostgreSQL, AWS, Microsoft Azure, Ansible, Docker, Kubernetes, Artifactory, SonarQube, Jenkins
Responsibilities
Define SRE technical strategy and architecture for developer tooling; Lead complex incidents and root cause analysis; Mentor SREs in operational excellence and architectural thinking; Drive automation and Infrastructure as Code to reduce toil; Establish reliability standards (SLIs, SLOs, error budgets); Guide major upgrades, migrations, and lifecycle planning; Partner with cybersecurity and program leadership on compliance and risk mitigation.
Seniority
Senior, hands-on IC with significant mentorship and strategic influence