Staff Data Reliability Engineer - Hybrid
Core
Ensure the integrity, quality, and availability of data assets and pipelines by applying SRE principles to the 'data journey' layer.
Role type
Staff Data Reliability Engineer
Builds
Reliable data products and pipelines for downstream consumers
Domain
Insurance, Data Engineering, SRE
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Data Service Level Objectives (SLOs), data observability, pipeline resiliency, automation, incident management, runbook creation, data warehousing, data lakes, ETL pipelines, data quality checks, AIOps, prompt engineering, DataOps
Preferred skills
.NET framework, ASP.NET, distributed compute (EMR/Hadoop), cloud native services
Technologies
Informatica, Python, Pyspark, Amazon EMR, Hadoop, Snowflake, AWS, GCP, SQL Server, Monte Carlo, Bigeye, Astro Observe, Datafold
Responsibilities
Establish and enforce Data SLOs for freshness, completeness, and accuracy; Implement data observability tools to monitor the data journey; Collaborate with Data Engineering to embed reliability patterns in pipelines; Automate data validation, reprocessing, and backfilling; Lead response and resolution for data-related incidents; Develop and automate data-aware runbooks for pipeline failures and recovery
Seniority
Staff, hands-on IC