Sr Data Engineer
Core
Design, build, and scale data products on a cloud lakehouse to power analytics, reporting, and AI/ML for Illumina's global operations.
Role type
Senior individual-contributor data engineer
Builds
End-to-end data products on Databricks and Snowflake (medallion architecture)
Domain
Life sciences / Genomics / Cloud Data Engineering
Deliverable
production ML models | product features
Required skills
Python (functional/OOP), SQL, data modeling, distributed systems, Spark, Delta Lake, dbt, data governance, CI/CD
Preferred skills
SAP domain knowledge, GxP/21 CFR Part 11 experience, Unity Catalog, Snowflake-to-Databricks migration, Power BI/Tableau
Technologies
Databricks, Snowflake, Spark, Delta Lake, Apache Iceberg, Parquet, dbt, Unity Catalog, AWS, Git, REST APIs
Responsibilities
Partner with business/AI teams to translate needs into scalable data products; Design and build pipelines from ingestion to curated datasets; Develop reusable Python frameworks; Design robust data models and distributed pipelines; Embed data quality, validation, and governance; Monitor, alert, and troubleshoot pipelines; Act as technical leader setting standards and mentoring engineers
Seniority
Senior, hands-on IC with leadership