Data Solutions Engineer II , Enabling Functions Data
Core
Building and managing scalable data pipelines and data lakes using AWS and Databricks to support drug development and technology activities.
Role type
Senior IC data solutions engineer (cloud data engineering)
Builds
Production-grade data pipelines, data lakes, and data ecosystems
Domain
Healthcare / Pharma / Cloud Data Engineering
Deliverable
production ML models | product features | infrastructure
Required skills
Python, PySpark, SQL, AWS (Glue, Athena, Redshift, Postgres), Databricks (Lakehouse, Delta Lake, Unity Catalog, Workflows), data security and privacy best practices
Preferred skills
Enterprise Functions domain knowledge, process improvement
Technologies
AWS, Databricks, Delta Lake, Unity Catalog, PySpark, SQL, Glue, Athena, Redshift, Postgres
Responsibilities
Develop and optimize data pipelines using PySpark/SQL and Databricks; configure clusters and jobs; tune performance; manage production-grade data ecosystems; support data lakes and cloud-native architectures.
Seniority
Mid-Senior, hands-on IC