Sr Data Engineer – Research Data and Analytics
Core
Design, build, and maintain scalable data lake solutions and ETL pipelines for biopharma scientific data to drive research business decisions.
Role type
Senior Data Engineer (Research Data and Analytics)
Builds
Scalable data lake solutions, data pipelines, and data models for scientific datasets
Domain
Biopharmaceuticals / Bioinformatics / Big Data
Deliverable
production ML models | product features | infrastructure
Required skills
SQL, Python, PySpark, SparkSQL, workflow orchestration, data modeling, data warehousing, RDBMS (Oracle, MySQL, SQL Server, PostgreSQL), cloud platforms (AWS)
Preferred skills
Databricks Certified Data Engineer Professional, data visualization (Dash, Plotly, Spotfire), process mapping tools (Miro, Lucidchart), technical documentation (Confluence), data governance frameworks
Technologies
Databricks, Apache Spark, AWS, Confluence, Miro, Lucidchart, Dash, Plotly, Spotfire
Responsibilities
Design and implement data pipelines and ETL/ELT processes; manage data pipeline projects from inception to deployment; develop and maintain data models and documentation; optimize large datasets for query performance; collaborate with research scientists and cross-functional teams; implement data security and privacy measures; explore new tools to improve ETL platform performance
Seniority
Senior, hands-on IC