Data Engineer – R&D Multi-Omics (Open)
Core
Design, develop, and maintain data pipelines and integration solutions to support target and biomarker discovery in biopharma research.
Role type
Data Engineer (R&D Multi-Omics)
Builds
Scalable data pipelines, ETL/ELT processes, and data models for scientific research data.
Domain
Biopharma / Drug Discovery / Multi-Omics
Deliverable
production ML models | product features | infrastructure
Required skills
Python, SQL, Databricks, Apache Spark (PySpark), workflow orchestration, test automation (pytest), cloud computing (AWS)
Preferred skills
CI/CD, data modeling, data warehousing, data visualization (Dash, Plotly), technical documentation
Technologies
AWS, Databricks, Apache Spark, PostgreSQL, MySQL, Oracle, Git, Confluence, Miro, Lucidchart
Responsibilities
Design and implement data pipelines and ETL/ELT processes; optimize large datasets for query performance; contribute to data models and documentation; collaborate with research scientists and data architects; implement data security measures; participate in sprint planning and technical estimations.
Seniority
Mid-Senior (5-9 years experience)