Data Engineer
Core
Design, develop, and maintain complex ETL/ELT data pipelines, data integration frameworks, and metadata-driven architectures to enable seamless data access and analytics for biotech/pharma domains.
Role type
Senior Data Engineer (Big Data & Cloud)
Builds
Large-scale data pipelines and frameworks for self-service analytics and AI-driven insights
Domain
Biotechnology / Pharmaceutical / Big Data
Deliverable
production ML models | product features
Required skills
Databricks, PySpark, Scala, SQL, AWS, workflow orchestration, performance tuning, data modeling, data governance, data quality frameworks
Preferred skills
Biotech/pharma domain knowledge, API development, vector databases for LLMs, OLAP/OLTP data modeling, CI/CD pipelines, automated unit testing
Technologies
Databricks, PySpark, Scala, SQL, AWS, PostgreSQL, MySQL, SQL Server, MongoDB, JIRA, Confluence, Jenkins, Maven, Git
Responsibilities
Design and implement unified data access and governance solutions across hybrid cloud environments; ingest and transform structured and unstructured data from diverse sources; ensure data integrity through rigorous quality checks and monitoring; automate tasks and develop reusable frameworks; collaborate with cross-functional teams to translate business requirements into technical solutions (via careerplan.io/jobs/R-241791-data-engineer-at-amgen)
Seniority
Senior, hands-on IC
