Data Engineering Professional II
Core
Building and maintaining scalable data systems, pipelines, and datasets to support Business Intelligence, downstream systems, and data-driven decision-making.
Role type
Senior Data Engineer (Cloud & GenAI)
Builds
Scalable data pipelines, data integrations, and GenAI-powered solutions (RAG, LLMs) on AWS.
Domain
Healthcare / Pharma (Takeda) + Cloud Data Engineering
Deliverable
production ML models | product features | infrastructure
Required skills
AWS cloud technologies (DMS, Lambda, Databricks, SQS, Step Functions), SQL/NoSQL/Graph databases, dimensional modeling, API design (SOAP/REST), data pipeline development, unit/integration testing, data quality monitoring, GenAI/LLM integration, RAG pipelines, vector stores
Preferred skills
Aurora database optimization, DevOps collaboration
Technologies
AWS, Databricks, Lambda, SQS, Step Functions, Aurora, DMS, REST, SOAP, Vector Stores, LLMs
Responsibilities
Develop and maintain scalable data pipelines and new integrations using AWS native technologies; Collaborate with analytics and business teams to improve data models for BI tools; Implement processes for data reconciliation and quality monitoring; Write test scripts and document work; Troubleshoot data issues; Deploy data pipeline solutions in AWS environments meeting security requirements.
Seniority
Senior, hands-on IC