Data Engineer
Core
Design and implement robust, scalable data architectures and pipelines to enable efficient processing, integration, and visualization for business objectives.
Role type
Data Engineer
Builds
Data pipelines, data models, and analytical systems on AWS Cloud
Domain
Cloud data engineering and analytics
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Python, PySpark, Kafka, AWS native services, Databricks, Redshift, RDS, S3, ETL processes, data modeling, data cleaning, Power BI
Preferred skills
BI applications, data quality, performance tuning, pharmaceutical manufacturing operations, GMP regulations, industrial manufacturing processes
Technologies
AWS, Databricks, Spark, Redshift, RDS, S3, Power BI, Kafka
Responsibilities
Design and implement data pipelines; Develop and maintain optimal pipeline architecture; Design and optimize data models; Integrate and assemble large, complex datasets; Perform ETL processes; Customize and manage integration tools, databases, and analytical systems; Enhance internal Python libraries; Monitor and optimize data performance, uptime, and scalability; Create architecture and design documentation; Participate in technical planning, design, and peer code reviews
Seniority
Mid-level, hands-on IC