Data Engineer I, DSP Analytics
Core
Design and build real-time and batch data pipelines to power Generative AI applications and automate data operations for Amazon's Delivery Service Partner (DSP) program.
Role type
Data Engineer I (IC)
Builds
Scalable data infrastructure and automated data operations agents for GenAI products
Domain
Logistics / Generative AI / Cloud Data Engineering
Deliverable
production ML models | infrastructure
Required skills
SQL, ETL pipeline development, data warehousing, data modeling, Python, scripting languages, database management, data quality validation, pipeline monitoring, data security compliance
Preferred skills
Big data technologies (Hadoop, Hive, Spark, EMR), AWS services (Redshift, S3, Glue, Kinesis, Lambda), Generative AI tool integration, schema design (relational vs dimensional)
Technologies
AWS, Redshift, S3, AWS Glue, EMR, Kinesis, FireHose, Lambda, IAM, Hadoop, Hive, Spark, Python, SQL
Responsibilities
Design and maintain robust data pipelines from diverse sources; Develop and optimize ETL processes; Implement data warehousing solutions; Establish and enforce data quality standards; Optimize storage for large volumes; Ensure data privacy and security; Collaborate with data scientists and analysts; Maintain documentation; Implement monitoring solutions; Research and implement emerging data technologies