Data Engineer I, Zappos Analytics
Core
Design, build, and maintain robust data pipelines and ETL processes to acquire, process, and store data for analysis, reporting, and machine learning applications.
Role type
Data Engineer I
Builds
Data pipelines, ETL processes, and data warehousing solutions
Domain
E-commerce / Data Engineering
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Data modeling, ETL pipeline development, SQL/PL/SQL/HiveQL/SparkSQL, Python, Bash scripting, Data warehousing, Data quality validation, Pipeline monitoring
Preferred skills
Big data technologies (Hadoop, Hive, Spark, EMR), ETL tools (Informatica, ODI, SSIS, Datastage), Generative AI tools usage
Technologies
AWS, Hadoop, Hive, Spark, EMR, Informatica, ODI, SSIS, Datastage
Responsibilities
Design and maintain data pipelines from various sources; Develop and optimize ETL processes; Implement and manage data warehousing solutions; Establish data quality standards and perform validation; Optimize storage solutions for large volumes; Ensure data privacy and security; Collaborate with data scientists and analysts; Maintain documentation for pipelines and models; Implement monitoring solutions for pipeline failures.
Seniority
Entry-level, hands-on IC