Data Engineer - Data Products - (Hadoop, Spark, Kafka, Python, CA-7, ETL Data Warehousing)
Core
Design, build, and maintain scalable data service infrastructure and ETL pipelines on Hadoop, Spark, and Kafka platforms to support multiple applications and business objectives.
Role type
Data Engineer (Data Products)
Builds
Data services, ETL pipelines, and data lakehouse infrastructure for multiple applications
Domain
Financial Services / Big Data Engineering
Deliverable
production ML models | product features | infrastructure
Required skills
Apache Hadoop, Apache Spark, Kafka, Python, Batch data loading, Streaming data, CA-7 scheduling, Data lakehouse, ETL pipelines, Data warehousing, Apache Iceberg
Preferred skills
Spark SQL, Data Mining, Data Science, Machine Learning (ML)
Responsibilities
Develops, supports, and implements data services for multiple applications; Designs and builds data service infrastructure on multiple data platforms; Implements data migration and transformation activities to ensure accuracy and security.
Seniority
Mid-level (3+ years experience)