Data Engineer
Core
Design and maintain ETL processes, transforming business logic from Python Pandas to distributed environments with PySpark for banking institutions.
Role type
Data Engineer
Builds
Data pipelines and data warehouse solutions for financial institutions
Domain
Financial services / Big Data
Deliverable
production ML models | product features
Required skills
ETL design, PySpark, Python Pandas, SQL (Oracle/SQL Server), Big Data ecosystems (Hadoop, HDFS, Hive), API integration, JSON processing, execution monitoring
Preferred skills
Agile methodologies, strategic project participation
Technologies
PySpark, Python, Pandas, SQL, Oracle, SQL Server, Hadoop, HDFS, Hive, ControlM, JSON, APIs
Responsibilities
Design and maintain ETL processes, Transform business logic from Python Pandas to distributed environments, Work with Big Data and Data Warehouse ecosystems, Integrate information from APIs, JSON, and SQL databases, Configure and monitor execution flows, Collaborate with technical and business teams using Agile methodologies
Seniority
Mid-level (2-3 years experience)