Data Engineer
Core
Design and maintain scalable data pipelines, ETL processes, and data models to support business intelligence and decision-making in an on-premises and AWS cloud environment.
Role type
Data Engineer
Builds
Scalable data pipelines, ETL jobs, data models, and API integrations
Domain
Civil Infrastructure / Enterprise Data Management
Deliverable
production ML models | product features | dashboards & analysis
Required skills
ETL pipeline development, data modeling (relational/dimensional), SQL, Spark/SparkSQL, data quality assurance, metadata management, API integration, unit/integration testing, Git, database management (Redshift, Oracle), file format handling (XML, CSV, JSON)
Preferred skills
AWS, Google Cloud Platform, Azure, open source and vendor tool evaluation
Technologies
Spark, SparkSQL, Redshift, Oracle, Git, XML, CSV, JSON
Responsibilities
Develop and maintain scalable data pipelines and ETL jobs; Design data integrations and data quality frameworks; Collaborate with analytics teams to improve data models for BI tools; Implement processes to monitor data quality and ensure data availability; Define company data assets and data models; Troubleshoot data issues and perform data analysis; Document work and contribute to engineering wiki.
Seniority
Mid-level to Senior, hands-on IC