Data Engineer
Core
Design, build, and maintain scalable data pipelines and data warehouse solutions for large-scale data processing.
Role type
Data Engineer
Builds
Scalable data pipelines, ETL/ELT processes, and data warehouse solutions
Domain
Big Data, Data Engineering
Deliverable
production ML models | product features | dashboards & analysis
Required skills
PySpark, Python, SQL, ETL processes, data warehousing, distributed environments
Preferred skills
Apache Airflow, cloud platforms (AWS, GCP, Azure), data lakes, streaming tools (Kafka, Spark Streaming)
Technologies
PySpark, Python, SQL, Hadoop, Apache Airflow, AWS, GCP, Azure, Kafka, Spark Streaming
Responsibilities
Design and build scalable data pipelines, Develop and optimize complex SQL queries, Implement and manage ETL/ELT processes, Build and maintain data warehouse solutions, Handle large-scale data processing, Perform performance tuning of data workflows