Data Engineer
Core
Design, develop, and optimize scalable data pipelines, ETL processes, and data storage solutions to drive organizational decision-making and operational efficiency.
Role type
Data Engineer
Builds
Scalable data pipelines, ETL processes, data warehouses, and data lakes
Domain
Data Engineering / Big Data
Deliverable
production ML models | infrastructure
Required skills
ETL tools, SQL, relational and NoSQL databases, Apache Spark, Kafka, Hadoop, cloud platforms (AWS, Azure, GCP), Python, Java, Scala
Preferred skills
Apache Airflow, Luigi, data warehousing solutions (Redshift, Snowflake), Agile environment
Technologies
Apache Spark, Kafka, Hadoop, AWS, Azure, GCP, Grafana, AWS CloudWatch, Redshift, Snowflake, Apache Airflow, Luigi
Responsibilities
Develop and maintain scalable data pipelines and ETL processes; Assemble large, complex datasets; Collaborate with data architects, data scientists, and analysts; Monitor and troubleshoot data systems; Implement data governance and security measures; Design and optimize data storage solutions; Automate and improve data processes; Optimize database performance; Document data pipelines and best practices
Seniority
Mid-level (3+ years experience)