Data Engineer
Core
Design, build, and maintain scalable data pipelines and architectures to transform raw data into actionable insights for strategic decisions.
Role type
Data Engineer
Builds
Scalable ETL/ELT pipelines, data lakes, and data warehouse solutions
Domain
Cloud data engineering and big data processing
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Python, SQL, Apache Spark, Hadoop, ETL/ELT pipeline design, relational databases (SQL Server, PostgreSQL), NoSQL databases (MongoDB, Cassandra), cloud platforms (AWS, GCP, Azure), Apache Airflow, Git
Preferred skills
Redshift, S3, BigQuery, Azure Data Factory, Infrastructure as Code, CI/CD pipelines, containerized environments, data governance
Technologies
GitHub Copilot, Apache Spark, Hadoop, Apache Airflow, SQL Server, PostgreSQL, MongoDB, Cassandra, AWS, GCP, Azure, Git
Responsibilities
Design and develop scalable ETL/ELT pipelines for structured and unstructured data; Build and optimize data lakes and data warehouse solutions in cloud environments; Develop data ingestion and transformation processes; Work with distributed data processing frameworks; Orchestrate and monitor workflows; Ensure data quality, governance, and security; Collaborate with Data Scientists and Analysts; Optimize database performance; Implement version control and CI/CD practices; Participate in architecture discussions; Support cloud-based data solutions; Improve platform scalability through automation.
Seniority
Mid-level (3+ years experience)