Data Engineer
Core
Build and maintain scalable data pipelines, real-time streaming, and data warehouse infrastructure to enable data-driven decision-making.
Role type
Data Engineer
Builds
Scalable ETL/ELT pipelines, real-time data flows, optimized data warehouse clusters, and data quality frameworks.
Domain
Cloud Data Engineering (AWS)
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Python, SQL, Apache Spark (PySpark), Apache Kafka, Apache Airflow, Amazon Redshift, AWS (S3, EMR, EC2, Lambda), Data Quality Checks, REST API Integration
Preferred skills
Team management, mentoring
Technologies
AWS, Kafka, Airflow, Redshift, Spark, Python, SQL
Responsibilities
Build and maintain scalable ETL/ELT pipelines using AWS; Develop and manage real-time data ingestion pipelines using Kafka; Build, schedule, and monitor end-to-end data workflows using Apache Airflow; Administer and optimize Amazon Redshift clusters; Implement automated data quality checks and observability; Integrate third-party and internal REST APIs into data pipelines; Monitor and optimize cloud costs across AWS services; Partner with BI teams to align data models with reporting needs.
Seniority
Mid-level, hands-on IC