Data Engineer
Core
Design, develop, and maintain scalable cloud-based Big Data products, ETL processes, and data infrastructure to support analytics and business intelligence.
Role type
Data Engineer
Builds
Cloud-based Big Data products and services, ETL pipelines, data warehouses, and data lakes
Domain
Big Data, Cloud Infrastructure, Data Engineering
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Java, Scala, Python, Apache Spark, Hadoop, AWS Glue, ETL pipeline design, SQL query optimization, data transformation (JSON, CSV, Parquet, Avro, ORC), workflow scheduling (Apache Airflow), SQL databases (Redshift, BigQuery, Delta Lake), unit testing, code reviews
Preferred skills
Apache Airflow, Cloud Data Warehouses, Data Lakes, Kubernetes, Machine Learning, Tableau
Technologies
Apache Spark, Hadoop, AWS Glue, Apache Airflow, Amazon Redshift, Google BigQuery, Delta Lake, Kubernetes, Tableau
Responsibilities
Implement and evolve cloud-based Big Data products; design and maintain ETL processes for analytics; optimize SQL queries for BI reporting; transform structured and unstructured data; write code, perform code reviews, and write unit tests; create proof-of-concept prototypes
Seniority
Mid-level, hands-on IC