Data Engineer
Core
Design, build, and scale distributed data pipelines and platforms to power decision-making and analytics for 100 million travelers.
Role type
Senior Data Engineer (Distributed Systems)
Builds
Scalable data pipelines, Databricks Lakehouse solutions, and data governance frameworks.
Domain
Travel technology / Big Data Engineering
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Python, SQL, Apache Spark, PySpark, Apache Airflow, Databricks, Delta Lake, Medallion Architecture, Unity Catalog, Data Quality Monitoring
Preferred skills
Data modeling, Architecture documentation, Code reviews
Technologies
Spark, PySpark, SQL, Databricks, Delta Lake, Airflow, Unity Catalog, Monte Carlo
Responsibilities
Design scalable Spark/PySpark and SQL pipelines; Create and manage data workflows; Implement and optimize Lakehouse solutions; Apply Medallion Architecture principles; Enable access control and lineage tracking via Unity Catalog; Establish data quality monitoring and optimize pipeline performance.
Seniority
Senior, hands-on IC