AWS Lakehouse Data Engineer
Core
Design, implement, and operate a cloud-native AWS Lakehouse data platform powering AI/ML, analytics, and reporting using Amazon S3 and open table formats.
Role type
Senior IC AWS Lakehouse Data Engineer
Builds
Scalable batch and streaming ingestion pipelines, Delta Lakehouse-style data platform on S3, metadata governance services, and automated CI/CD environments
Domain
Cloud Data Engineering / AWS / Data Governance
Deliverable
production ML models | product features | dashboards & analysis
Required skills
AWS-native lakehouse architecture, Python, PySpark, Apache Iceberg, SQL, data governance, IAM, IaC, CI/CD, distributed systems optimization
Preferred skills
Databricks/Delta Lake migration, AWS Step Functions/MWAA/Kinesis, Terraform/CDK, BI tools integration, AI-assisted coding, Knowledge Graph/Graph RAG
Technologies
Amazon S3, AWS Glue, Amazon Athena, Amazon EMR, AWS Lake Formation, Amazon Redshift, Apache Iceberg, Apache Parquet, Python, PySpark, Terraform, AWS CDK, GitHub Actions
Responsibilities
Design and implement batch/streaming ingestion from APIs, databases, and event streams; Build and manage scalable lakehouse on S3 with ACID transactions and schema evolution; Implement data governance, lineage, and fine-grained access controls; Automate AWS provisioning and CI/CD pipelines; Optimize platform performance, cost, and reliability; Collaborate with cross-functional teams on data platform delivery
Seniority
Senior, hands-on IC