Data Engineering Architect
Core
Design, build, and operate scalable data pipelines and Lakehouse architectures to deliver trusted datasets powering analytics, experimentation, and AI/ML use cases.
Role type
Senior Data Engineering Architect
Builds
Scalable data pipelines, production-grade datasets (Gold layer), and Lakehouse architecture components
Domain
Cloud data engineering, Lakehouse architecture, AI/ML data infrastructure
Deliverable
production ML models | product features
Required skills
SQL (query optimization, performance tuning), Python, Databricks, Spark, distributed data processing, ELT, layered data modeling (bronze/silver/gold), CI/CD, data quality monitoring, schema design, database migrations
Preferred skills
Product analytics data (event tracking, user behavior), dimensional modeling, domain-oriented modeling
Technologies
Databricks, Spark, SQL, Python, AWS, GCP
Responsibilities
Partner with stakeholders to translate KPIs into scalable datasets; Design and operate end-to-end data pipelines; Evolve Lakehouse architecture and data models; Build governed datasets for AI/ML; Enforce reusable data engineering patterns; Own data quality, validation, and incident resolution; Provide technical guidance to junior staff
Seniority
Senior, hands-on IC with architectural responsibilities