Staff Data Engineer
Core
Design and build next-gen data platforms and pipelines using Python, PySpark, or Scala to ingest data from diverse sources into centralized lakes and cloud platforms, creating ESDM aligned Data Products and reports for strategic decision-making.
Role type
Staff Data Engineer (Gen AI & Data Mesh)
Builds
State-of-the-art data solutions, secure and reliable data products, and engineering roadmaps for long-term transformation.
Domain
Banking (Business Banking) + Cloud Data Engineering + Generative AI
Required skills
Python, PySpark, SQL, Scala, AWS Cloud (Glue, Lambda, Redshift, Athena, Kinesis, EMR), Terraform, CloudFormation, GitOps, Snowflake, Apache Iceberg, Data Governance, Policy-as-code, Automated testing, Observability, Data lineage
Preferred skills
AI-powered coding assistants (Cline, Roo, Aider), AWS Marketplace, API Gateway, Data monetization strategies, Data product thinking, Data mesh principles
Technologies
AWS, PySpark, Scala, Python, Snowflake, Apache Iceberg, Terraform, CloudFormation, GitOps, AWS DataZone, Lake Formation, IAM
Responsibilities
Design and build next-gen data platforms and pipelines; Integrate data from diverse sources into centralised lakes and cloud platforms; Create technology blueprints and engineering roadmaps; Ensure data security, governance, and compliance; Deliver end-to-end solutions that meet business needs; Define and evolve shared semantic models and metric definitions; Drive adoption of catalogues, glossaries, and stewardship practices; Embed policy-as-code for data access, classification, and retention; Implement automated testing, observability, and end-to-end lineage.
Seniority
Staff, hands-on IC with strategic scope