Data Engineer
Core
Design, build, and operate scalable data pipelines and platforms on AWS to ingest, transform, and govern data for analytics, AI/ML, and business intelligence.
Role type
Data Engineer
Builds
End-to-end data pipelines, AWS data lake architectures, and secure data sharing patterns
Domain
Cloud Data Engineering (AWS)
Deliverable
production ML models | product features | infrastructure
Required skills
AWS data services (S3, Glue, Athena, Lambda, Step Functions), Python, SQL, data modeling, schema design, RDBMS (PostgreSQL, MSSQL, RDS), IAM, VPC networking
Preferred skills
Data quality checks, alerting mechanisms, root-cause analysis, cross-account data access patterns
Technologies
AWS, Amazon S3, AWS Glue, AWS Lambda, Step Functions, EventBridge, Amazon Athena, PostgreSQL, MSSQL, Amazon RDS
Responsibilities
Design and maintain batch and near-real-time data pipelines; Implement data ingestion from SFTP, databases, APIs, and on-premise systems; Develop data transformations using AWS Glue and SQL; Optimize storage formats and query performance; Manage AWS data lake architectures; Implement data quality checks and monitoring; Build alerting for pipeline failures; Provide L2/L3 support for production pipelines; Support cross-account data access and secure data sharing
Seniority
Mid-level, hands-on IC