Data Engineer
Core
Designing, building, and optimizing large-scale data pipelines and architectures on AWS to support business analytics and decision-making.
Role type
Senior Data Engineer
Builds
Scalable data pipelines, data lakes, and big data solutions
Domain
Cloud Data Engineering (AWS)
Deliverable
production ML models | product features | dashboards & analysis
Required skills
Python (Pandas, PySpark), AWS (S3, Athena, Redshift, EMR, Glue, ECS, RDS), SQL (MS SQL), NoSQL (DynamoDB, Postgres, Cassandra), Java, C++, Scala, Git, Workflow Orchestration, Hadoop, Spark, Kafka, Stream Processing (Kinesis, Firehose), Microservices, Containerization, ETL/ELT, CDC, API Integration
Preferred skills
Big Data solutions, Root cause analysis, Unstructured data processing, Metadata management, Cross-functional collaboration
Technologies
AWS, Python, PySpark, Pandas, MS SQL, DynamoDB, Postgres, Cassandra, Hadoop, Spark, Kafka, Kinesis, Firehose, ECS, RDS, Glue, Athena, Redshift, EMR, Git, Java, C++, Scala
Responsibilities
Build and optimize big data data pipelines and architectures; Perform root cause analysis on data and processes to identify improvement opportunities; Manipulate and extract value from large, disconnected datasets; Develop database solutions following best practices; Support cross-functional teams in a dynamic environment.
Seniority
Senior, hands-on IC