Data Engineer Intern
Core
Build and maintain batch and streaming data pipelines for production data platforms.
Role type
Data Engineer Intern
Builds
Production data pipelines and data processing applications
Domain
Data Engineering / Big Data
Deliverable
production ML models | product features | infrastructure
Required skills
Python, Java, Scala, Apache Spark, Apache Flink, Kafka Streams, SQL, ETL/ELT design, data modeling
Preferred skills
Apache Kafka, Spark internals, data warehouse/lakehouse platforms, cloud platforms (AWS/Azure/GCP), Kubernetes, Infrastructure as Code, CI/CD
Technologies
Apache Spark, Apache Flink, Kafka Streams, Python, Java, Scala, SQL, AWS, Azure, GCP, Kubernetes, Terraform, CloudFormation
Responsibilities
Build and maintain batch and streaming data pipelines; Develop data processing applications; Work with distributed processing frameworks; Assist in designing ETL/ELT workflows; Contribute to data models for data warehouses and lakehouse architectures; Participate in code reviews, testing, and operational best practices; Support performance tuning and pipeline optimization efforts