Data Engineering Intern
Core
Design, develop, and maintain data pipelines to ensure clean, reliable, and timely data for GenAI projects.
Role type
Data Engineering Intern
Builds
Data pipelines, ETL processes, data models, and visualizations for GenAI applications
Domain
Generative AI, Data Engineering
Deliverable
production ML models
Required skills
Python, SQL, Data visualization, Data cleaning, Data transformation, Problem solving
Preferred skills
AWS, PySpark, Airflow, Data lakes, Data warehouses, Git
Responsibilities
Design and develop data pipelines; Implement and optimize ETL pipelines; Integrate data from various sources into warehouses and lakes; Support data management tasks including cleaning and validation; Understand business objectives and develop data models; Participate in client communications to gather requirements; Identify data quality issues and improve codebase. (via careerplan.io/jobs/23286-data-engineering-intern-at-loka-inc)
