Junior Data Engineer
Core
Designing, developing, and maintaining scalable data pipelines and cloud-native architectures to support analytics, machine learning, and AI workloads.
Role type
Junior IC data engineer (cloud & AI data infrastructure)
Builds
Cloud-based data warehouses, lakehouses, streaming pipelines, and AI-ready datasets
Domain
Cloud data engineering, AI/ML data infrastructure
Deliverable
production ML models | infrastructure
Required skills
SQL, Python, data modeling, ELT/ETL patterns, data quality frameworks, cloud data pipelines, orchestration tools, feature engineering
Preferred skills
MLOps concepts, feature stores, vector databases, cloud certifications
Technologies
Snowflake, Redshift, PostgreSQL, MySQL, Airflow, AWS Step Functions, DBT, AWS Glue, Fivetran, Openflow
Responsibilities
Design and maintain scalable data pipelines for structured and unstructured data; Build and manage cloud-native data architectures; Implement modern ingestion and ELT pipelines; Collaborate with data scientists to understand data requirements; Develop and maintain high-quality, AI-ready datasets; Enforce data quality, validation, and observability controls; Design and evolve enterprise-scale data models; Optimize pipelines for performance, reliability, and cost; Enable access to curated data for GenAI use cases; Apply data governance, security, and privacy best practices.
Seniority
Junior, hands-on IC