Data Engineer (Praca hybrydowa - Kraków) @ IT TALENTO
Core
Designing, developing, and optimizing scalable data pipelines and distributed data processing solutions for high-volume environments.
Role type
Senior Data Engineer
Builds
Scalable ETL/ELT pipelines and distributed data processing solutions
Domain
Enterprise Data Engineering, Cloud Data Platforms
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
PySpark, Python, SQL, Azure Data Factory, Distributed Data Processing, Data Modeling, Performance Tuning, Workflow Management
Preferred skills
Data Architecture Design, Troubleshooting, Optimization Strategies
Technologies
PySpark, Python, SQL, Azure Data Factory, Databricks
Responsibilities
Designing and maintaining scalable data pipelines using PySpark and Python, Creating and optimizing ETL/ELT processes for high-volume data, Processing structured and unstructured data from multiple sources, Building performant and scalable solutions adhering to Data Engineering best practices, Optimizing data processing performance (partitioning, caching, join optimization), Creating and managing workflows in Azure Data Factory, Maintaining data quality, consistency, and reliability, Solving performance issues in distributed processing environments, Collaborating with Data Scientists, Architects, and Business Analysts
Seniority
Senior, hands-on IC
