Python Developer (Data)
Core
Design, develop, and maintain scalable data-processing applications and pipelines using Python, Pandas, and PySpark to clean, transform, validate, and analyze structured and semi-structured datasets.
Role type
Senior IC Python Developer (Data Engineering)
Builds
ETL/ELT pipelines, data-processing components, and scalable data applications
Domain
Data Engineering / Cloud Data Platforms
Deliverable
production ML models | product features
Required skills
Python, Pandas, PySpark, SQL, ETL/ELT pipeline development, data validation, performance tuning, unit testing, CI/CD integration
Preferred skills
Databricks, Apache Spark environments, cloud platforms (Azure, AWS, Google Cloud), data lake/lakehouse architectures, workflow orchestration
Technologies
AWS, Azure, CI/CD, Cloud, Databricks, ETL, JSON, Python, PySpark, SQL, Spark, pandas
Responsibilities
Design and maintain scalable data-processing applications; Optimize Python and PySpark code for performance; Integrate data from multiple sources; Implement data validation, error handling, and monitoring; Perform unit testing, debugging, and code reviews; Collaborate with data engineers, analysts, and architects; Maintain documentation for data flows and technical designs
Seniority
Mid-Senior, hands-on IC