DATA ENGINEER JAVA SPARK
Core
Building, optimizing, and stabilizing data pipelines for the DatahubV2 platform using Java, Spark, and modern data architectures.
Role type
Senior Data Engineer (Java/Spark)
Builds
High-performance batch and distributed data processing pipelines, Spark as a Service on Kubernetes, and data workflows.
Domain
Banking / Data Platform
Deliverable
production ML models | product features | infrastructure
Required skills
Java, Apache Spark 3, Kubernetes, SQL, Python, Apache Airflow/Astronomer, CI/CD pipelines, Log analysis (ELK)
Preferred skills
Scala, cloud-native environments, banking context experience
Technologies
Spark 3, Kubernetes, Starburst (Trino), Astronomer, Apache Airflow, Gitlab, Jenkins, ArgoCD, ELK, Vault, S3
Responsibilities
Design and optimize distributed data pipelines; Develop and orchestrate Spark 3 workflows on Kubernetes; Integrate applications in Java/Scala; Manage CI/CD pipelines and log analysis; Collaborate on internal Python libraries and data practices.
Seniority
Senior, hands-on IC