Data Engineer
Core
Build and maintain reliable data pipelines, ETL/ELT workflows, and data models for analytics and internal tools to support software supply chain security.
Role type
Data Engineer (via careerplan.io/jobs/7ec5eac6-2adb-4554-8634-5dbb21034e1b-data-engineer-at-sonatype)
Builds
Clean, trusted datasets and data lakehouse architecture
Domain
Software supply chain security / Data Engineering
Deliverable
production ML models
Required skills
Java, Scala, Python (PySpark/pandas), SQL, Spark, Kafka, NoSQL (Cassandra, HBase), Data modeling, CI/CD, AI-assisted engineering tools
Preferred skills
dbt, Databricks, Terraform, CloudFormation, Real-time data pipelines, Data governance, ML pipelines
Technologies
AWS (S3, SNS, SQS, ECS/Fargate, EMR), Spark, Kafka, Cassandra, HBase, dbt, Databricks, Terraform, CloudFormation
Responsibilities
Build and maintain reliable data pipelines and ETL/ELT workflows; Develop and optimize data models for analytics and internal tools; Work with team members to deliver clean, trusted datasets; Support core data platform tools like Spark and AWS; Monitor data pipelines for quality, performance, and reliability; Write clear documentation and contribute to test coverage and CI/CD processes; Help shape data lakehouse architecture and platform roadmap
