Senior Software Engineer - Data Platform (Spark & Trino)
Core
Architecting and building large-scale distributed data processing engines (Apache Spark and Trino) for mission-critical analytics, interactive analysis, and reporting in a multi-tenant cloud environment.
Role type
Senior IC distributed systems engineer (data platform)
Builds
High-velocity hybrid transactional/analytical engine, low-latency interactive engine, large scale cube builder engine
Domain
Cloud data infrastructure, distributed query processing
Deliverable
production ML models | infrastructure
Required skills
Java, Scala, Linux/Unix, Apache Spark, Trino/PrestoSQL, SQL, distributed systems internals, query processing, observability frameworks (Prometheus, Grafana, OpenTelemetry, JMX), cluster auto-scaling, fault tolerance design
Preferred skills
AI coding tools (Cursor), team leadership/mentoring
Technologies
Apache Spark, Trino, AWS, GCP, Prometheus, Grafana, OpenTelemetry, JMX
Responsibilities
Develop data processing algorithms for large datasets; design high availability and fault isolation strategies; build end-to-end tracing and alerting frameworks; optimize resource allocation and cluster auto-scaling
Seniority
Senior, hands-on IC