Senior / Staff Software Engineer, ML Datasets & Data Pipelines
Core
Building scalable ML data pipelines to train and evaluate deep learning models for autonomous driving platforms.
Role type
Senior/Staff Software Engineer (ML Data Pipelines)
Builds
Scalable data pipelines for autonomous driving models using real-world driving data and high-fidelity simulators.
Domain
Autonomous driving / Physical AI
Deliverable
production ML models
Required skills
Python, deep learning frameworks (PyTorch, TensorFlow, JAX), distributed ETL, data processing pipelines, cloud job orchestration, monitoring, instrumentation
Preferred skills
Large scale distributed training optimization, MapReduce (Hadoop/Spark), orchestration frameworks (Airflow, Beam, Dataflow, Step Functions), autonomous driving data challenges, linear algebra, 3D geometry, multimodal sensor data (LiDAR, RADAR, camera)
Responsibilities
Design and implement data pipelines using real-world driving data and simulators; Optimize data formats, caching, and dataloading; Improve data sampling and composition for model performance tracking; Write high-quality, tested code; Drive project roadmap planning and delivery
Seniority
Senior/Staff, hands-on IC with mentorship