Staff Software Engineer, Behavior ML Data
Core
Architecting and delivering complex, multi-system ML data engineering systems that transform massive autonomy data into high-value training signals for Level 4 autonomous driving AI models.
Role type
Staff Software Engineer (ML Data Infrastructure)
Builds
Scalable data ingestion/processing pipelines, active learning engines, data introspection tools, and automated labeling workflows for autonomy researchers.
Domain
Autonomous driving / Physical AI / Machine Learning
Deliverable
production ML models
Required skills
C++, Python, petabyte-level data management, end-to-end ML data pipeline architecture, active learning, uncertainty sampling, vector databases, embedding computation, system design for 24/7 production services
Preferred skills
Workflow orchestration, introspection UI/UX design, data-centric AI (pre-training), large-scale AI system productionization, robotics, deep learning, autonomous driving data utilization
Technologies
C++, Python, vector databases, ML frameworks
Responsibilities
Design scalable data ingestion and processing pipelines; develop infrastructure and visualization tools for data introspection and failure mode analysis; operationalize active learning methods to sample informative data points; define quality standards and automate QC for labeling operations; partner with ML researchers and infra teams to build data products and APIs.
Seniority
Staff, technical leadership & architecture