Site Reliability Engineer
Core
Build and maintain the operational backbone for AI-driven autonomous vehicles, ensuring robustness, resilience, and reliability for urban mobility.
Role type
Site Reliability Engineer (Vehicle SRE)
Builds
Operational infrastructure and automation tools for autonomous vehicle fleets
Domain
Autonomous driving / Embodied AI / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Python, C++, Rust, Linux, cloud computing (AWS, GCP, Azure), monitoring and troubleshooting (DataDog, Prometheus, Grafana, OpenTelemetry, Splunk, Humio), systems foundations
Preferred skills
Azure, AV industry experience, embedded systems, ML/AI
Technologies
Python, C++, Rust, AWS, GCP, Azure, DataDog, Prometheus, Grafana, OpenTelemetry, Splunk, Humio
Responsibilities
Guarantee seamless operation of autonomous vehicles on public roads; Drive development of tools and automation for fleet management; Develop key metrics and monitoring/logging systems for rapid problem resolution
Seniority
Mid-Senior, hands-on IC