Site Reliability Engineer, Vehicle Software
Core
Build and improve tooling, automation, observability, and incident-management processes for vehicle software reliability, working closely with software engineers and field teams to debug real systems and improve production performance.
Role type
Senior IC Site Reliability Engineer (Vehicle Software)
Builds
Production vehicle software systems, observability tooling, and automation for incident management
Domain
Autonomous vehicles, embedded systems, Linux, distributed systems
Deliverable
production ML models | product features | infrastructure
Required skills
Python, C++, Rust, Linux debugging, CI/CD, containerization, networking, distributed systems, observability tooling (DataDog, Prometheus, Grafana, OpenTelemetry, Splunk, Humio), incident management
Preferred skills
Autonomous vehicles, robotics, embedded systems, safety-critical environments, large-scale telemetry, high-volume data pipelines, on-device software systems
Technologies
Python, C++, Rust, Linux, DataDog, Prometheus, Grafana, OpenTelemetry, Splunk, Humio
Responsibilities
Build and improve tooling, automation, observability, and incident-management processes; Diagnose reliability issues and improve system performance; Own hands-on debugging across Linux, low-level systems, logs, metrics, traces, and vehicle data; Develop reliability improvements to reduce manual intervention; Support vehicle-centric operations including safety-operator tools
Seniority
Senior, hands-on IC