Site Reliability Engineer
Core
Architect and maintain the Project Delivery Cloud Platform for Trimble's AECO segment, ensuring reliability, scalability, and efficiency for digital construction solutions.
Role type
Senior Site Reliability Engineer (Cloud Infrastructure)
Builds
Production cloud environments, CI/CD pipelines, and observability solutions for Architecture, Engineering, and Construction clients.
Domain
Cloud Infrastructure / AECO (Architecture, Engineering, Construction)
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Infrastructure as Code (Terraform), Cloud Platform Management (Azure/AWS), Kubernetes, CI/CD Pipeline Management, Observability Tooling, Python Scripting, Incident Response, Capacity Planning, Cost Optimization, Networking, Security Concepts
Preferred skills
OpenTelemetry, AIOps, MLOps, SecOps, New Relic, DataDog
Technologies
Terraform, Azure DevOps, GitHub, Jenkins, Argo CD, Helm, New Relic, DataDog, Sumologic, Splunk, Prometheus, Grafana, Cloudwatch, Kubernetes, Python
Responsibilities
Develop and maintain infrastructure-as-code (IaC) with Terraform; Implement and enhance observability solutions; Perform code deployments and manage CI/CD pipelines; Automate routine tasks and workflows; Evaluate system designs for reliability and security; Lead incident response and root cause analysis; Develop and maintain runbooks and procedures; Collaborate with cross-functional teams on technical designs; Participate in on-call rotations; Continuously improve documentation.
Seniority
Senior, hands-on IC