Cloud Reliability Engineer (SRE)
Core
Build and operate cloud platforms for Adobe creative tools (Photoshop, Firefly, Express) using Kubernetes and AWS, focusing on reliability, scalability, and AI-assisted workflows.
Role type
Senior Site Reliability Engineer (SRE)
Builds
Microservice landscape, observability dashboards, infrastructure-as-code pipelines, and AI-driven automation for Adobe Creative Cloud.
Domain
Cloud Infrastructure, Distributed Systems, AI/LLM Operations
Deliverable
production ML models | infrastructure
Required skills
Kubernetes, AWS, Terraform, GitOps/CI-CD, Observability (Prometheus, Grafana, Splunk), Python, Golang, Java/Spring, HTTP/REST, Service Mesh
Preferred skills
MongoDB, Cassandra, DynamoDB, Agentic/LLM tooling, Data stores
Responsibilities
Improve platform reliability and cost-efficiency; build observability and alerting; maintain IaC and automated delivery; grow shared automation platform with AI; partner on capacity forecasting; set standards for AI in operations.
Seniority
Senior, hands-on IC