DevOps & Site Reliability Engineer
Core
Maintaining, optimizing, and scaling infrastructure for an AI-focused SaaS platform to ensure high availability and performance.
Role type
DevOps & Site Reliability Engineer
Builds
Cloud infrastructure, CI/CD pipelines, containerized environments, and observability systems for web, mobile, and API applications.
Domain
SaaS / AI / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Cloud platform management (Azure, AWS, GCP), Container orchestration (Docker, Kubernetes, Helm), CI/CD pipeline design, Monitoring and observability (NewRelic, Datadog, Prometheus/Grafana), Bash scripting, Incident response and disaster recovery planning.
Preferred skills
Experience deploying web, mobile, and API applications.
Technologies
Azure, AWS, GCP, Docker, Kubernetes, Helm, NewRelic, Datadog, Prometheus, Grafana, Jenkins, CircleCI, Azure Pipelines, Bash.
Responsibilities
Deploy and manage web, mobile, and API applications across cloud environments; Implement and maintain monitoring and observability tools; Design and optimize CI/CD pipelines; Manage containerized environments; Write automation scripts; Develop and maintain incident response processes and disaster recovery strategies; Collaborate with development, product, and operations teams to improve system reliability.
Seniority
Mid-level, hands-on IC