SW Engineer- Developer Systems Reliability Engineering
Core
Build and advance Site Reliability Engineering (SRE) practices for Visa's Cloud Platform to ensure security, availability, reliability, and performance for development teams.
Role type
Senior IC Site Reliability Engineer (SRE)
Builds
Visa Cloud Platform (IaaS, PaaS, Container-as-a-Service)
Domain
Payments technology / Cloud Infrastructure
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
Observability (Grafana, Prometheus, Splunk, Datadog), CI/CD (Jenkins, ArgoCD, Azure DevOps), Container orchestration (Kubernetes/OpenShift), Linux/Windows systems, Relational/NoSQL databases (MySQL, PostgreSQL, MongoDB), Python/Go/Java scripting, YAML/JSON, AI-AIOps tools (Copilot, ChatGPT)
Preferred skills
Platform engineering experience, Virtualization (Hyper-V, VMware), Terraform/Ansible/Helm, Distributed computing environments
Technologies
Kubernetes, Jenkins, ArgoCD, Grafana, Prometheus, Splunk, Datadog, MySQL, PostgreSQL, MongoDB, Python, Go, Java, Terraform, Ansible, Helm, OpenShift
Responsibilities
Drive operational excellence and automation to reduce toil; Own end-to-end observability, alerting, and monitoring; Deliver AI-AIOps initiatives for incident response; Partner with dev teams on release reviews and production readiness; Support 24-7-365 operating model and on-call coverage
Seniority
Senior, hands-on IC