Site Reliability Engineer
Core
Ensuring reliability, performance, and operational excellence of cloud-based services for Nasdaq's FinTech clients worldwide.
Role type
Senior Site Reliability Engineer (Platform Operations)
Builds
Mission-critical cloud systems and operational processes for global financial markets
Domain
FinTech / Cloud Infrastructure
Deliverable
production ML models | infrastructure
Required skills
Cloud platform management (AWS/Azure/GCP/OCI), Infrastructure-as-Code (Terraform, Ansible), Linux system administration, Containerization (Docker, Kubernetes), Networking (TCP/IP, firewalls, VLAN, VPN), Incident management, Disaster recovery planning, Scripting (Bash, Python), Monitoring tools (Datadog, AWS CloudWatch), Database knowledge (Oracle, PostgreSQL)
Preferred skills
AI tools proficiency (Copilot, LLM, RAG, AI agents), Financial institution experience, Security management expertise
Technologies
Terraform, Ansible, Docker, Kubernetes, Datadog, AWS CloudWatch, AWS, Azure, GCP, OCI, Bash, Python, Oracle, PostgreSQL
Responsibilities
Test, plan, and deploy changes to existing systems; Handle incidents and problems through to resolution; Facilitate disaster recovery tests and BCP activities; Identify and implement automation improvements; Drive security-first culture; Design and implement technical and process improvements for service delivery metrics
Seniority
Senior, hands-on IC