Reliability Engineer — Regulatory Reliability
Core
Own end-to-end reliability for IT regulatory infrastructure services, including connectivity, transaction processing flows, and settlement-related operational workflows.
Role type
Senior Reliability Engineer (Regulatory Infrastructure)
Builds
Mission-critical systems supporting real-time interbank transfers and regulatory integrations
Domain
Fintech / Banking Regulation / Cloud Infrastructure
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
SRE/DevOps production engineering, Linux performance tuning and security hardening, networking fundamentals (TCP/IP, routing), incident response and postmortem leadership, observability stack design (tracing, queue health), capacity planning, infrastructure-as-code (Puppet), Git workflows, scripting (Python/Shell), AWS services (EC2, S3, CloudWatch, EKS, VPC, RDS, SQS), regulatory audit experience
Preferred skills
Mexican payment rails (SPEI), SQL for operational analysis, cloud certifications (AWS Cloud Practitioner+)
Technologies
VxRail, Prometheus, Grafana, AWS (EC2, S3, CloudWatch, KMS, EKS/ECS, VPC, RDS, DynamoDB, SQS/SNS), Puppet, Claude, Cursor, Claude Code
Responsibilities
Define and improve SLIs/SLOs for critical transactions, lead incident response and recovery, design observability for regulatory links, execute disaster recovery exercises, automate operational toil, partner with security and networking teams, participate in on-call rotation
Seniority
Senior, hands-on IC