Senior Reliability Engineer | Engineering & Reliability @ ING Bank
Core
Senior Reliability Engineer driving SRE practices, systemic resilience, and end-to-end reliability for ING's critical business services in Romania using the One Engineering System (1ES).
Role type
Senior IC Site Reliability Engineer (SRE) / Reliability Authority
Builds
Critical Business Services, Digital Products, and resilient distributed systems
Domain
Banking / Cloud-native distributed systems
Deliverable
production ML models | product features | infrastructure
Required skills
distributed systems design, failure mode analysis, chaos engineering, error budget management, toil reduction automation, observability correlation, capacity planning, CI/CD pipeline design, microservices architecture, container orchestration, AIOps integration
Preferred skills
software development (Java/Kotlin/Python), networking fundamentals, database consistency models, blameless post-mortem facilitation, well-architected reviews
Technologies
Kubernetes, Docker, Azure DevOps, GitOps, Prometheus, ELK, service mesh, TCP/IP, SQL/NoSQL, 1ES
Responsibilities
Develop and mature SRE practices and resilience patterns; conduct deep failure-mode analysis and root-cause analysis; drive toil reduction and automation programs; manage error budgets as decision-making mechanisms; enable observability and capacity planning; act as technical authority for major incidents.
Seniority
Senior, hands-on IC with strategic influence