Site Reliability Engineer (DevOps) - Netherlands
Core
Build high-quality technology solutions for AI-native networking (Mist AI) SaaS applications, ensuring production environment reliability, scalability, and rapid scaling for Fortune 100/500 customers.
Role type
Senior Site Reliability Engineer (DevOps)
Builds
SaaS networking applications and infrastructure on AWS and GCP
Domain
Cloud infrastructure, AI-native networking, SaaS
Deliverable
production ML models | product features | infrastructure
Required skills
Distributed system design, Infrastructure as Code (Terraform, CloudFormation), Kubernetes administration, Continuous Integration/Deployment, Cloud platform management (AWS/GCP), Programming (Go, Java, Python), Metrics monitoring for SaaS
Preferred skills
Kafka, Spark, Cassandra, ElasticSearch, PostgreSQL, Redis, Zookeeper, Nginx, Airflow, Open Source contributions, Failure-based testing, Test-driven development
Technologies
AWS, GCP, Kubernetes, Terraform, Jenkins, Travis CI, CircleCI, Go, Java, Python, Kafka, Spark, Cassandra, ElasticSearch, PostgreSQL, Redis, Zookeeper, Nginx, Airflow
Responsibilities
Define and own KPIs for system availability, quality, and scale; Automate monitoring, alerting, and scalability; Implement redundant servers/services for business continuity; Manage after-hours infrastructure updates; Research and propose new technologies; Create Mist standards for Microservices; Run secure, scalable applications in multi-region deployments; Ship code several times per week; Participate in on-call rotation; Own disaster recovery and business continuity plans
Seniority
Senior, hands-on IC
