Middle/ Senior SRE Engineer
Core
Design, deploy, and manage Kubernetes clusters for a semantic layer platform bridging cloud data platforms (Snowflake, Databricks, BigQuery) with business users for AI-ready analytics.
Role type
Middle/Senior Site Reliability Engineer (SRE)
Builds
Production Kubernetes clusters, CI/CD pipelines, and infrastructure-as-code for a semantic data layer
Domain
Cloud infrastructure, Data & AI, Kubernetes
Deliverable
production ML models | infrastructure
Required skills
Kubernetes (networking, storage, RBAC), Helm charts, Terraform, Go, Python, TypeScript, AWS, Azure, GCP, Grafana, Mimir, Loki, Tempo, Open Telemetry
Preferred skills
AI/ML efficiency tools
Responsibilities
Design and manage Kubernetes clusters (EKS, AKS, GKE, self-managed) ensuring security and reliability; Build and maintain CI/CD pipelines and infrastructure-as-code; Participate in architecture discussions and client calls to resolve technical issues
Seniority
Middle/Senior, hands-on IC
