Job
Core
Design and operate the end-to-end observability stack (metrics, logs, traces) for a hybrid AWS and on-premise trading platform.
Role type
Senior IC Platform Engineer (Observability)
Builds
Production telemetry pipelines, dashboards, and alerting systems for engineering teams
Domain
Cloud Infrastructure / Observability / Trading Technology
Deliverable
production ML models | infrastructure
Required skills
VictoriaMetrics, OpenSearch, OpenTelemetry, Kafka, log shippers (Fluent Bit/Vector/Fluentd), Kubernetes, Terraform, Bash/Python scripting
Preferred skills
Strimzi, Argo CD, GitOps, Helm, Prometheus, Elasticsearch
Technologies
VictoriaMetrics, OpenSearch, OpenTelemetry, Kafka, Fluent Bit, Vector, Fluentd, Grafana, Kubernetes, Terraform, Argo CD, Helm, Prometheus, Elasticsearch
Responsibilities
Architect and run VictoriaMetrics cluster topology; Operate OpenSearch clusters with ISM and hot-warm-cold architecture; Build and maintain OTEL Collector pipelines; Run Kafka as the telemetry transport layer; Manage log shipping infrastructure; Build Grafana dashboards and alerting; Work with teams to improve sampling strategies; Contribute to incident response and reliability improvements; Mentor engineers on observability practices
Seniority
Senior, hands-on IC