CareerPlanSign in

Site Reliability Engineer II- CTJ - Secret

United States, Washington, Redmond💼 Full-time🗓 2026-03-26 → 2026-10-02

Core

Design, build, and maintain automation for deployment, operations, and incident mitigation in large-scale cloud or distributed systems to ensure service health and reliability.

Builds

Automated deployment pipelines, incident response tools, and observability instrumentation

Domain

Cloud infrastructure and distributed systems

Required skills

Automation, incident response, telemetry analysis, programming/scripting (C#, Java, Python, PowerShell), system administration

Preferred skills

Observability (MELT practices), root cause analysis, compliance processes in regulated environments

Technologies

C#, Java, Python, PowerShell, MELT

Responsibilities

Participate in 24x7 on-call rotation for monitoring and incident response; Design and maintain automation for operations and mitigation; Instrument services for observability and analyze telemetry; Support compliance with security and privacy requirements

Seniority

Mid-level, hands-on IC