Software Engineer II
Core
Design, implement, and operate monitoring, alerting, telemetry, and operational intelligence platforms for large-scale Azure services, focusing on incident detection, triage, and service health visibility.
Role type
Software Engineer II (SRE/DevOps focus)
Builds
Monitoring and alerting platforms, automation for incident management, dashboards for service health, deployment pipelines, and release engineering capabilities.
Domain
Cloud infrastructure (Azure), Site Reliability Engineering, DevOps, Distributed Systems
Deliverable
production ML models | product features | dashboards & analysis | infrastructure
Required skills
C#, C++, Java, Python, telemetry, monitoring, alerting, logging, metrics, tracing, diagnostics, automation, incident management, distributed systems, cloud platforms, service APIs, event-driven architectures, AI-assisted engineering tools, vector databases, RAG
Preferred skills
operational intelligence, site reliability engineering, production operations, service engineering, deployment pipelines, release orchestration, rollout automation, service validation frameworks, search technologies, information retrieval, AI-powered applications
Responsibilities
Design and implement components of monitoring and alerting platforms; develop automation for incident detection and mitigation; build dashboards for service health visibility; contribute to scalable logging and tracing infrastructure; develop deployment pipelines and release engineering capabilities; investigate production issues using telemetry; participate in DevOps and livesite operations.
Seniority
Mid-level, hands-on IC