Application Operations Engineer
Core
Designing and implementing chaos engineering tests, automating DevOps/GitOps processes, and building systems to monitor and safeguard the reliability of virtualized infrastructure.
Role type
Application Operations Engineer (Chaos Engineering & Reliability)
Builds
Self-service automation tools, monitoring/alerting systems, and resilient infrastructure designs
Domain
Cloud Infrastructure & Reliability Engineering
Deliverable
production ML models | infrastructure
Required skills
Chaos engineering, DevOps practices, GitOps, Unix/Linux internals, networking (TCP/IP, SDN), system administration, troubleshooting
Preferred skills
None stated
Technologies
None explicitly listed beyond general categories
Responsibilities
Designing chaos engineering tests to simulate system failures, implementing remediation plans, running game days to test reliability assumptions, building proactive monitoring and alerting systems, troubleshooting network and system issues
Seniority
Entry-level, detailed instruction